Le NL2SQL peut-il modifier ou supprimer des données en base ?+
Non, c’est mathématiquement impossible par conception. Le module aura-ai utilise la bibliothèque Rust sqlparser pour analyser l’arbre syntaxique abstrait (AST) de la requête produite par le LLM. Seules les requêtes de type SELECT sont autorisées. Toute instruction INSERT, UPDATE, DELETE, DROP ou ALTER est rejetée au niveau du serveur avant même d’atteindre PostgreSQL.
Quels fournisseurs d’IA et modèles sont pris en charge ?+
Aurabase intègre nativement Anthropic (Claude Sonnet 5, Claude Opus 5, Claude Haiku 4.5), OpenAI (GPT-4o, o3-mini, embeddings text-embedding-3-small/large), Google Gemini (Gemini 2.5 Flash, Pro), ainsi qu’Ollama pour les environnements 100% souverains hébergeant des modèles open-source (Llama 3, Mistral, Qwen) en local.
Pourquoi privilégier pgvector plutôt qu’une base vectorielle dédiée ?+
Dans 99% des applications modernes, les données métiers vivent déjà dans PostgreSQL. En intégrant pgvector avec indexation HNSW directement dans votre instance, vous éliminez la double facturation, la synchronisation complexe entre deux bases et la latence réseau inter-cloud. Vos requêtes peuvent ainsi joindre en une seule transaction vos vecteurs et vos tables relationnelles avec toutes les garanties ACID et les règles de sécurité RLS.
Comment mes clés secrètes d’API sont-elles sécurisées ?+
Chaque projet dispose d’un trousseau chiffré au repos par le moteur HashiCorp Vault Transit (aura-ai-kek). Les clés sont envoyées en écriture seule (write-only) et ne sont jamais renvoyées dans les réponses HTTP. Le service aura-ai déchiffre les clés en mémoire vive éphémère uniquement au moment d’effectuer l’appel sortant vers le fournisseur.
Comment fonctionne le comptage des tokens et la réservation de quota ?+
Pour éviter les abus et les facturations imprévues, Aurabase normalise les compteurs de tokens (input_tokens, output_tokens et reasoning_tokens). Avant chaque appel coûteux, une réservation atomique est inscrite dans PostgreSQL avec verrouillage consultatif, complétée par un rate-limiting glissant via Redis.