En bref
Une base de données vectorielle est une base de données conçue pour stocker des embeddings - les vecteurs numériques qui représentent le sens de texte, d'images ou de code - et trouver en millisecondes ceux qui sont les plus similaires à un vecteur de requête. Une base de données normale est forte pour les correspondances exactes ("trouve la ligne où id = 42"), mais ne peut pas répondre : "trouve les passages qui veulent dire à peu près la même chose que cette question". Une base de données vectorielle le peut, car elle indexe par distance dans l'espace de sens plutôt que par valeurs exactes. C'est précisément cette capacité - une recherche rapide des plus proches voisins sur des embeddings - qui alimente le RAG, la recherche sémantique et les recommandations à grande échelle.
Ce qu'elle fait réellement
Vous embeddez votre contenu en vecteurs et les stockez. Au moment de la requête, vous embeddez la question entrante et demandez à la base les k vecteurs les plus proches. Elle les renvoie presque instantanément, même sur des millions d'entrées, à l'aide d'un index approximatif des plus proches voisins. Les hits sont les passages, produits ou enregistrements dont le sens est le plus proche de ce qui est demandé.
- Stocker : ranger chaque embedding avec le texte d'origine et des métadonnées.
- Indexer : construire un index approximatif des plus proches voisins pour que la recherche reste rapide à grande échelle.
- Interroger : embedder la question, ramener les k vecteurs les plus proches et renvoyer leur texte source.
Base vectorielle vs base de données normale
Une base relationnelle ou documentaire matche des champs exacts et des mots-clés. Une base de données vectorielle matche la similarité sémantique, pour qu'une requête formulée tout autrement trouve quand même le texte stocké. Elles sont complémentaires, pas rivales : beaucoup de systèmes filtrent par métadonnées dans une requête normale et trient par similarité vectorielle, et plusieurs bases classiques offrent désormais des index vectoriels, pour que vous ayez les deux au même endroit.
Quand vous en avez besoin
Vous avez besoin d'une base de données vectorielle dès que le RAG ou la recherche sémantique dépasse la taille jouet. Pour quelques centaines d'entrées, vous pouvez comparer les vecteurs en mémoire ; au-delà, un index vectoriel dédié garde la recherche rapide et bon marché. C'est la couche de stockage qui permet à un agent de raisonner sur vos documents privés, à un bot de support de répondre depuis votre centre d'aide et à une recherche de renvoyer des résultats par sens plutôt que par mots exacts.
