RAG (génération augmentée par récupération)
Technique qui retrouve les passages pertinents dans une base documentaire puis les fournit au modèle de langage pour qu'il réponde à partir de sources réelles et citables.
Technique qui retrouve les passages pertinents dans une base documentaire puis les fournit au modèle de langage pour qu'il réponde à partir de sources réelles et citables.
Le RAG enchaîne une recherche (par embeddings, par mots-clés ou hybride) et une génération : les passages trouvés sont insérés dans le prompt du LLM, qui répond en s'appuyant sur eux.
C'est le cœur de la Box : il permet d'interroger les dossiers du cabinet sans réentraîner de modèle, et de citer les documents utilisés. Il impose aussi la contrainte majeure du projet : la recherche doit être filtrée par les permissions de l'utilisateur avant d'atteindre le modèle.
Voir RAG et Permissions.