Les sources
Ce que l'assistant a le droit de lire. Un périmètre choisi, quelques dossiers d'abord et pas tout le drive. Pour chaque sujet, un document qui fait foi. Données RH, contrats et données clients sensibles exclus par défaut.
§ Base de connaissance IA
Vos procédures, vos offres, vos comptes rendus et vos réponses types existent déjà. Ils sont juste introuvables au moment où on en a besoin. Une base de connaissance IA permet à votre équipe de poser une question en français et d'obtenir une réponse tirée de vos documents, avec la source.
Réponse directe
C'est un assistant interne branché sur vos documents. Il ne répond pas avec ce qu'un modèle sait en général, mais avec ce que votre entreprise a écrit : procédures, contrats types, fiches produit, historiques de tickets. Chaque réponse renvoie au document d'origine, et chaque personne ne voit que ce qu'elle a le droit de voir.
RAG signifie « génération augmentée par la recherche ». Anthropic le définit ainsi : une méthode qui retrouve les informations pertinentes dans une base de connaissance et les ajoute à la question posée au modèle. Le modèle ne répond plus de mémoire. Il répond avec les bons passages sous les yeux.
En pratique, quatre étapes :
Le RAG n'est pas toujours nécessaire. Toujours selon Anthropic, une base de moins de 200 000 tokens (environ 500 pages) peut être donnée en entier au modèle. C'est la première chose que l'on vérifie : si vos procédures tiennent dans ce volume, la solution est plus simple et moins chère.
Quatre couches. Les deux premières décident de la qualité des réponses, bien plus que le choix du modèle.
Ce que l'assistant a le droit de lire. Un périmètre choisi, quelques dossiers d'abord et pas tout le drive. Pour chaque sujet, un document qui fait foi. Données RH, contrats et données clients sensibles exclus par défaut.
Ce qui permet de retrouver le bon passage. Les documents sont découpés et indexés par le sens, et l'index se met à jour quand un document change. L'hébergement est décidé avec vous, selon la sensibilité des données.
Qui peut voir quoi. Les droits d'accès de vos outils sont repris, pas réinventés. Le filtre s'applique au moment de la recherche, avant que le modèle ne lise quoi que ce soit.
Ce que voit la personne : une réponse rédigée avec les documents sources en lien, « je ne sais pas » quand rien ne correspond, et un journal des questions posées pour repérer ce qui manque dans la documentation.
§ Déroulé
On vérifie que le besoin est bien un problème de savoir introuvable, et si une solution sans développement suffit.
Un service, une famille de documents, une liste de vraies questions posées par l'équipe.
L'assistant répond sur ce périmètre. On note chaque réponse fausse ou incomplète et on corrige la source ou le réglage.
Part des questions correctement répondues sur la liste de test, et retours des utilisateurs.
Nouveaux périmètres, règles de mise à jour, code et documentation transmis.
Le chatbot est l'interface. La base de connaissance est ce qu'il y a derrière : vos documents indexés, les droits d'accès, les sources citées. Un chatbot sans base de connaissance répond avec ce que le modèle sait en général. Avec, il répond à partir de vos documents et montre d'où vient la réponse.
Non. Anthropic indique que si votre base fait moins de 200 000 tokens, soit environ 500 pages, on peut la placer entièrement dans le contexte du modèle, sans RAG. Pour quelques procédures et un catalogue, un projet Claude avec les bons documents suffit souvent. Le RAG se justifie quand le volume dépasse ce seuil, quand les documents changent souvent ou quand les droits d'accès diffèrent selon les personnes.
C'est le cas normal, et c'est le vrai chantier. Une base de connaissance ne répare pas des documents contradictoires : elle les expose. On commence donc par un périmètre réduit, on choisit pour chaque sujet le document qui fait foi, on écarte les versions périmées. Cette étape compte plus que le choix de la technologie.
Pas si les droits sont appliqués au moment de la recherche, ce qui est notre règle : la base ne remonte à une personne que les passages des documents qu'elle peut déjà ouvrir. Les données RH, les contrats et les données clients sensibles sont exclus par défaut et ajoutés seulement après une décision explicite.
Oui. Une base de connaissance réduit les réponses inventées, elle ne les supprime pas. C'est pour cela que chaque réponse cite ses sources et que l'assistant doit dire qu'il ne sait pas quand rien ne correspond. On mesure la qualité sur une liste de questions réelles avant de l'ouvrir à l'équipe.
Sur devis après l'audit gratuit. Le coût dépend surtout du volume de documents, du nombre de sources à brancher et de la finesse des droits d'accès. L'audit sert à vérifier d'abord si une solution simple, sans développement, répond au besoin.
Page mise à jour le par Simon Beros, fondateur de Waimia.