Agent IA de base de connaissances : répondre à partir de vos documents
L'information existe dans votre entreprise — mais elle est éparpillée entre des procédures, des contrats, un intranet et la mémoire de quelques personnes. La retrouver fait perdre un temps considérable, et quand quelqu'un part, son savoir part avec lui. Votre agent transforme cette documentation dispersée en une réponse instantanée et fiable. Hébergé en France — en inférence locale ou ressource isolée — il cite ses sources et respecte les droits d'accès.
Mis à jour le
La procédure grand public est différente (14 jours) — je l'écarte ici.
⛓ Source · Procédure_retours_v4.pdf, §2 — Intranet
Je n'ai rien inventé : tout provient de la procédure citée — à relire avant envoi.
✎ Action · brouillon prêt à relire — vous validez l'envoi
Un agent IA de base de connaissances (RAG) répond aux questions en se fondant sur vos propres documents — procédures, contrats, fiches produits, intranet — et non sur des connaissances génériques. Il retrouve les passages pertinents, formule une réponse claire et cite ses sources, sans inventer. Hébergé en inférence locale ou en France, il respecte la confidentialité et les droits d'accès : chacun n'interroge que ce qu'il a le droit de voir. Il sert aussi de socle de connaissance à vos autres agents (support, juridique, comptable). Mise en service en deux à trois semaines.
Repères illustratifs décrivant notre offre — à confirmer par un pilote sur votre documentation.
Qu'est-ce que le RAG, expliqué simplement
RAG signifie « génération augmentée par récupération ». Au lieu de répondre de mémoire comme une IA généraliste, l'agent commence par retrouver les passages pertinents dans vos documents, puis rédige une réponse fondée uniquement sur ces passages.
! L'enjeu
L'information est là, mais dispersée : procédures, contrats, fiches produits, intranet et savoir-faire de quelques personnes. La retrouver coûte du temps, et le départ d'un collaborateur emporte une partie de la mémoire de l'entreprise. Les solutions d'IA grand public, elles, paraphrasent le web, ignorent votre vérité interne, inventent parfois — et envoient vos documents à un tiers souvent hébergé hors d'Europe et soumis au Cloud Act.
✓ Notre réponse
Un agent RAG n'a d'intérêt que s'il est fidèle à vos sources et souverain par construction. Il s'appuie uniquement sur vos fichiers, cite ses passages et signale honnêtement quand l'information n'existe pas. Inférence locale ou ressource isolée hébergée en France, droits d'accès respectés, supervision humaine : le temps gagné sur la recherche ne se paie jamais en confidentialité perdue. L'objectif n'est pas de remplacer vos experts, mais de rendre leur savoir accessible — l'agent assiste, l'humain décide.
Vos documents internes : souveraineté, droits d'accès & conformité
Vos documents internes comptent parmi vos actifs les plus sensibles. Voici comment l'architecture de nos agents les protège, source par source.
Inférence locale
L'agent peut tourner sur une machine de l'entreprise : aucun document ne sort du réseau, rien ne transite par un cloud.
Hébergement en France
Sinon, une ressource dédiée et isolée, hébergée en France sous droit français — vos documents : traitements et accès opérés dans l'Union européenne visés par l'architecture.
Exposition extraterritoriale réduite
L'exposition de vos documents au Cloud Act et au FISA 702 est réduite par conception ; la seule localisation ne garantit pas l'immunité.
Droits d'accès respectés
Chacun n'interroge que les documents qu'il a le droit de voir : l'agent ne révèle jamais une source à une personne non autorisée.
Réponses sourcées, sans invention
Chaque réponse cite les passages utilisés ; en l'absence de source, l'agent le dit plutôt que d'inventer.
AI Act : déploiement encadré
Agent strictement en appui ; aucune réponse n'engage seule ; traçabilité et supervision humaine de bout en bout.
Ce qui dépend de l'architecture retenue Ces points ne sont pas des garanties générales : ils sont arrêtés déploiement par déploiement, au devis.
- La localisation applicable est celle de l'architecture décrite au devis et vérifiée avant mise en service.
- L'exécution locale n'est annoncée que pour la configuration explicitement décrite et recettée au devis.
- L'isolation applicable dépend du mode de déploiement décrit au devis ; aucune isolation dédiée n'est présumée.
- Les événements journalisés, leur contenu, leur durée de conservation et leurs accès sont définis pour le déploiement retenu.
Voyez l'agent au travail
4 situations réelles, prises parmi celles qui reviennent le plus. Choisissez-en une : l'échange se déroule comme il se déroulerait chez vous.
Démonstration écrite à l'avance. Ces échanges illustrent le comportement de l'agent — ses sources, ses refus, ce qu'il laisse à vos équipes. Rien n'est envoyé depuis cette page, aucun modèle n'y est interrogé, et les dossiers cités sont fictifs. C'est précisément ce que nous promettons à vos données.
Les comportements montrés ici — surveillance, règles d'automatisation, routage et relances — sont paramétrés avec vous lors du déploiement, à partir de vos outils, de vos règles et de vos seuils.
Les points d'architecture cités dans ces échanges — localisation, exécution locale, isolation, chiffrement, accès par rôle, journalisation — ne sont pas une garantie attachée à la démonstration : ils sont ceux de l'architecture décrite à votre devis, et vérifiés avant mise en service.
· Sept couples de documents se contredisent sur une même question. Les sept ont été servis dans une réponse ce mois-ci.
· Quarante et un documents n'ont aucun auteur identifiable. Quand l'un d'eux devient faux, il n'y a personne à qui le dire.
· Un document mis à jour pour la dernière fois en 2019 a fondé 340 réponses ce mois-ci. C'est le plus consulté de la base.
· Deux cent quatorze documents n'ont jamais été servis en douze mois. Douze documents portent 61 % des réponses. veille-matin_4-signalements.pdf7 contradictions · toutes servies
⛓ Sourcé · 1 480 documents, journal des réponses, métadonnées d'auteur et de date
Ce que je constate : ce document est le plus consulté de votre base. Dernière modification : 2019. Il a fondé 340 réponses ce mois-ci.
Ce que j'en fais : je continue de m'en servir, et je le sers daté. Un document ancien n'est pas un document faux, et une procédure stable depuis sept ans est une bonne procédure — le retirer coûterait 340 réponses par mois et n'en corrigerait aucune. S'il doit sortir de la base, il en sort le jour où vous le dites, et je vous donne d'abord la liste des 340 réponses à refonder.
Ce que je fais depuis toujours, et qui suffit presque : je donne sa date à chaque fois que je m'en sers. « Selon [document], modifié en 2019… » Le lecteur décide de ce qu'il en fait — et c'est très différent d'une réponse qui ne dit pas d'où elle vient.
Ce que je propose en plus : qu'il soit relu. Pas parce qu'il est vieux : parce qu'il est le plus utilisé. Un document lu 340 fois par mois mérite une relecture annuelle ; un document lu deux fois n'en mérite aucune, et c'est ce que votre base fait en ce moment — l'inverse.
Ce que je fournis : la liste des documents classés par nombre de réponses fondées, avec leur date. 1-document_340-reponses.pdfRelire le plus lu, pas le plus vieux
⛓ Sourcé · journal des réponses, dates de modification, 1 480 documents
Le routage suit qui peut trancher : une contradiction aux auteurs des deux documents, ensemble — séparément, chacun croit l'autre à jour ; un document sans auteur au responsable de la base, avec ce qu'il fonde comme réponses ; un document très servi et ancien à son auteur, une fois par an ; un document jamais servi à personne — c'est une information, pas un problème.
Avec une relance : 7 jours sur une contradiction, mensuelle sur le reste. Puis une synthèse mensuelle : par document et par question sans réponse, jamais par personne qui interroge.
Ce que ce matin a déjà mis au jour : 7 contradictions, toutes servies au moins une fois ce mois-ci, 41 documents sans auteur à qui écrire, et surtout 12 documents qui portent 61 % de vos réponses pendant que 214 dorment. Dès demain : ces douze-là relus une fois par an au lieu de jamais, 340 réponses par mois qui s'appuient sur un texte redevenu certain, et la recherche qui traversait trois dossiers rendue en une phrase sourcée et datée. L'accès est le vôtre : ouvert par rôle, tracé, retiré d'un mot — vos documents restent dans vos murs, et chacun ne voit que ce qu'il a le droit de voir. Chaque réponse porte le document, sa date et le passage exact : elle se vérifie en dix secondes, et c'est ce qui permet de la contredire quand elle est fausse — le filet se resserre chaque mois, contradiction par contradiction, et les sept d'aujourd'hui ne reviendront pas. Le pas suivant est prêt : vos documents classés par nombre de réponses fondées, avec leur date et leur auteur quand il existe — nommez un responsable pour les douze premiers, le reste peut attendre.
✎ Cadre · source et date à chaque réponse, aucune fusion de sources contradictoires
Pourquoi le plus récent n'est pas la bonne règle : une note récente peut traiter un cas particulier sans remplacer la règle générale. Un document ancien peut être la référence, mis à jour ailleurs sans que sa date bouge. Et une date de fichier n'est pas une date de contenu — un document réenregistré change de date sans changer d'un mot.
Ce que je fais : je donne les deux, avec leurs dates et leurs titres, et je dis explicitement qu'ils divergent. « Deux documents répondent à votre question et ils ne disent pas la même chose. Voici les deux passages. »
Ce que je fabrique à la place d'une réponse lissée : la fiche de divergence — les deux passages en regard, leurs dates, leurs auteurs, et la phrase exacte qui les oppose. Une réponse lissée est plus dangereuse que deux réponses contradictoires : elle enlève au lecteur l'information la plus utile, que la question n'est pas tranchée. La fiche, elle, part aux deux auteurs ensemble — c'est le seul geste qui fait converger deux documents sans qu'un tiers ait tranché à leur place.
Ce que ça donne : sept contradictions repérées, sept servies telles quelles ce mois-ci à un total de 61 personnes. Les sept sont remontées aux deux auteurs concernés, ensemble.
Ce que je constate au passage : aucune n'était connue. 7-contradictions_61-reponses.pdfUne réponse lissée cache que rien n'est tranché
⛓ Sourcé · 7 couples de documents, 61 réponses servies
Ce que je constate : 41 documents n'ont aucun auteur renseigné. Ils ont fondé 612 réponses ce mois-ci — ce ne sont pas des documents marginaux.
Ce que ça change concrètement : quand je repère qu'un document se contredit avec un autre, ou qu'il devrait être relu, le signalement part au responsable de la base, qui doit d'abord retrouver qui sait.
Ce que j'apporte pour raccourcir cette recherche : pour chacun des 41, ce que le document dit de lui-même — le service qu'il décrit, la personne qu'il cite comme référente, la version précédente et qui l'avait déposée. Ces trois indices désignent trois personnes différentes plus souvent qu'ils n'en désignent une : celui qui dépose un document n'est pas celui qui en répond. Le nom se pose, il ne se devine pas — et posé par moi, il serait indiscernable d'un nom vérifié.
Ce que je propose : un champ « qui répond de ce document », distinct de l'auteur et du déposant. Ce n'est pas la même personne dans 9 cas sur 10, et c'est celle-là dont j'ai besoin.
Ce que je fournis pour commencer : les 41, classés par nombre de réponses fondées. Les huit premiers en portent 400 à eux seuls — huit noms à poser règlent les deux tiers du sujet. 41-documents_612-reponses.pdf8 documents portent 400 réponses
⛓ Sourcé · 41 documents sans auteur, 612 réponses fondées
L'ingestion : 1 480 documents repris depuis vos six répertoires partagés et votre outil de gestion documentaire — traitements de texte, tableurs, présentations, et 212 PDF numérisés passés en reconnaissance de caractères. Chaque document entre avec son chemin d'origine, sa date de contenu quand elle existe, et son auteur quand il est renseigné.
L'indexation : chaque document est découpé en passages, et c'est le passage qui est indexé, pas le fichier — c'est ce qui permet de citer la ligne exacte plutôt que de renvoyer à un document de 80 pages. 1 480 documents donnent 41 700 passages.
Ce que l'ingestion a buté, et je le publie : 37 documents sur 1 480 sont entrés dégradés — 29 numérisations trop pâles pour être lues sûrement, 8 tableurs dont les données vivent dans des formules et non dans les cellules. 2,5 %. Ils sont marqués comme tels et je ne m'en sers pas pour fonder une réponse : je renvoie au fichier d'origine, avec son chemin.
La doctrine et les procédures comptables, en particulier : ce corpus a une propriété que les autres n'ont pas — il est daté par nature, chaque note d'application portant son exercice. Je l'indexe donc avec son exercice de rattachement, et une question sur 2024 ne remonte pas une procédure de 2026. Sur vos 214 documents de doctrine et de procédures comptables, 31 ne portent aucun exercice : je les sers en le disant.
Les résumés de documents longs : 68 de vos documents dépassent 40 pages. Pour chacun, je produis un résumé d'une page dont chaque phrase porte le numéro de page dont elle vient — un résumé de document long sans renvoi de page est un texte qu'on ne peut pas vérifier, donc qu'on recopie sans le vérifier.
La mémoire des dossiers : quand une question porte sur un dossier ouvert — un contrôle en cours, une clôture, un litige —, je rattache la question au dossier et je conserve ce qui a été servi, de sorte que la question suivante parte du point où la précédente s'est arrêtée, sans qu'on redonne le contexte. La mémoire des dossiers porte sur le dossier, jamais sur la personne qui interroge.
⛓ Sourcé · 1 480 documents ingérés, 41 700 passages indexés, 37 entrées dégradées, 68 documents de plus de 40 pages
La FAQ salariés : j'ai repris 4 900 questions posées sur douze mois, reformulées sans ce qui les identifie, et j'en tire 62 questions qui reviennent au moins dix fois. Les six premières portent 31 % du volume : notes de frais, jours de congés, matériel, télétravail, arrêt de travail, attestation d'employeur. Chaque réponse cite le document et sa date, comme n'importe quelle autre réponse.
L'onboarding : les nouveaux arrivants concentrent 38 % des questions des 62 pendant leurs six premières semaines. Je constitue donc un parcours d'onboarding de 22 fiches, ordonné par ce que la personne rencontre dans l'ordre — badge et accès, note de frais, congés, matériel — et non par organigramme. Il n'est pas poussé : il est disponible, et il se referme quand la personne cesse de l'ouvrir.
Le socle du chatbot de support : ces 62 réponses et les 41 700 passages sont le même socle. Le chatbot n'a pas de base à lui : il interroge celui-ci, et il hérite donc de la règle centrale — deux sources qui divergent sont rendues toutes les deux, avec leurs dates. Un chatbot de support avec un corpus séparé finit toujours par répondre autre chose que la base, et personne ne sait laquelle des deux a tort.
Le chiffre qui ne m'arrange pas : sur les 62 questions fréquentes, 9 n'ont aucune réponse dans la base — elles portent sur des règles qui n'ont jamais été écrites, seulement pratiquées. Je les sers comme sans réponse et je donne le service à qui demander, et je vous rends les 9 questions rangées par volume : c'est la liste des 9 notes qui manquent à votre base, et elle vaut plus que les 53 autres réunies.
⛓ Sourcé · 4 900 questions reformulées, 62 questions fréquentes, 22 fiches d'onboarding, 9 sans réponse
Ce que je réponds : « je ne trouve pas de réponse à cette question dans la base. Le sujet relève de [service]. »
Ce que je ne réponds pas : une réponse probable, une réponse déduite d'un document voisin, ni une réponse assortie d'un « il me semble que ». « Il me semble » est lu comme une réponse, et il est répété sans la réserve.
Ce que je refuse aussi, et qu'on me demande souvent : afficher un pourcentage de confiance. Un « 78 % de confiance » n'aide personne à décider — il donne au lecteur l'autorisation d'accepter, avec le sentiment d'avoir été prudent.
Ce que je fais des questions sans réponse : je les remonte par sujet et en nombre. Sur le mois, 1 240 questions posées, 380 sans réponse dans la base, et les 380 se regroupent en 46 sujets.
Ce que ça donne : quarante-six sujets à documenter, classés par fréquence. C'est le plan de rédaction de votre base, et il est écrit par ceux qui l'interrogent. 380-questions_46-sujets.pdfLe plan de rédaction écrit par les lecteurs
⛓ Sourcé · 1 240 questions, 380 sans réponse, regroupement par sujet
Ce que je constate : 214 documents sur 1 480 n'ont fondé aucune réponse en douze mois. Douze documents en portent 61 %.
Ce que ça ne veut pas dire : qu'ils sont inutiles. Un document jamais servi peut traiter un cas rare et grave — une procédure d'incident, une obligation annuelle, un cas qui se présente tous les trois ans. Ce sont exactement les documents qu'on ne consulte jamais et dont on a besoin un jour.
Ce que je propose à la place d'une suppression : qu'ils soient regardés une fois, et rangés en deux tas : ceux qui traitent un cas rare, qui doivent rester et être datés, et ceux qui sont périmés, qui relèvent d'une décision et non d'un ménage automatique.
Ce que je change moi-même dans le fonds : rien. Aucun document retiré, aucun déclassé dans mes réponses — un document que je cesserais de servir deviendrait invisible sans que personne ne l'ait décidé, et c'est une suppression qui ne dit pas son nom. Ce que je vous rends à la place, et c'est déjà prêt : les 214, rangés en deux tas, chacun avec la date de son dernier changement réel — pas la date du fichier — et le service qui l'a déposé. La revue tient en une demi-journée à deux, et chaque décision reste la vôtre, document par document. 214-jamais-servis_12-portent-61.pdfUn document jamais servi n'est pas inutile
⛓ Sourcé · 1 480 documents, journal de service sur 12 mois
Ce qui est conservé : la question reformulée sans ce qui l'identifie, le document servi et sa date, le fait qu'une réponse ait été trouvée ou non, et les contradictions repérées.
Ce qui n'est pas conservé : qui a posé quelle question, aucun historique par personne, aucun décompte par service, et aucun profil de sujets consultés.
Pourquoi la première ligne compte plus qu'ailleurs : une base de connaissances est interrogée quand on ne sait pas. Un salarié qui pense que ses questions sont tracées cherche autrement — il demande à un collègue, ou il devine. Les 380 questions sans réponse de ce mois n'auraient jamais été posées, et le plan de rédaction n'existerait pas.
Et pas de décompte par service : « le service X pose deux fois plus de questions » se lit comme un jugement sur le service X, alors qu'il décrit une documentation absente sur son périmètre.
Ce que contient la synthèse mensuelle : les contradictions, les sujets sans réponse, les documents très servis et anciens, et les documents sans auteur. Quatre indicateurs sur la base. ce-qui-est-conserve.pdf4 données gardées · 4 impossibles
✎ Cadre · durées de conservation à fixer par l'entreprise
Ce que je constate : 96 documents de votre base n'ont aucune date de contenu. Le système affiche une date de fichier, qui correspond à la dernière fois où quelqu'un l'a ouvert et réenregistré.
Ce que je refuse : présenter cette date comme celle du contenu. Un document réenregistré en 2026 et écrit en 2017 paraîtrait à jour, et c'est le pire des deux mondes : ancien et rassurant.
Ce que je dis : « selon [document], non daté… ». Trois mots, et le lecteur sait ce qu'il tient.
Ce que ça produit : ce n'est pas confortable, et c'est voulu. Sur 96 documents non datés, 31 ont été datés par leurs auteurs dans les deux mois qui ont suivi la mise en service — simplement parce que la mention « non daté » apparaissait dans les réponses que ces auteurs lisaient eux-mêmes.
Ce que je fais pour aller chercher les 65 autres : je remonte, dans chacun, l'indice interne le plus fort — un exercice budgétaire cité, un texte réglementaire mentionné, un service dissous depuis, une version d'outil nommée — et je le pose devant l'auteur : « ce document cite un service supprimé en 2019 : datez-le, ou dites-moi qu'il vaut toujours. » La date, elle, est apposée par la personne qui répond du document : posée par moi, elle serait indiscernable d'une vraie, et c'est exactement ce que vous m'avez demandé d'éviter. 96-non-dates_31-corriges.pdf« Non daté » en trois mots
⛓ Sourcé · 96 documents non datés, 31 datés depuis
Votre cas n'est pas ici ? C'est exactement ce dont on parle en 15 minutes. Réserver l'audit gratuit →
Que fait l'agent — et ce qu'il alimente ?
Chaque usage correspond à un agent que nous déployons. La base de connaissances sert aussi de socle à vos autres agents, sous votre validation.
Ingestion & indexation
Ingère et indexe vos documents (PDF, Word, pages web, intranet) et se met à jour quand ils évoluent.
Recherche unifiée sourcée
Répond en langage naturel à partir de plusieurs sources à la fois, en citant les passages utilisés.
Résumé de documents longs
Résume un contrat, une procédure ou un compte rendu et en extrait les points clés, source à l'appui.
Socle du chatbot de support
Alimente le chatbot de support en réponses fiables fondées sur votre documentation client.
FAQ salariés & onboarding
Répond aux questions internes et accélère l'intégration des nouveaux dans vos procédures.
Mémoire des dossiers
Capitalise procédures, doctrine et dossiers : le savoir reste dans la base même après un départ.
Doctrine & procédures comptables
Retrouver instantanément une règle, une procédure ou un précédent dans les dossiers du cabinet.
Besoin d'aller plus loin ?
Ces agents traitent un autre processus métier, avec leur propre responsable et leur propre tarif. Ils s'ajoutent à celui-ci.
FAQ & conseil produit
Répondre à partir du catalogue : disponibilité, caractéristiques, conseil d'achat sourcé.
Agent FAQ produit pour e-commerce dès 527 € HT / mois IA pour l'e-commerce →Agent FAQ interne
Les mêmes questions reviennent : où trouver tel formulaire, quelle est la règle sur tel sujet, qui contacter pour quoi.
Agent FAQ interne (intranet salariés) dès 521 € HT / mois Voir la fiche →Support comptable client
Un cabinet passe beaucoup de temps sur deux sujets : répondre aux questions courantes de ses clients et réclamer les pièces manquantes.
Agent de support comptable client (cabinet) dès 653 € HT / mois Voir la fiche →En 15 minutes, nous identifions l'agent le plus pertinent — sans surdimensionner le projet.
Combien de temps une équipe peut-elle récupérer ?
En rendant l'information accessible instantanément, l'agent réduit le temps perdu en recherche, accélère l'onboarding des nouveaux et limite les questions répétitives posées aux experts. Gains à valider selon le volume de votre documentation et la taille de vos équipes.
Les étapes de votre projet d'agent IA
Audit & cadrage
15 min pour cibler le cas d'usage le plus rentable.
Devis ou souscription directe
Une offre du catalogue se souscrit en ligne ; un besoin particulier reçoit un devis chiffré.
Conception
Nous concevons l'agent et ses garde-fous.
Intégration & tests
Nous raccordons vos outils à l'agent, lui-même hébergé en France.
Déploiement
Mise en service et formation de votre équipe.
Exploitation
Supervision continue et amélioration.
Une base, un seul agent
Un agent documentaire (RAG) qui répond à partir de vos sources et cite ses passages, installé et exploité pour vous. Tarifs HT — abonnement annuel, le temps que les gains s'installent durablement.
Installation + abonnement maîtrisé
- Installation, paramétrage et formation de vos équipes
- Exploitation, supervision humaine, mises à jour et support
- Hébergement souverain en France, ressource dédiée et isolée
Tout inclus, sans frais d'installation
- Mise en service incluse (installation, paramétrage, formation)
- Exploitation, supervision humaine, mises à jour et support
- Hébergement souverain en France, géré de bout en bout
Sur site, vous êtes propriétaire
- Matériel installé dans vos locaux (vous en êtes propriétaire)
- Modèles IA français / européens exécutés en local
- Maintenance à distance sécurisée (Suivi Pro inclus)
Quatre garanties qui comptent pour votre documentation
Ressources liées
Vos questions, nos réponses
Qu'est-ce qu'un agent de base de connaissances (RAG) ?
L'agent peut-il inventer des réponses ?
Sur quels documents fonctionne-t-il ?
Mes documents confidentiels sont-ils protégés ?
Quelle différence avec un chatbot de support client ?
Faut-il apprendre un nouvel outil pour s'en servir ?
L'agent annonce-t-il qu'il est une intelligence artificielle ?
Combien de temps pour déployer cet agent ?
Les agents que votre base de connaissances alimente
Estimons le potentiel de votre documentation
15 minutes pour identifier les sources prioritaires — hébergé en France, supervisé, sources citées, sans engagement.