Préparer les documents pour un assistant IA : que mettre en ordre avant
Créer une base d'information utilisable, à jour et accessible aux bons rôles.
L'équipe éditoriale SqualiOnline · 2026-09-07
Un assistant IA ne sait rien de votre entreprise que vous ne lui ayez donné. Si trois versions de la même procédure cohabitent dans le dossier des documents, l'assistant en choisira une : pas la plus récente, mais celle qui est mieux écrite pour la question reçue. Un client se verra répondre avec les conditions de l'année dernière, et la réponse aura l'air aussi sûre que toutes les autres.
C'est pourquoi le vrai travail commence avant le système : mettre en ordre ce qui existe, quelle version fait foi, qui peut le voir et ce qui se passe quand la réponse n'existe pas. C'est un travail utile de toute façon, même si l'assistant ne se fait finalement pas : ce sont les mêmes choses qui ralentissent les nouveaux employés.
Inventaire : ce qui existe, qui en répond, quelle version fait foi
La première étape est une liste. Pas des dossiers, mais des documents qui contiennent des réponses : manuels, procédures, conditions de vente, fiches techniques, réponses déjà données par l'assistance. Pour chacun, quatre informations sont nécessaires.
| Document | Qui en répond | Dernière mise à jour | Qui peut le voir | Statut |
|---|---|---|---|---|
| Conditions de vente | Administration | Mis à jour cette année | Public | Valide, version unique |
| Manuel d'installation, modèle A | Bureau technique | Mis à jour cette année | Public | Valide |
| Manuel d'installation, modèle A (ancien) | Bureau technique | Figé depuis des années | Personne | À archiver hors des sources |
| Tarif revendeurs | Commercial | Mis à jour chaque trimestre | Interne | Valide, ne doit pas sortir |
| Procédure de retours | Assistance | Date inconnue | Public | À réécrire avant utilisation |
| Notes de la formation interne | Personne | Date inconnue | Interne | Exclu : personne ne le maintient |
Les lignes les plus utiles sont les deux dernières. Un document dont personne ne répond n'est pas une source : c'est du matériel d'archive. Et un document sans date ne peut pas être jugé, donc ne peut pas servir à répondre à un client.
Public, interne, confidentiel : la séparation vient avant
La classification n'est pas une formalité administrative : c'est ce qui empêche un assistant destiné aux clients de citer le tarif des revendeurs. Trois niveaux suffisent presque toujours.
- Public : peut être dit à quiconque écrit. Si vous ne diriez pas un contenu à un client inconnu au téléphone, il n'est pas public.
- Interne : sert aux employés, pas aux clients. Marges, conditions particulières, procédures qui révèlent l'organisation interne.
- Confidentiel : données personnelles, contrats individuels, informations sur des clients tiers. En général, cela n'entre pas dans les sources de l'assistant, et si cela y entre, cela a besoin de ses propres contrôles d'accès.
La règle pratique est que la séparation se fait par les permissions, pas par les instructions. Un assistant à qui l'on demande de ne pas révéler le tarif, mais qui a le tarif parmi ses sources disponibles, finira tôt ou tard par l'utiliser : il suffit d'une question formulée de façon détournée. Le document confidentiel ne doit pas être accessible, pas seulement déconseillé.
Des documents écrits pour être lus par fragments
Un assistant ne lit pas un manuel du début à la fin : il récupère les passages qui semblent répondre à la question. Un document pensé pour une lecture continue se comporte mal, parce que ses fragments ne tiennent pas debout seuls.
- Des titres vrais et spécifiques. Une section appelée « Généralités » ne dit pas de quoi elle parle ; « Garantie sur les pièces remplacées » si.
- Chaque section doit avoir du sens prise isolément. Les renvois implicites — « comme indiqué plus haut », « dans ce cas » — deviennent incompréhensibles dès que le fragment est extrait.
- Les informations qui comptent ne doivent pas se trouver dans une image. Un tarif photographié, un schéma scanné ou un document fait de pages acquises par scanner sont, pour le système, des pages vides.
- Les tableaux doivent rester des tableaux, avec les en-têtes répétés s'ils sont longs.
- Les conditions doivent être écrites intégralement là où elles servent : si la règle sur les retours dépend d'une pièce jointe qui ne fait pas partie des sources, la réponse sera incomplète et personne ne s'en apercevra.
- Mieux vaut un document court et exact qu'un document long et générique : la longueur n'aide pas la récupération, la précision si.
Ce qui doit se passer quand la source n'existe pas
C'est la décision qui distingue un système fiable d'un système dangereux, et elle doit être prise par vous, pas laissée aux réglages par défaut. Les possibilités sont peu nombreuses : répondre que l'information n'est pas disponible, proposer le contact avec une personne, ou ouvrir une demande interne.
Qui met à jour, et à quel rythme
Une base de connaissances se détériore en restant immobile. Les conditions changent, un produit sort de production, une procédure est remplacée, et l'assistant continue de répondre comme avant avec une parfaite assurance.
- Chaque document a un responsable avec un nom et un prénom, pas un service.
- Chaque document a une date de révision : quand il doit être revu même si personne ne signale rien.
- Il existe un seul endroit où il se met à jour. Si le document vit à deux endroits, l'un des deux sera périmé et vous ne saurez pas lequel.
- Quand un document est remplacé, le précédent sort des sources au même moment. Le renommer ne suffit pas : tant qu'il est accessible, il sera utilisé.
- Les questions auxquelles l'assistant n'a pas su répondre se relisent à intervalles réguliers : c'est la liste des documents manquants, écrite par les clients.
Si ce travail n'est pas soutenable — personne ne peut s'en occuper, personne ne peut dire quelle version fait foi — c'est une bonne raison de reporter le projet ou d'en réduire le périmètre à une seule zone, celle où les documents sont en ordre. Un assistant construit sur des sources que personne n'entretient aggrave la situation : il donne des réponses erronées plus vite qu'avant.
Ce que ce guide ne couvre pas
Ici, on prépare la connaissance : ce qui entre parmi les sources, sous quelle forme et avec quelles permissions. La façon dont on vérifie ensuite le comportement de l'assistant — les tests à faire avant de le mettre en ligne, le contrôle des réponses, la gestion des erreurs — est un travail distinct et ultérieur, traité ailleurs. Il vaut la peine de rappeler une distinction : mettre des documents à la disposition d'un système qui les récupère n'est pas la même chose qu'entraîner un modèle sur vos données, et les deux choses ont des implications différentes.
Questions fréquentes
Combien de documents faut-il pour démarrer ?
Moins que vous ne l'imaginez. Mieux vaut partir d'une zone circonscrite avec des documents à jour et un responsable — par exemple les conditions de vente et les questions fréquentes de l'assistance — que de charger l'archive entière. Le périmètre s'élargit une fois que le premier fonctionne.
Peut-on charger les documents tels quels ?
Cela dépend de comment ils sont faits. Les textes avec des titres clairs et des sections autonomes fonctionnent tout de suite. Les documents acquis par scanner, ceux qui contiennent les informations dans des images et ceux pleins de renvois internes doivent être refaits, sinon le système ne trouve pas ce que vous cherchez.
Que dois-je faire des anciens documents ?
Ils se déplacent hors des sources consultables, dans une archive séparée. Les conserver est souvent nécessaire, les rendre accessibles à l'assistant non : tant qu'ils sont dans le chemin, ils seront utilisés pour répondre, et aucune instruction ne l'empêche de façon fiable.
Évaluons ensemble si vos documents sont prêts pour un assistant IA.
Si vous voulez en parler, le service concerné est Intelligence artificielle.

