« On branche une IA sur vos PDF » cache une dizaine de techniques très différentes, avec des forces et des pièges connus. Voici le paysage tel que la recherche le décrit, puis les principes qui guident nos choix — pas la recette exacte, mais le pourquoi.
| Technique | Ce qu'elle fait | Sa limite |
|---|---|---|
| Recherche par mots-clés (BM25) | Retrouve les passages qui partagent les mots exacts. Rapide, exacte sur les codes (« RR42 », « 45 Nm »). | Aveugle aux synonymes et aux paraphrases du terrain. |
| Recherche vectorielle (embeddings) | Retrouve par le sens : « ça ne monte pas en pression » trouve « perte de charge » même sans mot commun. | Peut rater une correspondance exacte de code; dépend du modèle. |
| Recherche hybride (fusion) | Combine les deux et fusionne les classements. La recherche la recommande largement comme socle robuste. | Demande un réglage soigné de la fusion. |
| Reranking | Réordonne les candidats selon leur vraie pertinence à la question. | Coût de calcul; inutile si le rappel initial est mauvais. |
| Vérification de citation (grounding) | Contrôle que chaque affirmation est appuyée par une source avant de l'afficher. C'est ce qui fait chuter les hallucinations. | Un appel de vérification en plus; exige de bonnes sources. |
| GraphRAG (graphe de connaissances) | Construit un graphe d'entités pour raisonner sur des liens complexes. | Lourd à bâtir et à maintenir; souvent surdimensionné. |
| Fine-tuning du modèle | Ré-entraîne le modèle sur vos données. | Coûteux, fige le savoir, ne cite pas ses sources, se périme. |
Notre séquence exacte — l'ordre, les seuils, les réglages — est notre travail d'ingénierie, et on ne la publie pas. Mais les principes qui la gouvernent, eux, sont transparents. Ils découlent tous d'une même obsession : une réponse fausse coûte plus cher que pas de réponse.
Un technicien écrit « ça chauffe » mais votre manuel dit « surchauffe palier » — et il tape aussi « RR42 » qui doit matcher au caractère près. Ni le mot-clé seul ni le vecteur seul ne suffisent. On combine, comme le recommande la recherche.
C'est le principe qui nous distingue le plus d'un « chatbot sur PDF » : une réponse non appuyée par une source n'est pas affichée. C'est exactement le mécanisme que la littérature associe aux plus hauts taux d'exactitude de citation.
Quand un cas sort du documenté, l'assistant vous l'indique et transforme ce moment en fiche à faire valider. La recherche sur la fiabilité des systèmes le confirme : répondre là où l'on est sûr rend un système plus digne de confiance.
Pour du dépannage documentaire, nous privilégions un socle hybride robuste et une vérification stricte — efficace dès le premier jour, simple à exploiter. Les approches à graphe de connaissances restent en réserve pour les cas qui les justifieront vraiment, quand la complexité des liens l'exige.
Notre approche lit vos documents en direct : chaque réponse cite la page et reste à jour à chaque mise à jour de vos manuels, et vos données n'entraînent aucun modèle. C'est ce qui garde la citation exacte et l'isolation entre clients — là où ré-entraîner un modèle le figerait et lui ferait perdre le lien vers la source (contrepartie documentée).