Hallucinations de l'IA : comment obtenir des réponses sourcées et vérifiables
Pourquoi l'IA invente des références, comment l'en empêcher et quels réflexes adopter pour ne plus jamais citer un arrêt ou un article imaginaire.

L'essentiel en 30 secondes
- Une IA généraliste produit le texte le plus plausible, pas le plus exact : elle peut inventer avec aplomb.
- La parade : répondre à partir de documents et de bases officielles, citer chaque source et vérifier chaque référence.
- Un bon outil doit savoir dire « je ne trouve pas de source » plutôt qu'inventer.
Une « hallucination », c'est une réponse fausse présentée comme vraie : un arrêt qui n'existe pas, un article de loi abrogé, un chiffre inventé, une citation attribuée à la mauvaise personne. Pour un professionnel, c'est le risque le plus insidieux de l'IA générative, car la réponse a l'air parfaitement sérieuse.
Pourquoi l'IA invente
Un modèle de langage ne consulte pas une base de données : il prédit, mot après mot, la suite de texte la plus probable. Quand il ne « sait » pas, il produit quand même une réponse plausible. Une référence de jurisprudence a une forme reconnaissable (juridiction, date, numéro) : le modèle sait en générer une qui en a toutes les apparences.
Le problème s'aggrave sur les sujets pointus, récents ou propres au droit français, moins présents dans les données d'entraînement.
Des conséquences bien réelles
L'exemple le plus connu reste l'affaire Mata v. Avianca (New York, 2023) : des avocats ont été sanctionnés pour avoir déposé un mémoire citant des décisions inventées par une IA. Mais les erreurs ordinaires sont plus fréquentes : un taux d'une année précédente, un seuil modifié par la dernière loi de finances, un délai de prescription approximatif.
Première parade : répondre à partir de sources
La technique la plus efficace consiste à ne plus demander au modèle de « se souvenir », mais de lire. C'est le principe de la génération augmentée par recherche (RAG) : pour chaque question, le système recherche d'abord les passages pertinents dans vos documents et dans des bases officielles, puis demande au modèle de répondre uniquement à partir de ces passages.
La réponse peut alors citer sa source exacte : fichier, page, article, décision. L'utilisateur vérifie en un clic.
Deuxième parade : vérifier chaque référence
Même avec des sources, un modèle peut mal recopier un numéro ou mélanger deux décisions. Il faut donc une étape de vérification automatique : chaque référence citée est recherchée dans sa base d'origine avant d'être affichée.
- Un article de loi est vérifié dans Légifrance, dans sa version en vigueur à la date voulue.
- Une décision est retrouvée dans Judilibre ou dans la jurisprudence administrative.
- Une entreprise est contrôlée dans Sirene, le RNE et le BODACC.
- Une interaction médicamenteuse est vérifiée dans le thésaurus de l'ANSM.
Une référence introuvable n'est pas affichée comme vraie : elle est signalée.
Troisième parade : autoriser l'IA à ne pas répondre
Un outil professionnel doit préférer « je ne trouve pas de source fiable » à une réponse inventée. Cette capacité d'abstention est un critère de choix essentiel, souvent absent des assistants grand public conçus pour toujours répondre.
Cinq réflexes pour les utilisateurs
- Exiger une source pour toute affirmation factuelle.
- Ouvrir la source avant de réutiliser une référence.
- Se méfier des réponses trop parfaites sur des sujets pointus.
- Préciser la date des faits pour obtenir la bonne version d'un texte.
- Garder la décision : l'IA prépare, le professionnel valide.
C'est ainsi que fonctionne 4ct : réponses fondées sur vos documents et sur les bases officielles de votre métier, références vérifiées, et silence plutôt qu'invention.
Une IA privée, installée chez vous
4ct installe dans vos locaux un serveur d'IA et un logiciel prêts à l'emploi. Vos documents ne sortent jamais. Tout compris dès 477 € HT par mois.
Questions fréquentes
Peut-on supprimer totalement les hallucinations ?
Pas totalement, mais on peut les rendre visibles et rares : réponses fondées sur des sources, vérification automatique des références, abstention quand aucune source n'est trouvée, et validation humaine.
Un modèle plus gros hallucine-t-il moins ?
Souvent un peu moins, mais il hallucine toujours. La méthode (sources, vérification, abstention) compte davantage que la taille du modèle.
Voir aussi : 4ct pour les avocats


