Vous demandez une référence à une IA : elle vous répond avec un titre d’article, un auteur, une date… et rien de tout cela n’existe. C’est ce qu’on appelle une hallucination : une information fausse, présentée avec autant d’assurance qu’une vraie.
Ce n’est pas un bug rare. C’est une conséquence directe du fonctionnement de ces outils. Bonne nouvelle : en comprenant pourquoi ça arrive, on peut réduire fortement le risque.
À retenir Une IA générative produit un texte plausible, pas un texte vérifié. Plus une information est précise (chiffre, date, citation, référence) et rare, plus le risque d’invention est élevé. Tout fait important doit être vérifié à la source.
Pourquoi les IA inventent
Un modèle de langage comme ChatGPT, Claude ou Gemini ne consulte pas une base de faits. Il a appris, sur d’énormes quantités de textes, à prédire la suite la plus probable d’un texte.
La plupart du temps, la suite la plus probable est aussi la bonne. Mais quand le modèle ne « sait » pas, il ne se tait pas forcément : il produit ce qui ressemble à une bonne réponse. Une référence scientifique plausible a un auteur, un titre et une année. Le modèle peut donc générer les trois, avec une parfaite cohérence de forme.
Deux facteurs aggravent le problème :
- le ton est toujours assuré : rien dans la formulation ne distingue une information solide d’une invention ;
- le modèle a une date limite de connaissances : sans accès à Internet, il ignore les événements récents et peut les combler au hasard.
Un cas célèbre
En 2023, aux États-Unis, dans l’affaire Mata v. Avianca, des avocats ont déposé devant un tribunal fédéral un mémoire citant plusieurs décisions de justice inexistantes, générées par ChatGPT. Le juge a constaté que ces jurisprudences n’existaient pas, et les avocats ont été sanctionnés.
La leçon vaut pour tout le monde : l’IA est un assistant de rédaction, pas une source.
Quand le risque est le plus élevé
| Type de demande | Risque |
|---|---|
| Reformuler, résumer un texte que vous fournissez | Faible |
| Expliquer un concept très connu | Faible à modéré |
| Donner des chiffres, des statistiques, des dates précises | Élevé |
| Citer des sources, des études, des articles de loi | Très élevé |
| Parler d’un sujet de niche, d’une personne peu connue | Élevé |
| Répondre sur l’actualité récente sans recherche web | Élevé |
7 méthodes pour s’en protéger
1. Fournir vous-même les informations
C’est la méthode la plus efficace. Collez le document, l’article ou les données, et demandez à l’IA de travailler uniquement à partir de ce contenu :
Réponds uniquement à partir du document ci-dessous.
Si l'information n'y figure pas, réponds « Non précisé dans le document ».
<document>
[collez votre texte]
</document>
2. Autoriser explicitement « je ne sais pas »
Les modèles ont tendance à vouloir répondre à tout prix. Donnez-leur une porte de sortie : « Si tu n’es pas sûr, dis-le plutôt que de deviner. » La documentation d’Anthropic recommande précisément cette technique.
3. Demander des citations exactes
Pour un long document, demandez à l’IA de citer mot pour mot les passages sur lesquels elle s’appuie. Il devient alors facile de vérifier que la réponse est bien fondée sur le texte.
4. Vérifier chaque référence
Toute source citée par une IA doit être ouverte et lue : le lien existe-t-il ? L’article dit-il vraiment ce qui est affirmé ? Méfiez-vous particulièrement des références sans lien.
5. Utiliser la recherche web, sans baisser la garde
Les modes avec recherche web réduisent le risque sur l’actualité, car ils s’appuient sur des pages réelles. Mais l’IA peut encore mal résumer une page ou la citer à tort. Cliquez sur les sources.
6. Poser la question autrement
Reposez la même question en la formulant différemment, ou dans une nouvelle conversation. Si les réponses se contredisent sur un fait, c’est un signal d’alerte.
7. Adapter l’usage à l’enjeu
Pour un brouillon d’e-mail, une erreur mineure est sans conséquence. Pour une information médicale, juridique ou financière, l’IA peut aider à comprendre et à préparer vos questions, mais la décision doit reposer sur une source fiable ou un professionnel.
Le bon réflexe au quotidien
Considérez l’IA comme un stagiaire brillant mais parfois trop sûr de lui : excellent pour produire un premier jet, structurer, reformuler, expliquer, mais dont le travail se relit avant d’être signé.
En résumé
Les hallucinations viennent du principe même des modèles de langage : ils produisent du texte plausible, pas vérifié. Pour s’en protéger :
- fournissez les sources ;
- autorisez le « je ne sais pas » ;
- vérifiez tout fait important.
Ces réflexes font partie d’une bonne méthode de prompt, détaillée dans notre guide pour écrire un bon prompt.