Intelligence artificielle Guide

Hallucinations de l'IA : pourquoi ChatGPT invente et comment s'en protéger

Pourquoi les IA comme ChatGPT inventent parfois des faits avec assurance, dans quels cas le risque est maximal et 7 méthodes concrètes pour s'en protéger.

Sommaire6 parties
  1. Pourquoi les IA inventent
  2. Un cas célèbre
  3. Quand le risque est le plus élevé
  4. 7 méthodes pour s’en protéger
  5. 1. Fournir vous-même les informations
  6. 2. Autoriser explicitement « je ne sais pas »
  7. 3. Demander des citations exactes
  8. 4. Vérifier chaque référence
  9. 5. Utiliser la recherche web, sans baisser la garde
  10. 6. Poser la question autrement
  11. 7. Adapter l’usage à l’enjeu
  12. Le bon réflexe au quotidien
  13. En résumé

Vous demandez une référence à une IA : elle vous répond avec un titre d’article, un auteur, une date… et rien de tout cela n’existe. C’est ce qu’on appelle une hallucination : une information fausse, présentée avec autant d’assurance qu’une vraie.

Ce n’est pas un bug rare. C’est une conséquence directe du fonctionnement de ces outils. Bonne nouvelle : en comprenant pourquoi ça arrive, on peut réduire fortement le risque.

À retenir Une IA générative produit un texte plausible, pas un texte vérifié. Plus une information est précise (chiffre, date, citation, référence) et rare, plus le risque d’invention est élevé. Tout fait important doit être vérifié à la source.

Pourquoi les IA inventent

Un modèle de langage comme ChatGPT, Claude ou Gemini ne consulte pas une base de faits. Il a appris, sur d’énormes quantités de textes, à prédire la suite la plus probable d’un texte.

La plupart du temps, la suite la plus probable est aussi la bonne. Mais quand le modèle ne « sait » pas, il ne se tait pas forcément : il produit ce qui ressemble à une bonne réponse. Une référence scientifique plausible a un auteur, un titre et une année. Le modèle peut donc générer les trois, avec une parfaite cohérence de forme.

Deux facteurs aggravent le problème :

  • le ton est toujours assuré : rien dans la formulation ne distingue une information solide d’une invention ;
  • le modèle a une date limite de connaissances : sans accès à Internet, il ignore les événements récents et peut les combler au hasard.

Un cas célèbre

En 2023, aux États-Unis, dans l’affaire Mata v. Avianca, des avocats ont déposé devant un tribunal fédéral un mémoire citant plusieurs décisions de justice inexistantes, générées par ChatGPT. Le juge a constaté que ces jurisprudences n’existaient pas, et les avocats ont été sanctionnés.

La leçon vaut pour tout le monde : l’IA est un assistant de rédaction, pas une source.

Quand le risque est le plus élevé

Type de demande Risque
Reformuler, résumer un texte que vous fournissez Faible
Expliquer un concept très connu Faible à modéré
Donner des chiffres, des statistiques, des dates précises Élevé
Citer des sources, des études, des articles de loi Très élevé
Parler d’un sujet de niche, d’une personne peu connue Élevé
Répondre sur l’actualité récente sans recherche web Élevé

7 méthodes pour s’en protéger

1. Fournir vous-même les informations

C’est la méthode la plus efficace. Collez le document, l’article ou les données, et demandez à l’IA de travailler uniquement à partir de ce contenu :

Réponds uniquement à partir du document ci-dessous.
Si l'information n'y figure pas, réponds « Non précisé dans le document ».

<document>
[collez votre texte]
</document>

2. Autoriser explicitement « je ne sais pas »

Les modèles ont tendance à vouloir répondre à tout prix. Donnez-leur une porte de sortie : « Si tu n’es pas sûr, dis-le plutôt que de deviner. » La documentation d’Anthropic recommande précisément cette technique.

3. Demander des citations exactes

Pour un long document, demandez à l’IA de citer mot pour mot les passages sur lesquels elle s’appuie. Il devient alors facile de vérifier que la réponse est bien fondée sur le texte.

4. Vérifier chaque référence

Toute source citée par une IA doit être ouverte et lue : le lien existe-t-il ? L’article dit-il vraiment ce qui est affirmé ? Méfiez-vous particulièrement des références sans lien.

5. Utiliser la recherche web, sans baisser la garde

Les modes avec recherche web réduisent le risque sur l’actualité, car ils s’appuient sur des pages réelles. Mais l’IA peut encore mal résumer une page ou la citer à tort. Cliquez sur les sources.

6. Poser la question autrement

Reposez la même question en la formulant différemment, ou dans une nouvelle conversation. Si les réponses se contredisent sur un fait, c’est un signal d’alerte.

7. Adapter l’usage à l’enjeu

Pour un brouillon d’e-mail, une erreur mineure est sans conséquence. Pour une information médicale, juridique ou financière, l’IA peut aider à comprendre et à préparer vos questions, mais la décision doit reposer sur une source fiable ou un professionnel.

Le bon réflexe au quotidien

Considérez l’IA comme un stagiaire brillant mais parfois trop sûr de lui : excellent pour produire un premier jet, structurer, reformuler, expliquer, mais dont le travail se relit avant d’être signé.

En résumé

Les hallucinations viennent du principe même des modèles de langage : ils produisent du texte plausible, pas vérifié. Pour s’en protéger :

  • fournissez les sources ;
  • autorisez le « je ne sais pas » ;
  • vérifiez tout fait important.

Ces réflexes font partie d’une bonne méthode de prompt, détaillée dans notre guide pour écrire un bon prompt.