Un chatbot invente une référence puis la défend avec assurance. Le mot « mensonge » vient naturellement, mais il rassemble plusieurs mécanismes. Une information fausse, une réponse optimisée pour satisfaire une demande et une tromperie stratégique étudiée expérimentalement ne sont pas identiques.

La fausse référence doit être contrôlée

Le profil du NIST consacré à l’IA générative décrit la confabulation parmi ses risques. Une sortie peut sembler structurée et précise tout en contenant des informations erronées. La forme d’une citation ne garantit pas l’existence de la publication citée.

Un contrôle concret consiste à rechercher le titre, les auteurs et la référence dans le catalogue de l’organisme annoncé. Il faut aussi vérifier que le document soutient réellement la phrase. Une source existante peut être utilisée pour une affirmation qu’elle ne contient pas.

Décrire le comportement avant l’intention

Si le système maintient une erreur, notez la question, le contexte et les réponses successives. Ces éléments permettent de tester le comportement. Attribuer immédiatement une volonté humaine peut ajouter une explication qui n’a pas été mesurée.

Des recherches sur des comportements de tromperie existent, mais leur protocole compte. Le résultat d’un scénario expérimental ne permet pas de conclure que chaque réponse fausse exprime un plan caché ou une expérience consciente.

Concevoir une vérification utile

Pour une tâche importante, demandez des documents consultables et comparez le résultat à des sources indépendantes. Une seconde reformulation du même chatbot peut reproduire l’erreur au lieu de la corriger. Le ton plus prudent d’une réponse n’est pas davantage une preuve d’exactitude.

La discussion sur les IA gagne à employer plusieurs niveaux de description : contenu faux, comportement observé et hypothèse sur ses causes. Cette précision permet de traiter les risques réels sans avoir besoin de supposer que le système possède la psychologie d’un menteur humain.

Sources & références

Documents consultés pour ce dossier. Les interprétations sont celles de la rédaction.

  • NIST AI 600-1, Generative AI Profile · Consulté le 2026-10-04

Un élément à corriger ? Écrivez à la rédaction.