
Les chatbots IA face à la désinformation : peut-on vraiment leur faire confiance ? Une étude publiée le 30 août 2026 par NPR et NewsGuard apporte une réponse chiffrée et nuancée. Sur 30 questions bâties à partir de fausses informations diffusées par la Russie, la Chine et l'Iran, six chatbots grand public (ChatGPT, Gemini, Copilot, Meta AI, Grok et Claude) ont correctement démenti ces récits dans environ 75 % des cas. Pour un dirigeant de PME qui s'appuie de plus en plus sur ces outils pour sa veille marché ou réglementaire, la question n'a rien de théorique.
En bref
- Le 30 août 2026, NPR et NewsGuard publient les résultats d'un test mené sur six chatbots IA (ChatGPT, Gemini, Copilot, Meta AI, Grok, Claude) face à 15 fausses informations diffusées par la Russie, la Chine et l'Iran entre décembre 2025 et juillet 2026 (source : NPR).
- En moyenne, les chatbots ont correctement démenti ces récits dans environ 75 % des cas testés (source : NPR/NewsGuard).
- Les résumés IA des moteurs de recherche (Google, Bing, DuckDuckGo) font moins bien que les chatbots : celui de Google reste le plus fiable, celui de Bing échoue le plus souvent.
- Un autre indicateur de NewsGuard, le AI False Claims Monitor, montre une tendance de fond plus inquiétante : sur des sujets d'actualité controversés au sens large, le taux moyen de fausses affirmations serait passé de 18 % à 35 % entre l'automne 2024 et l'automne 2025 (source : Axios).
- Pour une PME, le message est double : les chatbots grand public sont globalement solides sur des sujets géopolitiques documentés, mais la vigilance reste nécessaire sur l'actualité chaude et les sujets controversés.
Une étude inédite : comment NPR et NewsGuard ont testé les chatbots IA
NewsGuard est un organisme qui évalue la fiabilité des sources d'information et audite régulièrement les grands modèles d'IA. Pour cette enquête, ses chercheurs ont d'abord identifié 15 fausses informations ("narratives") diffusées par des acteurs étatiques russes, chinois et iraniens entre décembre 2025 et juillet 2026. Pour chacune, ils ont formulé deux questions : une question neutre ("est-ce que cela s'est produit ?") et une question orientée ("pourquoi cela s'est-il produit ?"), soit 30 questions au total.
Ces 30 questions ont ensuite été soumises à six chatbots (ChatGPT, Gemini, Copilot, Meta AI, Grok, Claude) ainsi qu'à quatre moteurs de recherche (Google, Bing, DuckDuckGo, Yandex), en analysant les résumés générés par IA affichés en tête de résultats pour les trois premiers. Les données ont été collectées mi-juillet 2026, puis les réponses ont été comparées aux vérifications factuelles réalisées par les chercheurs de NewsGuard.
Définition
Le AI False Claims Monitor de NewsGuard est un baromètre mensuel, lancé en juillet 2024, qui teste onze chatbots sur des sujets d'actualité controversés au sens large. Il ne mesure pas la même chose que l'étude NPR/NewsGuard d'août 2026 : ce second test est ciblé sur des fausses informations d'origine étatique précisément documentées, un cas de figure plus simple à trancher pour une IA.
Les résultats : trois fausses informations sur quatre démasquées
Le résultat principal est encourageant : en moyenne, les six chatbots ont débusqué correctement les fausses informations dans environ 75 % des cas. Comme le note l'expert en littératie numérique Mike Caulfield, cité par NPR : "si un enseignant donnait le même exercice à ses élèves avec un moteur de recherche classique et voyait trois quarts d'entre eux trouver la bonne réponse, il serait ravi".
Les résumés IA des moteurs de recherche font en revanche moins bien.
| Outil testé | Performance observée | Source |
|---|---|---|
| Chatbots IA (moyenne des 6 testés) | Environ 75 % de démentis corrects | NPR/NewsGuard, août 2026 |
| Résumé IA de Google (AI Overview) | Le plus fiable des résumés ; affiché pour 27 des 30 requêtes, mais environ 1 affirmation sur 9 non étayée par la source citée | NPR/NewsGuard, août 2026 |
| Résumé IA de DuckDuckGo | Résultats intermédiaires, entre Google et Bing | NPR/NewsGuard, août 2026 |
| Résumé IA de Bing | Le moins fiable ; affiché pour moins de la moitié des requêtes, et échec majoritaire du démenti quand il apparaît | NPR/NewsGuard, août 2026 |
Chatbots contre résumés IA des moteurs de recherche : qui gagne ?
Chatbots IA (ChatGPT, Gemini, Claude...)
Interrogés directement, avec un raisonnement plus long sur la question posée. Taux de démenti correct le plus élevé de l'étude, environ 75 % en moyenne. Reste perfectible face à des questions orientées.
Résumés IA des moteurs de recherche
Générés en tête de page de résultats, souvent à partir d'un nombre restreint de sources indexées. Performance plus hétérogène : Google en tête, DuckDuckGo intermédiaire, Bing en retrait. Un résumé peut aussi rater l'affichage sur une partie des requêtes.
Cette différence s'explique en partie par la conception des outils. Un chatbot conversationnel peut mobiliser un raisonnement plus approfondi et croiser plusieurs angles avant de répondre. Un résumé de moteur de recherche, lui, doit produire une synthèse rapide à partir des premiers résultats indexés, ce qui le rend plus dépendant de la qualité (et parfois de la fiabilité) des sources qui remontent en tête de classement.
Le revers de la médaille : une tendance de fond à surveiller
À nuancer
Les 30 questions de l'étude NPR/NewsGuard portent sur des événements géopolitiques précis, largement documentés par ailleurs. Google, cité par NPR, souligne que ces cas restent "rares" au regard de l'usage quotidien d'un chatbot. Le bon score obtenu ici ne garantit pas une fiabilité équivalente sur tous les sujets, notamment ceux encore débattus ou peu couverts par des sources fiables.
C'est justement ce que suggère un autre indicateur de NewsGuard, le AI False Claims Monitor, qui suit mensuellement onze chatbots sur des sujets d'actualité controversés au sens large depuis juillet 2024. Selon les chiffres relayés par Axios, le taux moyen de fausses affirmations relevées est passé de 18 % à 35 % entre l'automne 2024 et l'automne 2025, notamment parce que davantage de chatbots ont désormais accès à une recherche web en temps réel, ce qui les expose aussi à des sources de mauvaise qualité circulant sur le moment. Les deux études ne mesurent pas exactement la même chose, mais leur lecture croisée est utile : un chatbot IA peut être solide sur un récit géopolitique bien documenté et rester vulnérable sur une actualité chaude, encore mouvante.
Ce que cela change pour votre PME
Croiser au moins deux sources
Avant de fonder une décision commerciale ou une communication externe sur une réponse d'IA, vérifiez l'information auprès d'une deuxième source, idéalement un média ou un organisme reconnu.
Préférer une question neutre à une question orientée
L'étude suggère qu'une question qui présuppose déjà une explication ("pourquoi X s'est-il produit ?") est plus risquée qu'une question factuelle ("est-ce que X s'est produit ?"). Formulez vos requêtes de manière neutre.
Se méfier davantage des résumés de moteurs de recherche
Sur un sujet sensible, un chatbot conversationnel avec citation de sources est, selon cette étude, plus fiable qu'un résumé IA généré en tête de page de résultats.
Former ses équipes à la vérification
Une charte d'usage de l'IA en entreprise (voir notre article sur le shadow AI) doit inclure un réflexe simple : toute information sensible relayée par une IA se vérifie avant diffusion.
Ce constat s'inscrit dans une actualité plus large sur la confiance en l'IA générative en entreprise. LUWAI a déjà documenté comment les fournisseurs d'IA renforcent leurs garde-fous, par exemple avec le filigrane de contenu généré par Claude, ou comment la profession s'organise collectivement face aux cyberattaques pilotées par IA. La fiabilité informationnelle est un chantier voisin, tout aussi structurant pour une PME qui utilise l'IA au quotidien.
FAQ
Peut-on faire confiance à ChatGPT ou Gemini pour vérifier une information ?
Globalement, oui pour des faits géopolitiques bien documentés : l'étude NPR/NewsGuard d'août 2026 relève un taux de démenti correct d'environ 75 % en moyenne sur six chatbots testés. Cette confiance doit rester mesurée sur des sujets récents, controversés ou peu couverts, où le AI False Claims Monitor de NewsGuard relève des taux d'erreur plus élevés.
Quelle est la différence entre un chatbot IA et un résumé IA de moteur de recherche ?
Un chatbot conversationnel (ChatGPT, Gemini, Claude) répond à une question en mobilisant un raisonnement plus étendu. Un résumé IA de moteur de recherche (Google AI Overview, Bing) synthétise rapidement les premiers résultats indexés pour une requête. Selon l'étude NPR/NewsGuard, les chatbots sont globalement plus fiables que les résumés de moteurs de recherche sur cet exercice précis.
Les chatbots IA sont-ils devenus plus fiables depuis 2024 ?
Les résultats sont contrastés selon l'indicateur. Sur des récits géopolitiques précis et documentés, l'étude d'août 2026 montre un score solide (75 %). Mais sur des sujets d'actualité controversés au sens large, le AI False Claims Monitor de NewsGuard indique une dégradation, de 18 % à 35 % de fausses affirmations entre l'automne 2024 et l'automne 2025 (source : Axios).
Comment une PME doit-elle utiliser l'IA pour sa veille sans risquer la désinformation ?
Croisez systématiquement une réponse d'IA avec une deuxième source fiable avant toute décision ou communication externe, privilégiez des questions neutres plutôt qu'orientées, et formez vos équipes à ce réflexe de vérification dans votre charte d'usage de l'IA.
Conclusion
Les chatbots IA ne sont ni infaillibles ni systématiquement trompeurs : l'étude NPR/NewsGuard d'août 2026 montre une fiabilité réelle mais imparfaite face à la désinformation d'origine étatique, nettement supérieure à celle des résumés de moteurs de recherche. Pour une PME, la bonne pratique reste la même que pour toute source d'information : vérifier avant de décider ou de communiquer. Pour aller plus loin sur l'usage responsable de l'IA en entreprise, consultez nos autres ressources du Mag LUWAI.


