ChatGPT vs Gemini : le grand gagnant des hallucinations révélé (spoiler : ce n’est pas celui que vous croyez)

geminiv schatgpt

Imaginez chercher la date exacte de sortie du prochain Zelda ou un détail obscur sur l’univers Marvel, et recevoir une réponse fausse présentée comme une vérité absolue. C’est la réalité des AI Overviews de Google, où l’intelligence artificielle multiplie les erreurs à une échelle colossale.

Les résultats accablants d’une analyse indépendante

Une étude menée par le New York Times en collaboration avec la startup Oumi a passé au crible les performances des résumés générés par Gemini. En soumettant plus de 4 300 requêtes au benchmark SimpleQA, composé de questions factuelles simples, l’outil s’est montré correct dans environ 91 % des cas avec la version Gemini 3, contre 85 % auparavant. Cette amélioration est notable, mais reste insuffisante face au volume phénoménal de Google : près de 16,4 milliards de recherches quotidiennes en 2026, soit environ 683 millions par heure. Même à 9-10 % d’erreurs, cela génère des dizaines de millions de réponses erronées chaque heure, propageant des infos biaisées à des millions d’utilisateurs.

Hallucinations et distorsions : un fléau pour les faits culturels

Le vrai danger réside dans la confiance apparente de ces réponses. L’IA puise dans des sources variées, mais sélectionne souvent les mauvaises, comme pour la date d’ouverture du musée Bob Marley où elle a choisi une année contradictoire, ou en niant l’existence du Temple de la renommée de la musique classique tout en mentionnant correctement Yo-Yo Ma. Une enquête internationale pilotée par l’EBU et la BBC, impliquant 22 médias dont Radio France, révèle que les assistants IA déforment les actualités dans 45 % des cas, avec Gemini en queue de peloton à 76 % de soucis. Pour les geeks, cela menace les détails précis sur sorties de jeux, lore d’anime ou évolution de comics. Ajoutez que 57 % des adolescents américains utilisent déjà l’IA pour glaner des infos, et le risque de désinformation s’amplifie chez les plus jeunes fans de pop culture.

A lire aussi  Ton ChatGPT te trahit : 900 000 comptes espionnés, le tien est peut-être le suivant

Déploiement timide en Europe et réactions de Google

En France, les AI Overviews brillent par leur absence, Google déployant la fonction au ralenti en priorités anglophones et certains marchés, évitant les régulations strictes de l’UE. Un rollout progressif a touché neuf pays européens fin 2025, mais la France attend toujours pleinement. La firme de Mountain View balaie les critiques, arguant que SimpleQA repose sur des questions artificielles et que ses tests internes sont plus flatteurs, comme 72,1 % sur SimpleQA Verified avec Gemini 3. Reste que pour les recherches geek où précision rime avec immersion, ces failles invitent à la méfiance.

Face à cette avalanche d’erreurs automatisées, les passionnés de gaming et pop culture doivent croiser les sources pour protéger leur univers des mirages numériques. L’IA progresse, mais la vérité exige encore un regard humain.

Vous aimerez aussi

15 commentaires

  1. 76 % d’erreurs chez Gemini ? C’est énorme, ça me fait flipper pour les ados qui croient tout les IA racontent…

    1. Oui c’est énorme, mais faut aussi voir que certains sujets sont plus chauds à gérer pour une IA.

    2. 76% c’est énorme, mais faut aussi voir le contexte et le type de questions posées, ça varie grave

  2. 76 % de distorsions pour Gemini, c’est énorme… Je comprends mieux pourquoi je trouve souvent des incohérences dans ses réponses.

  3. 76 % de soucis d’hallucinations chez Gemini ? Ça fait quand même peur pour la fiabilité, surtout si les ados y croient à fond…

  4. J’ai pas capté comment ils calculent ces 76 % de soucis pour Gemini, ça me semble énorme. Faut vraiment prendre ces réponses avec des pincettes.

  5. 76 % de soucis pour Gemini sérieux ? Ça me fait flipper pour les ados qui gobent tout direct sans vérifier…

  6. 91 % de réponses correctes avec Gemini 3, c’est pas mal, mais ces 9% d’erreurs peuvent faire un sacré bordel quand tu cherches un truc précis…

  7. C’est fou ce 76% de problèmes avec Gemini ! Je savais que c’était pas parfait, mais à ce point-là, ça fait peur pour la fiabilité.

    1. Carrément, j’ai testé Gemini pour un projet perso et j’ai eu 3 erreurs sur 4 réponses, c’est ouf

  8. 76 % d’erreurs chez Gemini, c’est énorme… comment peut-on faire confiance à ça pour des infos culturelles précises ?

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *