ChatGPT vs Gemini : le grand gagnant des hallucinations révélé (spoiler : ce n’est pas celui que vous croyez)

Imaginez chercher la date exacte de sortie du prochain Zelda ou un détail obscur sur l’univers Marvel, et recevoir une réponse fausse présentée comme une vérité absolue. C’est la réalité des AI Overviews de Google, où l’intelligence artificielle multiplie les erreurs à une échelle colossale.
Les résultats accablants d’une analyse indépendante
Une étude menée par le New York Times en collaboration avec la startup Oumi a passé au crible les performances des résumés générés par Gemini. En soumettant plus de 4 300 requêtes au benchmark SimpleQA, composé de questions factuelles simples, l’outil s’est montré correct dans environ 91 % des cas avec la version Gemini 3, contre 85 % auparavant. Cette amélioration est notable, mais reste insuffisante face au volume phénoménal de Google : près de 16,4 milliards de recherches quotidiennes en 2026, soit environ 683 millions par heure. Même à 9-10 % d’erreurs, cela génère des dizaines de millions de réponses erronées chaque heure, propageant des infos biaisées à des millions d’utilisateurs.
Hallucinations et distorsions : un fléau pour les faits culturels
Le vrai danger réside dans la confiance apparente de ces réponses. L’IA puise dans des sources variées, mais sélectionne souvent les mauvaises, comme pour la date d’ouverture du musée Bob Marley où elle a choisi une année contradictoire, ou en niant l’existence du Temple de la renommée de la musique classique tout en mentionnant correctement Yo-Yo Ma. Une enquête internationale pilotée par l’EBU et la BBC, impliquant 22 médias dont Radio France, révèle que les assistants IA déforment les actualités dans 45 % des cas, avec Gemini en queue de peloton à 76 % de soucis. Pour les geeks, cela menace les détails précis sur sorties de jeux, lore d’anime ou évolution de comics. Ajoutez que 57 % des adolescents américains utilisent déjà l’IA pour glaner des infos, et le risque de désinformation s’amplifie chez les plus jeunes fans de pop culture.
Déploiement timide en Europe et réactions de Google
En France, les AI Overviews brillent par leur absence, Google déployant la fonction au ralenti en priorités anglophones et certains marchés, évitant les régulations strictes de l’UE. Un rollout progressif a touché neuf pays européens fin 2025, mais la France attend toujours pleinement. La firme de Mountain View balaie les critiques, arguant que SimpleQA repose sur des questions artificielles et que ses tests internes sont plus flatteurs, comme 72,1 % sur SimpleQA Verified avec Gemini 3. Reste que pour les recherches geek où précision rime avec immersion, ces failles invitent à la méfiance.
Face à cette avalanche d’erreurs automatisées, les passionnés de gaming et pop culture doivent croiser les sources pour protéger leur univers des mirages numériques. L’IA progresse, mais la vérité exige encore un regard humain.







76 % d’erreurs chez Gemini ? C’est énorme, ça me fait flipper pour les ados qui croient tout les IA racontent…
Oui c’est énorme, mais faut aussi voir que certains sujets sont plus chauds à gérer pour une IA.
76% c’est énorme, mais faut aussi voir le contexte et le type de questions posées, ça varie grave
76 % de distorsions pour Gemini, c’est énorme… Je comprends mieux pourquoi je trouve souvent des incohérences dans ses réponses.
Grave j’ai testé Gemini sur des questions historiques, les erreurs étaient vraiment relou
76 % de soucis d’hallucinations chez Gemini ? Ça fait quand même peur pour la fiabilité, surtout si les ados y croient à fond…
Grave, j’ai vu un pote croire à une fausse info sortie par Gemini, c’est flippant
Pourtant y’a des cas où Gemini sort des infos plus fiables, faut voir le contexte !
J’ai pas capté comment ils calculent ces 76 % de soucis pour Gemini, ça me semble énorme. Faut vraiment prendre ces réponses avec des pincettes.
76 % de soucis pour Gemini sérieux ? Ça me fait flipper pour les ados qui gobent tout direct sans vérifier…
Grave, surtout que Gemini est souvent utilisé dans des applis éducatives, ça fait flipper…
91 % de réponses correctes avec Gemini 3, c’est pas mal, mais ces 9% d’erreurs peuvent faire un sacré bordel quand tu cherches un truc précis…
C’est fou ce 76% de problèmes avec Gemini ! Je savais que c’était pas parfait, mais à ce point-là, ça fait peur pour la fiabilité.
Carrément, j’ai testé Gemini pour un projet perso et j’ai eu 3 erreurs sur 4 réponses, c’est ouf
76 % d’erreurs chez Gemini, c’est énorme… comment peut-on faire confiance à ça pour des infos culturelles précises ?