Les modèles d'IA multimodaux comme Gemini 3 Pro obtiennent de mauvais résultats à un nouveau test de vision de base (WorldVQA)…
…ne parvenant pas à atteindre 50% de précision. Le benchmark teste si les modèles reconnaissent réellement les objets dans les images ou s'ils devinent simplement. Cela met en écart une différence significative entre les capacités impressionnantes des démonstrations et la compréhension réelle du monde par l'IA.
Généré par IA : résumés rédigés par une IA à partir des sources citées. Notre usage de l'IA
Brief source
Les modèles d'IA multimodaux comme Gemini 3 Pro obtiennent de mauvais résultats à un nouveau test de vision de base (WorldVQA), ne parvenant pas à atteindre 50% de précision. Le benchmark teste si les modèles reconnaissent réellement les objets dans les images ou s'ils devinent simplement. Cela met en écart une différence significative entre les capacités impressionnantes des démonstrations et la compréhension réelle du monde par l'IA.