Skip to content

Multimodal

Archive thématique3 résultats

Généré par IA : résumés rédigés par une IA à partir des sources citées. Notre usage de l'IA

Retour à l'accueilGEO summary endpoint

2026-09-18

Technologie

  • Le Volcengine de ByteDance a entièrement publié Doubao-Seed-2.1-pro 0915, affirmant des capacités de codage multimodal, notamment la reconstruction d'un ERP Java de 280,000 lignes à partir d'enregistrements d'écran et l'obtention de ~83% de correctifs fusionnables du dépôt Luanti. La société affirme également des coûts de tokens d'inférence image/vidéo inférieurs de plus de 30%.

    Publication de modèlePandaily

    Lien permanent

2026-09-19

Technologie

  • Qwen a publié Qwen3.8-Omni-Flash, un modèle multimodal pour agents IA qui traite l'audio et la vidéo ensemble et peut utiliser des outils de manière autonome. Qwen affirme qu'il égale presque Gemini 3.8 Flash de Google sur les benchmarks audio-vidéo tout en cassant ses prix.

    Modèles IAThe Decoder

    Lien permanent

2026-09-07

Technologie

  • Cette analyse approfondie couvre le GPT-6 Astra d'OpenAI, détaillant ses nouvelles capacités, ses benchmarks de performance et son impact potentiel sur les applications d'IA. Les spectateurs apprendront à connaître les fonctionnalités multimodales du modèle, ses améliorations en matière de raisonnement, ainsi que la manière dont il se compare aux versions précédentes, avec les implications pour les développeurs et l'avenir de l'IA.

    AI Model ReviewAI Search

    Lien permanent