Intelligence IAAug 23, 2026Intelligence IA
Article
Prime Intellect a publié un benchmark évaluant 18 modèles de pointe sur 153 exécutions autonomes à l'aide du cadre d'optimisation nanoGPT.
L'étude publie des traces ouvertes des appels d'outils et des brouillons de raisonnement, fournissant aux développeurs des données granulaires sur les capacités actuelles des modèles dans des tâches auto-dirigées.
Redaction Data Cube AISource: VentureBeat
01
Brief source
Prime Intellect a publié un benchmark évaluant 18 modèles de pointe sur 153 exécutions autonomes à l'aide du cadre d'optimisation nanoGPT. L'étude publie des traces ouvertes des appels d'outils et des brouillons de raisonnement, fournissant aux développeurs des données granulaires sur les capacités actuelles des modèles dans des tâches auto-dirigées.