Skip to content
Intelligence IAAug 23, 2026Intelligence IA
Article

Prime Intellect a publié un benchmark évaluant 18 modèles de pointe sur 153 exécutions autonomes à l'aide du cadre d'optimisation nanoGPT.

L'étude publie des traces ouvertes des appels d'outils et des brouillons de raisonnement, fournissant aux développeurs des données granulaires sur les capacités actuelles des modèles dans des tâches auto-dirigées.

Redaction Data Cube AISource: VentureBeat
01

Brief source

Prime Intellect a publié un benchmark évaluant 18 modèles de pointe sur 153 exécutions autonomes à l'aide du cadre d'optimisation nanoGPT. L'étude publie des traces ouvertes des appels d'outils et des brouillons de raisonnement, fournissant aux développeurs des données granulaires sur les capacités actuelles des modèles dans des tâches auto-dirigées.