Skip to content
Inteligencia IAAug 23, 2026Inteligencia IA
Articulo

Prime Intellect publicó un benchmark que evalúa 18 modelos de frontera en 153 ejecuciones autónomas utilizando el marco del optimizador nanoGPT.

El estudio publica trazas abiertas de llamadas a herramientas y cuadernos de razonamiento, proporcionando a los desarrolladores datos granulares sobre las capacidades actuales de los modelos en tareas autónomas.

Redaccion Data Cube AIFuente: VentureBeat
01

Resumen fuente

Prime Intellect publicó un benchmark que evalúa 18 modelos de frontera en 153 ejecuciones autónomas utilizando el marco del optimizador nanoGPT. El estudio publica trazas abiertas de llamadas a herramientas y cuadernos de razonamiento, proporcionando a los desarrolladores datos granulares sobre las capacidades actuales de los modelos en tareas autónomas.