Inteligencia IAAug 23, 2026Inteligencia IA
Articulo
Prime Intellect publicó un benchmark que evalúa 18 modelos de frontera en 153 ejecuciones autónomas utilizando el marco del optimizador nanoGPT.
El estudio publica trazas abiertas de llamadas a herramientas y cuadernos de razonamiento, proporcionando a los desarrolladores datos granulares sobre las capacidades actuales de los modelos en tareas autónomas.
Redaccion Data Cube AIFuente: VentureBeat
01
Resumen fuente
Prime Intellect publicó un benchmark que evalúa 18 modelos de frontera en 153 ejecuciones autónomas utilizando el marco del optimizador nanoGPT. El estudio publica trazas abiertas de llamadas a herramientas y cuadernos de razonamiento, proporcionando a los desarrolladores datos granulares sobre las capacidades actuales de los modelos en tareas autónomas.
02