Skip to content
Inteligencia IAAug 23, 2026Inteligencia IA
Artigo

A Prime Intellect publicou um benchmark avaliando 18 modelos de fronteira em 153 execuções autônomas usando a estrutura do otimizador nanoGPT.

O estudo disponibiliza rastros abertos de chamadas de ferramentas e registros de raciocínio, fornecendo aos desenvolvedores dados granulares sobre as capacidades atuais dos modelos em tarefas autodirigidas.

Editorial Data Cube AIFonte: VentureBeat
01

Brief da fonte

A Prime Intellect publicou um benchmark avaliando 18 modelos de fronteira em 153 execuções autônomas usando a estrutura do otimizador nanoGPT. O estudo disponibiliza rastros abertos de chamadas de ferramentas e registros de raciocínio, fornecendo aos desenvolvedores dados granulares sobre as capacidades atuais dos modelos em tarefas autodirigidas.