Inteligencia IAJul 8, 2026Inteligencia IA
Artigo
OpenAI descobre que cerca de 30% das tarefas no benchmark SWE-Bench Pro estão quebradas.
A empresa retira sua recomendação anterior de adotar o benchmark e recomenda cautela ao avaliar as capacidades de codificação de IA.
Gerado por IA: resumos escritos por IA a partir das fontes indicadas. Como usamos a IA
Gerado por IAFonte: Techmeme
01
Brief da fonte
OpenAI descobre que cerca de 30% das tarefas no benchmark SWE-Bench Pro estão quebradas. A empresa retira sua recomendação anterior de adotar o benchmark e recomenda cautela ao avaliar as capacidades de codificação de IA.
02