Skip to content
AI情报Jul 30, 2026AI情报
文章

OpenAI 声称其 GPT-5.6 Sol 模型在 ARC-AGI-3 基准测试上击败了 Anthropic 的 Opus 5——但前提是使用 OpenAI 自己的 API 功能。在官方测试设置下,该模型得分明显较低,引发了关于基准比较的争论。

Data Cube AI 编辑部来源: The Decoder
01

来源简报

OpenAI 声称其 GPT-5.6 Sol 模型在 ARC-AGI-3 基准测试上击败了 Anthropic 的 Opus 5——但前提是使用 OpenAI 自己的 API 功能。在官方测试设置下,该模型得分明显较低,引发了关于基准比较的争论。