AI情报Jul 30, 2026AI情报文章OpenAI 声称其 GPT-5.6 Sol 模型在 ARC-AGI-3 基准测试上击败了 Anthropic 的 Opus 5——但前提是使用 OpenAI 自己的 API 功能。在官方测试设置下,该模型得分明显较低,引发了关于基准比较的争论。Data Cube AI 编辑部2026年7月30日来源: The Decoder01来源简报OpenAI 声称其 GPT-5.6 Sol 模型在 ARC-AGI-3 基准测试上击败了 Anthropic 的 Opus 5——但前提是使用 OpenAI 自己的 API 功能。在官方测试设置下,该模型得分明显较低,引发了关于基准比较的争论。02相关话题人工智能竞争OpenAI基准测试通用人工智能查看本期