Skip to content
AIインテリジェンスJul 30, 2026AIインテリジェンス
記事

OpenAIは、GPT-5.6 SolモデルがARC-AGI-3ベンチマークでAnthropicのOpus...

5を上回ると主張しているが、それはOpenAI独自のAPI機能を使用した場合に限られる。公式のテスト環境では、モデルのスコアは大幅に低く、ベンチマーク比較に関する議論を引き起こしている。

Data Cube AI 編集部出典: The Decoder
01

ソース要約

OpenAIは、GPT-5.6 SolモデルがARC-AGI-3ベンチマークでAnthropicのOpus 5を上回ると主張しているが、それはOpenAI独自のAPI機能を使用した場合に限られる。公式のテスト環境では、モデルのスコアは大幅に低く、ベンチマーク比較に関する議論を引き起こしている。