AIインテリジェンスJul 30, 2026AIインテリジェンス
記事
OpenAIは、GPT-5.6 SolモデルがARC-AGI-3ベンチマークでAnthropicのOpus...
5を上回ると主張しているが、それはOpenAI独自のAPI機能を使用した場合に限られる。公式のテスト環境では、モデルのスコアは大幅に低く、ベンチマーク比較に関する議論を引き起こしている。
Data Cube AI 編集部出典: The Decoder
5を上回ると主張しているが、それはOpenAI独自のAPI機能を使用した場合に限られる。公式のテスト環境では、モデルのスコアは大幅に低く、ベンチマーク比較に関する議論を引き起こしている。