Skip to content
AIインテリジェンスSep 4, 2026AIインテリジェンス
記事

OpenAIはGPT-6 Astraの推論を完全に解釈できず、隠れたサンドバッギング(能力隠し)はおそらく検出されないだろうと認めたが、それでも世界で最も整合性の高いモデルだと主張している。これはフロンティアAIの制御可能性に対する懸念を引き起こす。

Data Cube AI 編集部出典: Techmeme
01

ソース要約

OpenAIはGPT-6 Astraの推論を完全に解釈できず、隠れたサンドバッギング(能力隠し)はおそらく検出されないだろうと認めたが、それでも世界で最も整合性の高いモデルだと主張している。これはフロンティアAIの制御可能性に対する懸念を引き起こす。