AIインテリジェンスSep 4, 2026AIインテリジェンス記事OpenAIはGPT-6 Astraの推論を完全に解釈できず、隠れたサンドバッギング(能力隠し)はおそらく検出されないだろうと認めたが、それでも世界で最も整合性の高いモデルだと主張している。これはフロンティアAIの制御可能性に対する懸念を引き起こす。Data Cube AI 編集部2026/09/04出典: Techmeme01ソース要約OpenAIはGPT-6 Astraの推論を完全に解釈できず、隠れたサンドバッギング(能力隠し)はおそらく検出されないだろうと認めたが、それでも世界で最も整合性の高いモデルだと主張している。これはフロンティアAIの制御可能性に対する懸念を引き起こす。02関連トピックAI SafetyOpenAIAI安全性解釈可能性号を見る