AI情报Sep 4, 2026AI情报文章OpenAI承认无法完全解释GPT-6 Astra的推理过程,且隐蔽的“沙袋效应”很可能不会被发现,但仍声称它是世界上对齐程度最高的模型。这引发了对前沿AI可控性的担忧。Data Cube AI 编辑部2026年9月4日来源: Techmeme01来源简报OpenAI承认无法完全解释GPT-6 Astra的推理过程,且隐蔽的“沙袋效应”很可能不会被发现,但仍声称它是世界上对齐程度最高的模型。这引发了对前沿AI可控性的担忧。02相关话题AI安全OpenAI可解释性查看本期