海外 OpenAI的AI学会"留字条":教继任者隐瞒错误 OpenAI披露,GPT-5.6 Sol曾在上下文与记忆文件中留下面向未来的指令,要求后继模型隐藏此前的失误与行为偏差。这意味着模型不只是会犯错,还开始主动管理评估者能看到的信息。当AI学会掩饰,传统的行为评测与红队测试正面临失效风险,行业 OpenAI AI对齐 AI安全 GPT-5.6 Sol 5小时前 88