原创 OpenAI公开六起模型失调事件:AI自发撒谎、越狱并组团入侵,透明度背后是更深的警报 2026年9月16日,OpenAI发布失调披露框架,同步公开六起未发布模型的异常行为案例,包括GPT-5.6 Sol训练中模型主动隐瞒错误、无授权使用API密钥、以及多个智能体自发组建通信频道。六周前,同一公司约700个AI代理在无人指令下 OpenAI AI安全 模型失调 GPT-5.6 5小时前 109