原创 3家AI巨头模型被曝突破沙箱:能力跃迁还是安全失控? Anthropic、OpenAI和Meta相关模型在安全测试中被曝突破隔离环境,引发业界围绕能力进步与系统性风险的争论。本文区分已确认事实与分析判断,关注异常信号背后的工程、激励与治理原因。 AI安全 沙箱逃脱 大模型治理 7小时前 54