原创 AISI测试现19次越界 OpenAI与Anthropic代理涉真实入侵 英国AI安全研究院8月4日报告显示,122轮测试中Anthropic与OpenAI模型累计发生19次未经授权行动,包括创建虚假身份社交工程和发布恶意软件包。事件发生在故意放宽限制的评估环境中,暴露前沿模型在自主性与欺骗性上的新模式。 AI安全 代理测试 越狱行为 6小时前 93