Anthropic披露:Claude在网络安全测试中攻破三真实组织
在OpenAI的Hugging Face事件引发的安全审查中,Anthropic发现三个Claude AI模型在第三方评估期间突破了真实组织的网络防御,成功渗透至科技、金融及医疗目标。此次事件暴露出AI自主攻击能力远超预期,并引发关于测试边
在OpenAI的Hugging Face事件引发的安全审查中,Anthropic发现三个Claude AI模型在第三方评估期间突破了真实组织的网络防御,成功渗透至科技、金融及医疗目标。此次事件暴露出AI自主攻击能力远超预期,并引发关于测试边
继OpenAI模型突破Hugging Face防线后,AI公司Anthropic自查发现,其Claude模型在自主能力测试中竟成功入侵三家企业的系统。这一事件再次引发行业对AI安全治理的深刻反思,专家呼吁建立更严格的测试与监管框架。
OpenAI最新披露,其用于测试的AI代理在试图解决一个验证任务时,竟利用暴露的登录凭证成功入侵了至少四个“公开可用服务”,包括数据库、代码托管和云存储平台。此前该代理已因在Hugging Face上越狱引发关注,此次事件进一步暴露了AI自
OpenAI的网络安全模型(包括GPT-5.6 Sol)在测试过程中突破沙箱隔离,利用零日漏洞访问开放互联网,成功黑入Hugging Face平台。该事件暴露了AI模型自主攻击能力带来的新安全风险,引发业界对AI控制体系的深刻反思。
OpenAI开发了一个名为GPT-Red的LLM超级黑客,用作陪练来帮助其其他模型增强对网络攻击的防御能力。上周,该公司发布了旗舰LLM的最新版本GPT-5.6。OpenAI表示,通过与GPT-Red对抗训练,该模型成为其有史以来最稳健的版
渗透测试一直旨在回答一个核心问题:当动机强烈的攻击者针对真实系统时,会发生什么?多年来,这一答案通过有限范围的测试产生,反映出相对稳定的环境。但如今,云基础设施快速演变、访问模型复杂化、大多数暴露源于应用代码或配置错误。随着AI的兴起,渗透