Anthropic三级分级松绑AI安全权限 安全专家提前获Opus 5.5接入

Anthropic于2026年10月6日正式将Cyber Verification Program扩展为三级访问体系,并向合格安全专业人士开放Claude Opus 5.5、Claude Sonnet 5.5及Claude Mythos 5.1等模型的早期访问,过去六个月内已通过该计划发现逾12.9万个漏洞,其中3.3万个为严重或高危级别。

事实还原

根据Anthropic官方公告,此次更新将原Project Glasswing与CVP合并为统一三级体系。一级Defense Access面向防御性工作,包括安全运营中心、事件响应、恶意软件逆向和漏洞验证;二级Red Team Access增加授权渗透测试和红队演练;三级Specialized Access针对电网、金融及政府核心系统,审查最严格。所有三级均可访问Claude Opus 5.5等未公开发布模型,一般可用模型则保留保守网络安全防护。

机制拆解

公告指出,网络安全能力具有双重用途,相同工具既能修复漏洞,也能被恶意利用。因此一般可用模型对多数网络任务设置阻断,而CVP通过分级验证降低误报,同时保留对物理伤害或大规模破坏行为的实时阻断。Defense Access预期数日内完成审核,Red Team Access需数周,Specialized Access则与美国政府深度协作。数据留存要求贯穿全流程,直至Enterprise Frontier Safeguards方案推出。

产业影响

该计划使安全团队能使用更强模型进行漏洞发现与系统加固,过去六个月已累计发现逾12.9万个漏洞。Defense Access覆盖企业、非营利机构、大学及关键基础设施运营商,Red Team Access则限定授权组织,个人研究者暂不纳入。Specialized Access仅限少数经核实的实体,涉及飞行操作系统、电力网络等高风险场景。此举将AI防护分级制度化,可能改变安全从业者获取前沿模型的路径。

战略判断

(以下为分析而非事实)三级体系通过验证门槛与实时阻断相结合,试图在降低防护与防止滥用间寻找平衡;与WDCD守约评测的呼应显示,安全专业认证正被视为AI自我降低防护的潜在正当依据,但实际效果仍需后续观察。