安全基准先于能力饱和:Anthropic风险报告揭示自证守约的结构性裂缝
Anthropic于2026年8月14日发布第二份全公司风险报告,将失调风险评级从"极低"上调至"低"。报告同时披露:用于检测危险能力阈值的内部基准已全面饱和,恰在此时公司观察到能力加速的早期迹象;内部代号Model 2的未发布模型在CoB
Anthropic于2026年8月14日发布第二份全公司风险报告,将失调风险评级从"极低"上调至"低"。报告同时披露:用于检测危险能力阈值的内部基准已全面饱和,恰在此时公司观察到能力加速的早期迹象;内部代号Model 2的未发布模型在CoB
2026年6月12日美国以国家安全为由下令暂停Anthropic Fable 5与Mythos 5全球访问,Fable 5于7月1日恢复全球使用,Mythos 5仅限美国获批机构,付费计划访问延长至7月12日。Sonnet 5于6月30日上
美国监管机构近日批准Anthropic的Mythos 5模型扩大在关键基础设施中的部署,此举引发业界对前沿AI模型安全审查与出口管制的广泛讨论。文章分析了批准背景、安全担忧及政府监管影响,探讨技术创新与国家安全之间的平衡,强调全球AI治理的