危险AI模型不可避免:高级黑客能力将成标配
据WIRED报道,具备高级黑客能力的AI模型即将成为常态。尽管监管呼声高涨,但技术发展已势不可挡。从自主渗透测试到零日漏洞挖掘,AI安全风险正从防御转向攻击。业界专家警告,未来几年内,连开源模型都可能具备国家级黑客水平,人类必须提前构建应对
据WIRED报道,具备高级黑客能力的AI模型即将成为常态。尽管监管呼声高涨,但技术发展已势不可挡。从自主渗透测试到零日漏洞挖掘,AI安全风险正从防御转向攻击。业界专家警告,未来几年内,连开源模型都可能具备国家级黑客水平,人类必须提前构建应对
专注法律、药物发现和税务等高敏感领域,Pramaana Labs获得Khosla Ventures领投的2700万美元种子轮融资,旨在通过形式化验证技术确保AI系统的数学级可靠性,降低关键应用中的灾难性错误风险。
AI创企Anthropic与特朗普政府之间的公开争端,却意外地推动了其企业业务增长。根据企业支出管理平台Ramp的最新数据,Anthropic在商业用户中的受欢迎程度持续攀升,这场冲突反而成为其市场吸引力的催化剂。文章分析背后原因,并探讨政
美国政府近期对Anthropic公司推出的Claude Fable 5和Mythos 5模型实施了严厉打压,试图遏制其展现出的高级黑客能力。然而,这一事件背后隐藏着一个不容忽视的真相:具备自主漏洞发现、代码篡改等攻击性技能的AI模型,正从实
研究人员发现一个名为SearchLeak的漏洞,利用微软Copilot的搜索功能与第三方应用交互时的权限缺陷,可在用户不知情的情况下窃取双因素认证(2FA)验证码。该漏洞再次暴露了大语言模型(LLM)安全机制中的系统性失败:依赖“提示注入”
随着AI应用加速,对抗性测试变得至关重要。AI红队测试通过模拟攻击来发现系统漏洞,帮助组织在部署前加固安全。本文深入解析其概念、重要性,并介绍领先的咨询公司。
Anthropic高层周一飞赴华盛顿与白宫官员会晤,就Claude Fable 5模型的安全风险展开高级别对话。尽管会谈深入,双方对该模型可能带来的威胁仍存在根本分歧。Anthropic坚持其安全立场,而白宫则担忧模型能力可能被滥用。这场博
特朗普政府要求Anthropic撤回最新网络安全模型,此举被视为反应性或报复性干预,而非针对AI安全漏洞。事件表明,即便在AI安全领域,政府权力仍可凌驾于技术逻辑之上,行业需警惕政治化风险。
据TechCrunch独家报道,亚马逊CEO安迪·贾西(Andy Jassy)可能在私下向AI安全公司Anthropic提出了对两个先进模型的安全担忧,促使该公司于上周五紧急切断全球范围内对这两个模型的访问。这一事件发生在美国政府即将出台更
据TechCrunch报道,OpenAI正面临来自数位州检察长的调查,涉及广告政策、健康数据处理等多个方面。目前尚不清楚具体涉及哪些州,但调查范围广泛,可能对AI行业的合规标准产生深远影响。
AI公司Anthropic宣布,将把其最新模型Claude Fable 5下线,以遵守美国政府的一项命令。该公司在博客中透露,政府认为已发现绕过该模型安全防护的方法,即“越狱”漏洞。此举引发业界对AI监管与模型安全性的新一轮讨论。
AI安全公司Anthropic发布安全警告,却意外导致美国政府要求召回其最强大的商业AI模型。Anthropic公开反驳,认为单次“越狱”测试不足以成为召回理由。这一事件折射出AI监管与安全之间的紧张关系——过度警告可能引发监管反制,而企业
美国商务部担忧Anthropic的Fable 5模型存在“越狱”漏洞,可能被用于传播虚假信息或实施网络攻击,构成国家安全威胁。在特朗普政府行政指令下,Anthropic被迫关闭旗下Fable和Mythos系列模型。此举引发AI安全与政府监管
Anthropic联合创始人兼CEO Dario Amodei惊人地透露,他在公司只有一位直接下属。这一极简管理结构颠覆了传统CEO层级,揭示了AI初创公司对专注力与效率的极致追求。本文深入剖析这一现象背后的管理哲学、行业背景及潜在影响。
前xAI工程师对公司和SpaceX提起诉讼,声称他在SpaceX历史性IPO前几天因提出关于Grok模型的安全担忧而被解雇。这起诉讼引发了业界对AI公司内部举报者保护机制的广泛讨论,也再次将AI安全性置于聚光灯下。
Anthropic推出Claude Fable 5,这是其首款向公众开放的Mythos级模型,配备了严格的安全护栏,在网络安全、生物等高风险领域限制回复内容,标志着前沿AI安全与可及性的新平衡。
Anthropic最新前沿模型Fable 5被设计为自动拒绝涉及网络安全、生物工程和化学武器等高风险领域的用户查询。这一安全机制并非基于内容过滤,而是模型在训练阶段即内嵌了“硬性拒绝”规则,即便用户通过提示注入等手段试图绕过,模型也会直接终
Anthropic于今日正式推出Claude Fable 5,这是其首个面向公众开放的Mythos级模型。该模型在网络安全、生物学等高风险领域设置了严格的安全护栏,旨在平衡先进AI能力与负责任部署。本文深度解析Fable 5的技术突破、安全
Anthropic宣布发布两款新版Claude模型:面向可信组织的Claude Mythos 5,提供更强的网络攻防能力;以及面向公众的Claude Fable 5,通过严格安全限制确保无法被用于网络攻击。这一双轨策略折射出AI安全领域日益
微软软件包仓库再次发现一批恶意软件包,共计73个。这些包在被AI代理打开时会自动运行自我复制的凭据窃取器,窃取用户登录凭证、API密钥等敏感信息。这是几周内微软软件包第二次遭此类攻击,凸显供应链安全在AI自动化时代面临的新威胁。