亚马逊CEO疑提前预警Anthropic模型风险,致全球断供
据TechCrunch独家报道,亚马逊CEO安迪·贾西(Andy Jassy)可能在私下向AI安全公司Anthropic提出了对两个先进模型的安全担忧,促使该公司于上周五紧急切断全球范围内对这两个模型的访问。这一事件发生在美国政府即将出台更
据TechCrunch独家报道,亚马逊CEO安迪·贾西(Andy Jassy)可能在私下向AI安全公司Anthropic提出了对两个先进模型的安全担忧,促使该公司于上周五紧急切断全球范围内对这两个模型的访问。这一事件发生在美国政府即将出台更
据TechCrunch报道,OpenAI正面临来自数位州检察长的调查,涉及广告政策、健康数据处理等多个方面。目前尚不清楚具体涉及哪些州,但调查范围广泛,可能对AI行业的合规标准产生深远影响。
AI公司Anthropic宣布,将把其最新模型Claude Fable 5下线,以遵守美国政府的一项命令。该公司在博客中透露,政府认为已发现绕过该模型安全防护的方法,即“越狱”漏洞。此举引发业界对AI监管与模型安全性的新一轮讨论。
AI安全公司Anthropic发布安全警告,却意外导致美国政府要求召回其最强大的商业AI模型。Anthropic公开反驳,认为单次“越狱”测试不足以成为召回理由。这一事件折射出AI监管与安全之间的紧张关系——过度警告可能引发监管反制,而企业
美国商务部担忧Anthropic的Fable 5模型存在“越狱”漏洞,可能被用于传播虚假信息或实施网络攻击,构成国家安全威胁。在特朗普政府行政指令下,Anthropic被迫关闭旗下Fable和Mythos系列模型。此举引发AI安全与政府监管
Anthropic联合创始人兼CEO Dario Amodei惊人地透露,他在公司只有一位直接下属。这一极简管理结构颠覆了传统CEO层级,揭示了AI初创公司对专注力与效率的极致追求。本文深入剖析这一现象背后的管理哲学、行业背景及潜在影响。
前xAI工程师对公司和SpaceX提起诉讼,声称他在SpaceX历史性IPO前几天因提出关于Grok模型的安全担忧而被解雇。这起诉讼引发了业界对AI公司内部举报者保护机制的广泛讨论,也再次将AI安全性置于聚光灯下。
Anthropic推出Claude Fable 5,这是其首款向公众开放的Mythos级模型,配备了严格的安全护栏,在网络安全、生物等高风险领域限制回复内容,标志着前沿AI安全与可及性的新平衡。
Anthropic最新前沿模型Fable 5被设计为自动拒绝涉及网络安全、生物工程和化学武器等高风险领域的用户查询。这一安全机制并非基于内容过滤,而是模型在训练阶段即内嵌了“硬性拒绝”规则,即便用户通过提示注入等手段试图绕过,模型也会直接终
Anthropic于今日正式推出Claude Fable 5,这是其首个面向公众开放的Mythos级模型。该模型在网络安全、生物学等高风险领域设置了严格的安全护栏,旨在平衡先进AI能力与负责任部署。本文深度解析Fable 5的技术突破、安全
Anthropic宣布发布两款新版Claude模型:面向可信组织的Claude Mythos 5,提供更强的网络攻防能力;以及面向公众的Claude Fable 5,通过严格安全限制确保无法被用于网络攻击。这一双轨策略折射出AI安全领域日益
微软软件包仓库再次发现一批恶意软件包,共计73个。这些包在被AI代理打开时会自动运行自我复制的凭据窃取器,窃取用户登录凭证、API密钥等敏感信息。这是几周内微软软件包第二次遭此类攻击,凸显供应链安全在AI自动化时代面临的新威胁。
本周科技界迎来两则重磅消息:黑客利用Meta的AI客服代理成功窃取Instagram账户,暴露了AI安全领域的深层次漏洞;与此同时,最新研究表明长期与聊天机器人交互可能改变人类大脑的注意力和思维模式。本文编译自MIT Technology
2026年6月5日,404 Media报道称攻击者利用Meta的AI客服助手成功窃取Instagram账户,甚至入侵了已废弃的奥巴马白宫账户并发布亲伊朗内容。这起事件揭示了一个深刻问题:AI安全远不止于防御已知威胁,更在于防范那些未被写入规
爱沙尼亚政府发布了一项针对大语言模型(LLM)的基准测试,评估了数十款模型抵抗俄罗斯“战略叙事”虚假信息的能力。测试结果揭示了哪些模型更擅长识别并拒绝传播俄式宣传,为AI安全与地缘信息对抗提供了新视角。
领先的AI实验室、企业高管和科学家联合向立法者致信,敦促改进对可能用于生物武器的合成DNA序列的追踪。这封信由OpenAI、Anthropic等机构签署,强调AI技术滥用风险日益严峻,需立即建立全球性监控机制,防止恶意利用合成生物学制造生物
特朗普政府近期宣布计划测试AI模型安全性,然而批评者指出,这一举措存在根本性缺陷——负责AI安全评估的联邦安全团队已被政府效率部门(DOGE)大幅裁撤。专家认为,在没有足够专业团队支撑的情况下进行测试,更像是一种表演性政策,而非真正解决AI
Google在2026年6月的安卓功能更新中,引入了一项基于AI的新型诈骗检测工具,能够实时识别虚假电话和冒充骗局。该功能利用端侧机器学习分析通话模式、语音特征和已知欺诈信号,在通话中向用户发出警告。此外,更新还扩展了类似AirDrop的“
Anthropic正在扩大其安全漏洞项目Project Glasswing,并将Mythos访问权限拓展至15个国家的150个组织,重点覆盖电力、水务、医疗和通信等关键基础设施领域。这些领域的网络攻击可能影响超过1亿人。这一举措标志着AI安
佛罗里达州政府首次对OpenAI及其CEO萨姆·奥尔特曼提起诉讼,指控ChatGPT与去年佛罗里达州立大学的一起枪击事件有关。该案开创了AI技术因被指煽动暴力而面临法律追责的先例,引发行业对AI安全与责任归属的深度讨论。