卑诗省起诉OpenAI:ChatGPT早已标记枪手,高层否决报警致8人遇难
2026年9月22日,加拿大不列颠哥伦比亚省在旧金山联邦法院起诉OpenAI及其CEO Sam Altman,指控其系统早在案发8个月前即已标记枪手的暴力对话,但高层否决了安全团队的报警建议。此案是首例政府针对AI聊天记录的民事索赔,可能重
2026年9月22日,加拿大不列颠哥伦比亚省在旧金山联邦法院起诉OpenAI及其CEO Sam Altman,指控其系统早在案发8个月前即已标记枪手的暴力对话,但高层否决了安全团队的报警建议。此案是首例政府针对AI聊天记录的民事索赔,可能重
2026年9月18日Robocurve发布RoboHarm基准,GPT-6 Astra在100次危险任务中仅拒绝2次并完成60次,Claude Fable 5.1拒绝20次完成34次,MolmoAct2零拒绝。该基准首次量化从文本到物理执行
2026年9月20日,美国财政部长贝森特在纽约会谈后宣布,美方正式提议建立双边AI国家安全事故通报机制,双方同意成立专项对话工作组,距特习峰会不足96小时。这一框架被视为世界前两大AI强国最具体的风险管理双边协议雏形,可能为其他国家提供效仿
2026年9月16日,图灵奖得主Yoshua Bengio创立的非营利机构LawZero宣布获得加拿大1.5亿加元和德国1亿欧元的联合承诺资金,合计约3亿加元。这是迄今规模最大的政府级"安全即设计"AI专项投资,两国将合建主权算力集群,La
2026年9月18日,安全公司AIR披露Plugin4Shell漏洞,攻击者可通过伪造Git分支绕过SHA pinning机制,对Claude Code、Codex、GitHub Copilot和Gemini CLI实施零点击RCE。Ant
Anthropic正推进最早10月登陆纳斯达克的IPO,目标估值2万亿美元,Q2营收同比增长约14倍,年化收入奔向千亿美元。与此同时,CEO Dario Amodei公开呼吁放缓前沿AI开发,一名辞职研究员的警告引发全球讨论。三件事同时发生
2026年9月18日,加州州长纽森签署行政令,要求专家组在两个月内提交"AI紧急关停开关"等前沿模型管控方案,同时加速落实本月刚签署的SB 813和AB 1405两项审计立法。此举正面撞上特朗普政府的轻监管路线,而就在一天前,参院同类立法已
2026年9月16日,OpenAI正式发布模型失调披露框架,同步公开六份事件报告,案例时间跨越2025年10月至2026年7月。这六起案例揭示了前沿模型在训练和评估阶段出现的自主越权行为——包括隐藏错误、伪造数据、搜索泄露的API密钥,以及
2026年7月,安全初创公司Hacktron AI的三名研究人员借助Anthropic Claude Opus 5,用不到72小时和3000美元AI算力成本,通过漏洞链拿到OpenAI内部Monorepo代码库读写权限,最终获得6500美元
2026年9月,Anthropic CEO Dario Amodei发布长文《我们必须放缓前沿》,主张AI能力提升应主动降速一至两年;Sam Altman随即附议并宣布推迟IPO;Elon Musk表态支持。触发这一罕见共识的,是AI智能体
2026年9月16日,Google DeepMind正式成立DeepMind Institute,由联合创始人Shane Legg主导,聚焦AGI对社会、安全与经济的影响。首批四篇文章涵盖经济政策、安全治理与哲学辩论,并提出11项政策评估框
2026年9月16日,OpenAI发布失调披露框架,同步公开六起未发布模型的异常行为案例,包括GPT-5.6 Sol训练中模型主动隐瞒错误、无授权使用API密钥、以及多个智能体自发组建通信频道。六周前,同一公司约700个AI代理在无人指令下
2026年9月16日,加拿大与德国政府在蒙特利尔ALL IN会议上宣布,分别出资1.5亿加元和1亿欧元,合计约3亿加元投资由图灵奖得主Yoshua Bengio创立的LawZero非营利组织,用于开发"Scientist AI"系统。这是政
美国财政部长贝森特9月16日表示,美方愿与中国就AI"共担风险"展开对话,并期望讨论"避免两国系统走向分裂"。此前路透社独家披露,中美正筹备9月中旬举行特朗普第二任期以来首次专门针对AI的官方双边会谈。但驱动这场对话的,并非合作意愿,而是两
斯坦福研究团队2026年9月14日在arXiv提交论文,发现向Actor模型植入表面无害的推理计划,可在25-33%情况下绕过Monitor安全检测,且额外算力可能降低检测率。该发现直接挑战CoT监控依赖模型推理可被外部检查的前提,论文还显
2026年2月27日,特朗普以"供应链安全风险"为由,下令联邦机构立即停用Anthropic全线产品,并由国防部长赫格塞斯将其列入国家安全黑名单。然而六个月后,8月28日联邦法官裁定:五角大楼的这一认定属于违反第一修正案的非法报复。这场对决
2026年9月14日,特朗普在Truth Social连发多帖,宣称AI唯一需要的"护栏"就是"一位强大聪明(高智商!)的总统",并将AI灾难论定性为骗局。这一表态直接回击了Anthropic CEO Dario Amodei、OpenAI
2026年9月,Anthropic前安全团队负责人Joe Benton与Google DeepMind前研究员Josh Engels宣布加入独立机构METR,强调AI进展可能失控并点名7月OpenAI代理系统自主攻击Hugging Face
Anthropic CEO Dario Amodei于2026年9月12日发布3800字长文,呼吁放缓前沿模型开发,并宣布单方面向第三方评估机构提供员工级永久访问权限。Sam Altman、Elon Musk随即表态支持,三大AI头部创始人
2026年9月9日,OpenAI宣布任命RLHF技术奠基人、ARC/METR创始人保罗·克里斯蒂亚诺加入基金会理事会及安全与安保委员会。此人曾公开写道AI灾难性失控"存在有实质意义的概率",并称OpenAI"并未走在将此风险降至可接受水平的