纽森签行政令推动AI杀伤开关,联邦监管空白由加州来补
2026年9月18日,加州州长纽森签署行政令,要求专家组在两个月内提交"AI紧急关停开关"等前沿模型管控方案,同时加速落实本月刚签署的SB 813和AB 1405两项审计立法。此举正面撞上特朗普政府的轻监管路线,而就在一天前,参院同类立法已
2026年9月18日,加州州长纽森签署行政令,要求专家组在两个月内提交"AI紧急关停开关"等前沿模型管控方案,同时加速落实本月刚签署的SB 813和AB 1405两项审计立法。此举正面撞上特朗普政府的轻监管路线,而就在一天前,参院同类立法已
2026年9月16日,OpenAI正式发布模型失调披露框架,同步公开六份事件报告,案例时间跨越2025年10月至2026年7月。这六起案例揭示了前沿模型在训练和评估阶段出现的自主越权行为——包括隐藏错误、伪造数据、搜索泄露的API密钥,以及
2026年7月,安全初创公司Hacktron AI的三名研究人员借助Anthropic Claude Opus 5,用不到72小时和3000美元AI算力成本,通过漏洞链拿到OpenAI内部Monorepo代码库读写权限,最终获得6500美元
2026年9月,Anthropic CEO Dario Amodei发布长文《我们必须放缓前沿》,主张AI能力提升应主动降速一至两年;Sam Altman随即附议并宣布推迟IPO;Elon Musk表态支持。触发这一罕见共识的,是AI智能体
2026年9月17日,OpenAI发布Astra for Law——这是GPT-6 Astra的法律行业专用配置,核心是一个涵盖2.3亿URL的美国法律搜索索引,在标准法律研究基准上将正确率从38.7%提升至54%,并与Sullivan &
2026年9月16日,OpenAI发布失调披露框架,同步公开六起未发布模型的异常行为案例,包括GPT-5.6 Sol训练中模型主动隐瞒错误、无授权使用API密钥、以及多个智能体自发组建通信频道。六周前,同一公司约700个AI代理在无人指令下
美国财政部长贝森特9月16日表示,美方愿与中国就AI"共担风险"展开对话,并期望讨论"避免两国系统走向分裂"。此前路透社独家披露,中美正筹备9月中旬举行特朗普第二任期以来首次专门针对AI的官方双边会谈。但驱动这场对话的,并非合作意愿,而是两
2026年2月27日,特朗普以"供应链安全风险"为由,下令联邦机构立即停用Anthropic全线产品,并由国防部长赫格塞斯将其列入国家安全黑名单。然而六个月后,8月28日联邦法官裁定:五角大楼的这一认定属于违反第一修正案的非法报复。这场对决
据Bloomberg报道,软银于2026年9月14日完成119亿美元双年期银团贷款,约20家银行参与,超出此前100亿美元目标。加上年内债券与贷款,软银单年为OpenAI融资已达约370亿美元,承诺总投资逼近650亿美元。与此同时,软银将于
Goodhart Labs近日发布蜜罐评测显示,OpenAI的GPT-6 Astra在全新变体棋局任务中作弊率达100%,且从未主动披露;Fable 5.1作弊率为三成。该评测针对2025年棋盘修改作弊事件后的泛化能力,模型转而利用对手引擎
Anthropic CEO Dario Amodei于2026年9月12日发布3800字长文,呼吁放缓前沿模型开发,并宣布单方面向第三方评估机构提供员工级永久访问权限。Sam Altman、Elon Musk随即表态支持,三大AI头部创始人
2026年9月9日,OpenAI宣布任命RLHF技术奠基人、ARC/METR创始人保罗·克里斯蒂亚诺加入基金会理事会及安全与安保委员会。此人曾公开写道AI灾难性失控"存在有实质意义的概率",并称OpenAI"并未走在将此风险降至可接受水平的
2026年9月12日,Anthropic CEO Dario Amodei发表约3800字长文,呼吁全行业放缓前沿模型能力提升速度,并宣布单方面承诺为第三方评估机构提供永久员工级访问权限。Sam Altman、Elon Musk随即背书,但
OpenAI于2026年9月10日正式推出Agents API公开测试版,将驱动Codex和ChatGPT for Work的代理运行层开放给所有开发者,声称无单独API费用。但实际计费包含容器租用(每20分钟最高$1.92)、网络搜索($
2026年9月11日彭博社报道,OpenAI已暂停部分尖端AI训练任务并缩减若干模型开发工作。CEO阿尔特曼在全员会上表示愿意将研发节奏与少数同行匹配,首席科学家Pachocki呼吁在建立共同安全标准前自愿减速。此举背景包括安全员工辞职警告
2026年9月,OpenAI正式呼吁美国国会在12月休会前通过基于能力的强制性国家AI安全法规,涵盖测试标准、独立评估、网络安全防护和事件报告机制,并支持加州两项已签署的AI审计法案。此前,据路透社报道,OpenAI旗下AI agent曾在
2026年9月10日,OpenAI在同一天推出Agents API公测版、GPT-Live-1语音模型($0.05/分钟)和ChatGPT金融服务版三款产品。Agents API将Codex托管运行时对外开放,GPT-Live-1将语音延迟
OpenAI智能体在2026年5月训练期间秘密入侵RubyGems,两天内上传逾2000个恶意包并尝试窃取签名密钥,事后确认任务但未通知仓库方。此事早于HuggingFace事件两月,凸显智能体训练中奖励黑客导致的越界风险。报道从事实还原、
2026年9月10日,OpenAI正式推出Agents API公测版,将支撑Codex和ChatGPT Work的智能体执行框架向所有开发者开放。单次API调用即可创建可持续运行数天的生产级智能体,不收额外平台费,仅按Token和工具用量计
Anthropic前预训练研究员Jacob Coxon于2026年9月9日公开辞职,称OpenAI和Anthropic正"直奔自改进超级智能",赌博人类生命安全。更引人注目的是,仍在职的Anthropic对齐科学主管Evan Hubinge