Anthropic恢复Fable 5模型 18天出口管制暂停后重启
Anthropic于2026年7月2日前宣布Fable 5模型恢复上线。此前该模型因美国出口管制和国家安全审查暂停18天。官方推文显示,支持者认可其安全处理方式,反对者则指出政府干预限制了模型访问。事件凸显前沿AI发布需接受监管审查的新常态
Anthropic于2026年7月2日前宣布Fable 5模型恢复上线。此前该模型因美国出口管制和国家安全审查暂停18天。官方推文显示,支持者认可其安全处理方式,反对者则指出政府干预限制了模型访问。事件凸显前沿AI发布需接受监管审查的新常态
2026-07-02 Smoke 评测显示,Gemini 3.1 Pro 以主榜 82.97 分(执行 75、约束 92.7)位居第一,豆包 Pro 81.98 分紧随其后。Claude Opus 4.7 约束 97 分最高,但执行仅 58
亚马逊在与OpenAI达成500亿美元商业合作数天后,放弃了Luca Guadagnino执导的《Artificial》电影发行权。该片预算约4000万美元,聚焦Sam Altman 2023年董事会危机。Neon正接近收购此片,此前Net
Anthropic于2026年6月10日致函美国参议院,指控阿里巴巴通过2.5万个虚假账户和2880万次交互,在2026年4月22日至6月5日期间大规模蒸馏Claude模型。据路透社和CNBC报道,此案若属实将成为中国企业对美国AI公司最大
2026年7月,美国政府以国家安全和出口管制为由,要求Anthropic全面暂停Fable 5和Mythos 5前沿模型的访问。这一决定在行业内引发支持者与批评者的激烈辩论,前者强调安全监管必要性,后者指出其可能制造技术壁垒并压制创新。用户
WDCD Run #207 (2026-07-01) measured multi-turn commitment across 11 frontier models, recording an average commitment dec
WDCD三轮测试显示R1确认率98%、R2抵抗率77%、R3诚信率81.4%,Grok 4全程满分,GPT-5.5 R3崩溃5次,多约束场景下安全合规与数据边界约束最易失效。
Grok 4 以 WDCD 100.00 分满分排名第一,GPT-5.5 以 62.50 分垫底;R3 崩溃率 12.7%,头部与尾部差距达 37.5 分,Claude 系列本期提升显著。
豆包Pro今日Smoke评测主榜从85.91分跌至67.32分,代码执行从83.30分暴跌至44.50分,材料约束反而升至95.20分。单日10题快测中代码执行维度出现大幅波动。
赢政指数今日Smoke评测显示,Grok 4主榜从97.98分跌至82.73分,降幅15.3分,其中代码执行从100.00分骤降至68.60分。材料约束和任务表达反而上升,诚信评级维持pass。单日10题快测下,此类波动是否反映真实能力变化
2026-07-01 Smoke 轻量评测显示,Claude Opus 4.7 以 94.82 分(执行 94.5,约束 95.2)占据主榜首位,Claude Sonnet 4.6 紧随其后。Gemini 3.1 Pro 主榜暴跌 32.2
OpenAI o1系列模型通过推理阶段动态分配计算资源,实现了无需额外训练即可提升性能的突破。这一“推理时计算扩展”被视为继参数规模后的新AI scaling维度,在X平台引发技术圈广泛讨论。文章深入剖析其技术原理、与传统预训练差异,以及对
Digital Realty以35亿美元收购Blackstone持有的弗吉尼亚数据中心股权,标的估值达78亿美元。此交易反映AI算力需求激增下,数据中心资产正成为机构投资者重点标的。交易凸显基础设施领域资本活跃度提升,同时也引发市场对数据中
韩国政府近日宣布大规模AI芯片发展计划,重点投资下一代内存技术和6500亿规模AI数据中心建设。在总统Ezyong推动下,该战略迅速引发全球行业关注,凸显AI硬件竞赛白热化态势。计划涵盖半导体技术突破与基础设施升级,旨在提升韩国在全球AI供
OpenClaw于2026年6月29日推出iOS和Android原生移动应用,支持用户在移动端运行AI代理、处理任务和频道回复。该应用沿用网页版界面设计,目标是将AI代理能力延伸至便携场景。相比网页版,此举解决了随时访问的问题,但仍需验证实
Tidal于2026年6月29日发布AI政策,7月15日起对完全AI生成音乐自动添加“AI”标签,并从即日起停止向此类内容支付版税。该政策要求分销商提前识别AI内容,同时移除冒充艺术家或欺诈性作品。平台强调优先保障人类原创作品的收益,但也接
福特汽车在引入AI质量管控系统后发现实际效果不及预期,于2026年6月29日前后重新雇佣350名资深工程师负责零部件故障排查。该举措预计今年节省10亿美元成本,并在JD Power调查中帮助福特登上主流品牌质量榜首。事件显示AI在复杂制造场
今日Smoke评测中,Claude Sonnet 4.6主榜从97.84分跌至82.52分,降幅15.3分。其中代码执行从100.00直接跌到75.00,材料约束小降3.5分,而工程判断和任务表达反而分别升10.4分和16.7分。
在赢政指数今日Smoke评测中,Claude Opus 4.7主榜从100.00分跌至84.01分,代码执行维度从100.00分暴跌至72.80分,降幅达27.2分。材料约束仅降2.3分,工程判断反而上升9.1分,诚信评级维持pass。
2026-06-30 Smoke 评测显示,Gemini 3.1 Pro 以 98.47 分(执行 100、约束 96.6)排名第一。Claude Opus 4.7 执行分暴跌 27.2 至 72.8,主榜跌 16 分;文心一言 4.5 主