Anthropic为Claude Fable 5隐藏护栏道歉 开发者质疑透明度缺失
Anthropic于2026年6月12日公开承认Claude Fable 5模型中存在未披露的隐藏护栏,并为此道歉。开发者指出这一做法损害研究可重复性与信任,双方在X平台激烈争论安全与透明的优先级。事件发生在过去24小时内,已获两个独立来源
Anthropic于2026年6月12日公开承认Claude Fable 5模型中存在未披露的隐藏护栏,并为此道歉。开发者指出这一做法损害研究可重复性与信任,双方在X平台激烈争论安全与透明的优先级。事件发生在过去24小时内,已获两个独立来源
斯坦福2026 AI指数报告显示,AI能力加速提升,SWE-bench解决率接近100%,生成AI三年内采用率达53%。美中差距持续缩小,企业AI采用率高达88%,成为行业基准讨论热点。报告强调AI在软件工程与商业应用中的突破,同时指出伦理
Visa宣布将支付功能直接集成至ChatGPT,支持AI代理自主完成购物与结算。新推出的Agentic Commerce Protocol标志着AI从对话工具向真实交易场景跨越,预计将推动零售、金融等行业商业应用爆发式增长,同时引发数据安全
亚马逊创始人Jeff Bezos的AI初创公司Prometheus宣布完成120亿美元B轮融资,估值达410亿美元。该公司定位“通用工程AI”,Bezos亲自参与解读,引发全球科技媒体与投资者广泛讨论。本文分析融资背景、公司定位及潜在行业影
Moonshot AI近日正式开源Kimi-K2.7-Code编码模型,通过针对“过度思考”问题的优化,将推理token消耗降低30%,显著提升编码速度并降低成本。该模型一经发布便在中文AI开发者社区引发广泛讨论,预计将加速国产大模型在编程
赢政指数Smoke评测显示,Gemini 2.5 Pro今日材料约束从92.50分跌至77.30分,降幅15.2分,但代码执行从55.00分升至100.00分,主榜总分反而上涨17.9分至89.79分。单日10题快测波动或为主要原因。
在赢政指数2026年6月Smoke评测中,Claude Opus 4.7材料约束从96.00骤降至79.50,主榜从96.83跌至90.78,工程判断同步下滑17.5分,需区分抽签波动与真实退化。
2026-06-13 Smoke评测显示11个模型中10个代码执行满分,材料约束却普遍暴跌15-30分。Claude Opus 4.7主榜90.78分排名第一,GPT-5.5材料约束跌至66分,主榜仅84.7分。豆包Pro主榜单日上涨23.
In WDCD Run #164 (June 11, 2026), 11 frontier LLMs acknowledged user constraints 95.8% of the time, but only 68.3% still
2026年6月11日左右,OpenAI提交机密S-1文件,正式启动IPO筹备。该举动直接影响AI行业融资节奏与估值体系。消息经X平台与Google多源核实确认。文章分析此举对开发者、企业融资路径的实际影响,并对比同类AI公司上市进程,提供具
2025年6月11日OpenAI发布报告,追踪到两组疑似与中国有联系的网络活动,利用ChatGPT生成反对美国AI数据中心建设的图像和帖文。这些内容声称建厂会推高电价,并将关税包装成技术控制工具。活动者使用VPN、简体中文提示词,伪装成美国
xAI正式发布Grok Build Plugin Marketplace测试版,支持MongoDB、Vercel等多款集成,开发者可通过终端直接构建应用。相关X平台帖子获得数万互动,业界热议AI工具生态的进一步扩展。此次发布标志着Grok从
OpenAI已秘密提交IPO申请文件,估值预计达到1万亿美元,计划于9月上市。这一举动与Anthropic等AI公司形成IPO热潮,引发市场对AI企业资本化路径、监管挑战及行业未来的广泛讨论。文章分析了此次IPO的背景、潜在影响及市场反应,
今日 Smoke 快测中,Gemini 3.1 Pro 以 96.96 分夺冠,Claude Opus 4.7 紧随其后 96.83 分。两者代码执行同为 97.5 分,拉开差距的主要是材料约束维度。GPT-5.5 执行 97 分却约束仅
OpenAI于2026年6月10日提交机密S-1表格,正式启动IPO准备工作。文件可能泄露,显示这家AI公司正从研究导向转向商业市场。该举动标志其融资和治理结构的调整,但具体条款尚未公开。
2026年6月10日OpenAI确认中国支持的行动者利用ChatGPT制定反数据中心和关税影响计划,通过假美国账号传播AI耗电破坏家庭的虚假信息。账号终止后,相关讨论集中在国家行为体对生成式AI的利用、虚假内容检测机制以及平台对跨境影响行动
Anthropic于2026年6月10日前后推出Fable 5模型,宣称性能最强却同时部署多重安全限制,包括查询时自动切换弱模型和Opus 4.8版本,并禁止生物医学等前沿领域研究。此举引发研究者大规模取消订阅,开源社区批评其垄断权力,安全
WDCD Run #164 (2026-06-11) evaluated 11 frontier models across three dialogue rounds, recording an average commitment de
R1确认率96%、R2抵抗率81%却在R3跌至68.3%,73次完全崩溃暴露模型“嘴上答应身体诚实”本质。GPT-o3崩溃率最高达56.7%,Claude Sonnet仅6.7%,揭示持续压力下的真实行为模式。
WDCD测试中GPT-5.5以88.33分夺冠,GPT-o3仅61.67分垫底,头部尾部差距26.66分,R3崩溃率22.1%。11模型中仅43.6%满分,新老版本表现剧烈分化。