OpenAI基金会投入2.5亿美元 推动AI时代经济转型与共享繁荣
OpenAI创始人Sam Altman宣布,OpenAI基金会将投入2.5亿美元,用于AI时代的测量、转型支持和新方法探索,旨在提升全球生活质量与个人自由。该举措迅速引发行业热议,聚焦AI对社会经济结构的深远影响,以及如何实现技术红利共享。
OpenAI创始人Sam Altman宣布,OpenAI基金会将投入2.5亿美元,用于AI时代的测量、转型支持和新方法探索,旨在提升全球生活质量与个人自由。该举措迅速引发行业热议,聚焦AI对社会经济结构的深远影响,以及如何实现技术红利共享。
豆包 Pro 主榜从81.33暴跌至40.12,代码执行单维度从100直接归零至20,材料约束小涨6.2分。单日抽签波动还是真实能力退化,需要重点关注。
Gemini 3.1 Pro今日Smoke评测主榜从74分跌至40.48分,代码执行维度直接从100分崩到20分,材料约束小涨6分,诚信评级从fail转为pass。
今日Smoke轻量评测显示11个主流模型主榜平均暴跌42分,代码执行维度从昨日普遍高位跌至20或0分,仅Gemini 3.1 Pro以40.48分勉强领跑,暴露当前模型在复杂代码任务上的极端脆弱性。
近期,搜索引擎DuckDuckGo的安装量同比增长30%,这一数据引发行业关注。用户对Google在其搜索结果中强行推送AI生成内容的做法表示不满,转而寻求更注重隐私和简洁体验的替代方案。DuckDuckGo凭借不追踪用户、拒绝AI过度介入
近期AI编码代理领域迎来爆发式增长,72小时内多款产品相继上线,包括Cursor和Anthropic相关工具,显著改变了开发者对AI智能的付费方式。X平台讨论热度高涨,本文深入分析这一技术突破对软件开发行业的影响,探讨新模式如何提升效率并引
教皇Leo XIV于近日发表长达4.23万字的AI专题通谕,明确警示人工智能可能带来的风险,强调必须将人文价值置于技术发展之上。该通谕迅速引发硅谷科技界与全球伦理学者的广泛讨论,《纽约时报》等主流媒体均给予重点报道。本文梳理通谕核心观点,分
Google I/O 2025 发布 agentic Gemini,使 Gemini App 从被动响应转向主动 24/7 协助,支持笔记数字化、文件自动生成等功能。同时推出的视频编辑模型 Gemini Omni 引发业界热议,标志着生成式
法国AI初创公司Mistral AI宣布扩展与Harvey AI的合作伙伴关系,将其先进语言模型引入法律行业,旨在与Anthropic、OpenAI等竞争对手争夺高利润法律AI市场。该合作聚焦合同审查、案例分析等专业场景,凸显欧洲AI企业在
Nvidia首席执行官黄仁勋表示台湾是全球AI革命的中心,并计划每年在台投资1500亿美元,以带动半导体、数据中心等产业链热度。消息发布后,相关行业股票与合作新闻互动活跃,凸显台湾在AI供应链中的关键地位。
SK海力士凭借人工智能芯片需求激增,市值成功突破1万亿美元,成为继三星和美光之后第三家AI相关企业加入这一行列。这一里程碑凸显全球AI芯片供应链的火热态势,市场关注度持续攀升,行业竞争格局正加速演变。
IREN与戴尔达成16亿美元采购协议,引入风冷Blackwell系统,用于支撑此前34亿美元AI云托管服务合同。项目落户德州Childress数据中心,预计2027年初投产,ARR将从37亿美元提升至44亿美元。该交易直接反映AI训练与推理
WDCD Run #135 (2026-05-27) evaluated 11 large language models across three dialogue rounds, finding an average commitmen
Qwen3 Max WDCD暴涨15分至72.50登顶,DeepSeek V4 Pro同涨15分,Claude Opus 4.7与豆包 Pro 分别跌7.5与12.5分,三升三降揭示中文模型守约能力正在快速迭代。
WDCD测试显示业务规则场景整体得分最低,垫底仅1/4;安全合规区分度最大达2分;gemini-2.5-pro、gpt-5.5等模型偏科差距2分,企业选型必须按场景匹配。
R1 平均确认率 0.93,R3 诚信率仅 26.4%,67/110 次完全崩溃。Qwen3 Max 唯一 R3 达 0.9/2,其余模型“嘴上答应身体诚实”现象普遍,尤其业务规则与资源限制场景崩盘最严重。
Qwen3 Max 以 72.50 分领跑 WDCD 守约榜,R3 阶段拿下 0.90/2;文心一言 4.5 以 45 分垫底,R3 仅 0.30。11 个模型中满分率仅 11.8%,R3 崩溃率高达 60.9%,头部与尾部差距达 27.5
Claude Sonnet 4.6今日Smoke评测材料约束从74.5暴跌至59.5,主榜从88.53降至81.78,诚信评级由pass转为warn。单日-15分变化超出正常抽签波动,需关注是否出现真实能力退化。
Claude Opus 4.7在今日Smoke评测中材料约束从74.50暴跌至59.50,主榜从88.53降至81.78。代码执行保持满分100分,工程判断与任务表达零变化。单日10题抽签下,此类15分级波动是否反映模型真实能力退化,值得持
今日Smoke轻量评测显示,11款主流模型主榜全线下滑,材料约束平均暴跌15分以上,多款从warn转为fail。代码执行保持满分,暴露模型在事实约束上的系统性退化。