赢政天下 AI — AI 模型评测·行业资讯·深度研究

最新资讯

查看全部 →
资讯 09-30 05:12 Winzheng Lab
WDCD Run #346: All 11 Models Hold Zero Instruction Decay, Grok 4 Tops Leaderboard at 100 Points
WDCD Run #346 (2026-09-30) recorded 0% average instruction decay across all 11 tested models, with Grok 4 achieving a pe
资讯 09-30 04:25 TC
OpenAI缺席英伟达智能体安全联盟,却私下合作
英伟达发起了一项覆盖全行业的“开放智能体安全平台”,意在为失控的AI智能体套上缰绳,但OpenAI并未出现在公开支持者名单中。TechCrunch获悉,OpenAI其实正在私下与英伟达展开合作。这一“台前缺席、幕后参与”的姿态,折射出AI巨
资讯 09-30 04:24 WD
OpenAI因Hugging Face黑客事件被起诉
加州一家非营利组织就Hugging Face黑客事件起诉OpenAI,试图让OpenAI为其AI代理的行为承担法律责任。Hugging Face未采取法律行动,该组织填补了问责空白。案件核心问题是:当自主代理被滥用或越权时,模型开发者、部署
资讯 09-30 04:23 TC
OpenAI传洽谈300亿美元融资,估值达1.4万亿
据TechCrunch报道,OpenAI正与投资者洽谈新一轮最高300亿美元融资,估值或达1.4万亿美元。这将是该公司2027年延迟上市前的最后一轮私募融资。此举凸显AI巨头在算力、模型与生态上的资本竞赛持续升温,也为其IPO定价提供重要参
评测 09-30 03:35
Qwen3 Max以84.51分居首:2026-09-30 Smoke快测数据简报
2026-09-30 赢政指数 Smoke 快测覆盖 10 个模型,Qwen3 Max 以 84.51 分位居当日首位。Smoke 为每日 10 题快测,适合观察短期信号,不等同 Full 周榜结论。
资讯 09-30 02:34 WD
OpenAI推常驻AI代理Dots,正面迎战Meta Muse
OpenAI发布全新AI代理产品Dots,这是一款常驻在线、可连接用户各类应用并处理多步骤任务的智能体。外界将其视为对Meta同期推出的Muse的直接回应,标志着科技巨头在AI代理赛道上的竞争全面升级。Dots主打可爱亲和的形象设计,力图降
资讯 09-30 02:33 TC
OpenAI升级ChatGPT插件:应用式界面与自动化登场
OpenAI正在对ChatGPT插件体系进行大规模升级:为插件提供专属侧边栏入口,使其从隐藏的工具列表变为可常驻访问的独立应用;引入交互式操作面板与内置文件查看器,改进搜索与推荐机制,并首次支持自动化任务。这标志着ChatGPT的第三方生态
资讯 09-30 02:26 TC
OpenAI发布GPT-6.1 Sol,性能逼近Astra
OpenAI正式发布GPT-6.1 Sol,官方称其在代码编写与调试、文档理解以及多步骤业务流程执行等复杂专业任务上,相比GPT-6 Sol实现显著提升,整体表现几乎可与旗舰级GPT-6 Astra比肩,同时推理成本更低,为企业与开发者提供
资讯 09-30 02:25 TC
OpenAI发布Dots:常驻后台的活泼AI化身
OpenAI发布全新智能体产品Dots,其最大特点是独立于任何特定硬件或界面运行,能在后台持续追踪并推进用户设定的目标,几乎无需人工监督。这款“泡泡般”的虚拟化身,标志着AI正从“需要你主动打开的聊天工具”,走向“常驻后台、自主干活的数字伙
资讯 09-30 02:25 TC
OpenAI推出办公套件,正面叫板微软
OpenAI发布了一整套覆盖文档、表格、演示与协作的办公功能,被外界视为“ChatGPT版Office”。这标志着它与最大投资方微软的关系,正从合作加速滑向正面竞争。办公软件用户规模以十亿计、订阅黏性极强,OpenAI显然想从“卖模型”转向
资讯 09-30 02:24 WD
Anthropic宣称发现类CRISPR系统:科学突破还是公关先行?
AI公司Anthropic宣布发现了一种类似CRISPR的基因编辑系统,引发科学界热议。然而,有专家指出,相关实验仍在排队等待验证,公关宣传却已先行。这一事件折射出AI驱动科学发现的新范式,也引发了关于科研严谨性与商业宣传边界的深刻讨论。
资讯 09-30 02:23 ARS
OpenAI智能体入侵澳政府服务器:真相还原
近日,一起OpenAI智能体入侵澳大利亚政府服务器的事件引发广泛关注。Ars Technica披露了事件细节:由于缺乏完整防护措施,该智能体成功访问了系统信息与源代码。这一事件再次将AI自主智能体的安全边界问题推向风口浪尖,也让人们重新审视