Thinking Machines Lab发布Inkling 975B参数模型 美国开放权重领先但落后中国
Thinking Machines Lab于2026年7月发布Inkling模型,总参数9750亿,激活参数410亿,支持文本图像音频输入和100万token上下文。该模型在美国开放权重模型的智能体任务中领先,但整体性能落后于中国顶尖模型。
Thinking Machines Lab于2026年7月发布Inkling模型,总参数9750亿,激活参数410亿,支持文本图像音频输入和100万token上下文。该模型在美国开放权重模型的智能体任务中领先,但整体性能落后于中国顶尖模型。
Moonshot发布Kimi K3,参数2.8万亿、上下文100万token,支持开放权重。部分编程与Agent测试超过Claude Opus 4.8,定价约为同类闭源模型一半。发布后纳斯达克100期货跌约2%,亚洲半导体指数跌超6%,Z.
Thinking Machines于2026年7月15日推出Inkling模型,总参数9750亿、激活参数410亿,支持文本图像音频原生推理,完整权重开放下载与微调。该模型在美国开源榜单上成为领先的开放权重模型,同时发布激活参数120亿的I
Mistral AI于2026年7月前后发布Leanstral 1.5模型,专为Lean 4形式化证明语言设计,总参数1190亿,激活参数60亿。该模型权重以Apache 2.0协议开源,并提供免费API端点。它在miniF2F测试集达到1
Meta Platforms于2026年7月发布Muse Spark 1.1模型,向美国开发者开放公共预览。模型支持100万token上下文,定价为输入每百万token 1.25美元、输出4.25美元,注册用户获20美元免费额度。该模型在工
2026年7月9日OpenAI将GPT-5.6系列模型转为正式可用,包含Sol、Terra、Luna三款模型。Sol在Artificial Analysis Coding Agent Index达到80分,领先Claude Fable 5
Meta于2026年7月7日推出Muse Image模型,允许用户通过Instagram公开账号标签生成图像,默认纳入公开内容而非事先征得同意。Public Citizen等组织批评其缺乏明确同意机制,Meta回应称已设置排除私人账户和未成
Anthropic近日指控阿里巴巴的Qwen实验室通过大规模API查询进行模型蒸馏,提取Claude的推理轨迹来训练竞品模型,此举违反了服务条款。这一事件引发了关于AI训练伦理、知识产权保护和行业公平竞争的广泛讨论,在X平台上相关帖文获得超
OpenAI在2026年6月22日宣布扩展Daybreak计划,推出GPT-5.5-Cyber模型,该模型在CyberGym基准测试中达到85.6%的得分。新模型集成Codex Security插件,支持漏洞的自动发现、验证与修复,同时启动
2026年6月19日,中国开发者在GitHub发布airllm 70B参数本地模型,迅速获得2万星标。Anthropic等公司随后采取封禁措施并引发诉讼。此事件将本地运行的开源模型与闭源服务之间的冲突公开化,也凸显出隐私保护与安全风险之间的
Anthropic的Claude Fable 5及Mythos 5于2026年6月12日因jailbreak漏洞担忧全球下架,至今未恢复。该事件将前沿模型的安全控制与用户访问、生物识别数据收集的冲突推向台面。支持方主张政府身份验证可降低风险
Mistral AI于2026年6月推出优化设备端推理的紧凑开源语言模型,支持强多语言性能,针对移动AI优化。该模型预计加速边缘部署和本地应用开发,引发行业对小型高效模型与大模型竞争的讨论。文章分析其创新点、不足及与同类产品对比,并为开发者
Anthropic于2026年6月12日公开承认Claude Fable 5模型中存在未披露的隐藏护栏,并为此道歉。开发者指出这一做法损害研究可重复性与信任,双方在X平台激烈争论安全与透明的优先级。事件发生在过去24小时内,已获两个独立来源
Moonshot AI近日正式开源Kimi-K2.7-Code编码模型,通过针对“过度思考”问题的优化,将推理token消耗降低30%,显著提升编码速度并降低成本。该模型一经发布便在中文AI开发者社区引发广泛讨论,预计将加速国产大模型在编程
Anthropic于2026年6月10日前后推出Fable 5模型,宣称性能最强却同时部署多重安全限制,包括查询时自动切换弱模型和Opus 4.8版本,并禁止生物医学等前沿领域研究。此举引发研究者大规模取消订阅,开源社区批评其垄断权力,安全
Anthropic正式推出Claude Fable 5模型,采用Mythos架构,在SWE-Bench等基准测试中超越GPT系列,定价亲民引发开发者广泛讨论,X平台互动量破百万,标志AI竞争进入新阶段。
阿里巴巴正式推出Qwen 3.7-Max模型,以仅为Claude六分之一的价格提供强大性能,支持长达35小时自主运行和千次工具调用。该产品发布凸显中国AI在成本效益上的显著优势,引发中外模型对比热议,中文社区讨论活跃,预示全球AI竞争进入新
Anthropic即将推出Claude Mythos模型及Opus 4.8版本,聚焦企业级应用与高级推理。新品发布引发行业关注,预计将进一步巩固其在AI助手市场的领先地位。本文深入分析产品特性、技术亮点及潜在市场影响。
在AI能力趋同的时代,守约能力(模型遵守承诺的可靠性)将成为关键指标。欧盟AI法案和中国算法治理强调合规,赢政天下(winzheng.com)的YZ Index WDCD测试率先量化此维度。企业选型将从跑分转向可控性,预测1年内主流评测跟进
NVIDIA通过单一OpenAI兼容端点提供80多个AI模型的免费API访问,包括DeepSeek、Kimi、MiniMax、GLM等热门模型,开发者社区反响热烈,但免费政策的持续性和使用限制条件仍存在不确定性。