NVIDIA Alpamayo 2 Super开源34B模型支持商用 强化长尾场景推理
NVIDIA于2026年8月4日发布Alpamayo 2 Super,这是一款34B参数视觉-语言-动作模型,基于Cosmos 3 Super Reasoner构建并经强化学习后训练,采用OpenMDW-1.1许可开放权重,专为机器人出租车
NVIDIA于2026年8月4日发布Alpamayo 2 Super,这是一款34B参数视觉-语言-动作模型,基于Cosmos 3 Super Reasoner构建并经强化学习后训练,采用OpenMDW-1.1许可开放权重,专为机器人出租车
英伟达推出Alpamayo 2 Super开源推理模型,支持商业使用和微调。该34B参数视觉语言动作模型针对自动驾驶长尾场景,基于Cosmos 3 Super Reasoner构建,在LingoQA基准上得分79.2。OpenMDW-1.1
DeepSeek于2026年7月31日发布V4-Flash正式版API公测,支持Responses API格式并适配Codex,模型架构与预览版一致,仅重新后训练。V4-Pro正式版即将发布。该模型已集成至OpenCode Go等工具,用户
7月31日,MiniMax发布视频生成模型H3并以开放权重形式提供,支持文本到视频及基于参考的视频生成。同日字节Seedance 2.5亮相,两款中国视频模型正面撞车。fal等推理平台已同步上线H3的API端点。开源社区对国产模型开放权重给
7月31日,DeepSeek发布V4 Flash模型,采用MoE架构并以MIT许可开放权重,支持100万tokens上下文,定位面向Agent任务的高性价比选择。开发者社区反响积极,但长上下文实际利用率与复杂场景稳定性仍待第三方验证。
Meta首席执行官马克·扎克伯格于2026年7月29日表示,美国不应通过封禁中国AI模型取得领先,同时警告顶尖实验室可能借监管规则压制本土对手。他重申支持开源模型,反对限制强大开源AI,主张解决自身产业障碍而非阻止竞争对手。
OpenAI与Anthropic向美国政府警示中国AI模型国家安全风险,Anthropic报告2.4万账号、1600万次蒸馏互动;Nvidia、微软、Meta等支持开放权重模型,反对过度限制。辩论焦点为蒸馏防护与全球竞争力,直接影响出口管制
25家美国科技公司于2026年7月25日前后发布联名信,反对华盛顿对开源权重模型采取过早限制措施。信中强调此类模型有助于竞争与安全,Moonshot AI的Kimi K3等中国模型引发关注。OpenAI、Anthropic和Google未签
2026年7月17日,OpenAI战略未来负责人Dean W. Ball在X平台发文评价Moonshot AI于7月16日发布的Kimi K3模型,认可其在代理编码任务中接近2026年Q1最佳公开模型的性能,同时警告开放权重策略可能削弱前沿
月之暗面7月16日发布2.8万亿参数Kimi K3模型,48小时内请求量远超预期并逼近算力极限。7月19日公司宣布暂停C端新用户订阅,优先保障已订阅用户,同时拆分主权益与Kimi Code权益以优化资源分配。该事件凸显高端算力供需矛盾,也引
北京月之暗面公司于2026年7月16日发布Kimi K3模型,参数规模2.8万亿,上下文窗口100万词元,原生支持视觉理解。该模型计划7月27日开放权重,成为全球最大开源权重模型。报道显示其在软件工程和知识工作任务中表现接近Anthropi
2026年7月 Hugging Face 披露生产环境遭自主AI Agent 多阶段攻击,恶意数据集利用远程代码加载器和配置模板注入获取初始权限,攻击者横向移动并窃取凭证。调查中商业模型安全过滤器阻挡包含攻击载荷的取证请求,转而使用 GLM
GLM 5.2作为中国开源权重模型,在网络安全智能体基准测试中接近闭源前沿模型Opus和GPT-5.5的水平。该模型参数规模达744B,支持百万token上下文窗口,可能通过蒸馏或架构突破实现。开源社区正热议其在成本与性能之间的平衡,引发对
GLM 5.2作为开源模型在本地运行表现优异,支持1M token上下文,可处理整个代码库,采用MIT许可无限制使用。通过Ollama等工具,开发者可轻松部署,性能接近Opus 4.8,引发本地AI硬件需求热议,被誉为本地AI的ChatGP
谷歌DeepMind于2026年6月11日发布DiffusionGemma模型,总参数260亿,采用混合专家架构,推理仅激活约38亿参数。在NVIDIA H100上文本生成速度超过1000 token/秒,较传统自回归模型快约4倍。该模型支
Moonshot AI正式开源Kimi-K2.7-Code模型,该模型在推理阶段token消耗减少约30%,显著提升编码效率与智能水平。此举在中文AI社区引发热烈讨论,有望推动开源编码工具的进一步发展,为开发者提供更高效的智能辅助。
Cohere正式开源Command A+,采用218B总参数、25B活跃参数的MoE架构,支持128K上下文与多模态输入。该模型在电信代理任务中得分从37%跃升至85%,终端基准硬难度从3%提升至25%。Apache 2.0许可允许企业自由
中国AI企业DeepSeek推出V2模型,在中文数学和代码推理上超越Claude 3.5 Sonnet,总参数236B且完全开源。X平台互动超15万,开发者测试刷屏,凸显本土AI崛起与中美科技竞赛。该模型标志着开源大模型新时代。
NVIDIA 正式开源 PersonaPlex-7B,这是一款专为实时全双工语音交互设计的端到端 AI 模型。该模型打破了传统“对话-等待”的模式,支持随时打断、自然语气反馈及极低延迟响应(首字延迟仅 170ms)。它基于 Moshi 架构
中国AI公司DeepSeek推出V2开源模型,采用236B参数MoE架构,推理成本仅为GPT-4o的1/30。在Hugging Face平台下载量爆棚,互动超8万。中英文双语能力突出,开发者fork率高涨,助力本土AI生态快速发展。