美国三大情报机构联合点名六家中国AI企业,工业级蒸馏指控背后是一场定义战
2026年9月8日,美国NSA、CISA与FBI联合发布网络安全公告,指控DeepSeek、Moonshot AI等六家中国AI企业自2024年底起,通过数十亿token、数百万次查询系统性抽取美国前沿模型能力,称此举构成中国AI产业政策的
2026年9月8日,美国NSA、CISA与FBI联合发布网络安全公告,指控DeepSeek、Moonshot AI等六家中国AI企业自2024年底起,通过数十亿token、数百万次查询系统性抽取美国前沿模型能力,称此举构成中国AI产业政策的
2026年9月9日,DeepSeek上线deepseek-v4.1-flash-expires-on-0910限时内测。该模型采用全新架构,原生支持多模态,通过现有API访问,定价与V4 Flash系列一致,单账号并发上限20请求,计划于9
NVIDIA通过Build平台为DeepSeek、Qwen、Kimi、MiniMax、GLM等五家中国AI模型提供免费OpenAI兼容API,开发者无需信用卡即可一键调用。此举与美国政府封锁芯片出口的政策方向形成鲜明反差,折射出AI时代硬件
DeepSeek正推进约500亿元人民币投前估值的Pre-IPO融资,计划8月底前完成50亿元人民币募集,并准备2026年底提交科创板上市申请,2027年公开募股。此轮融资涉及CATL、CPE等机构,标志中国AI企业资本化进程加速。
2026年8月28日,腾讯混元正式开源Hy4 Preview,总参数770B、激活参数49B、上下文窗口超100万token。在Terminal Bench 2.1代码基准中得分85.4,超越DeepSeek V4 Pro并与Claude
英伟达宣布以60亿美元授权费取得AI初创Poolside的"模型工厂"技术,另投10亿美元并吸纳109名核心工程师进入Nemotron项目,剑指DeepSeek和Kimi K3。此举标志英伟达从算力供应商正式踏入前沿模型战场,但其真实战略目
加州大学伯克利分校与得克萨斯大学奥斯汀分校团队于2026年8月17日发布FreeToken,这套边缘原生MoE推理引擎通过带宽自适应调度,将本地可运行的参数上限从数十亿推至7530亿:8GB笔记本GPU运行35B模型、游戏台式机运行284B
OpenRouter平台数据显示,AI代理的token消耗量自2026年2月6日起增长14倍,从0.51万亿攀升至7.3万亿,而同期人类用户仅增长2.8倍。代理单次请求的token消耗量约为人类对话的13至15倍。这是AI基础设施进入"自我
一个被条款点名禁用的中国前沿实验室,以月产 8,273 个 commit 的节奏、在 Claude Code 与 OpenAI Codex 上造出自己的 agent 框架——这不是 DeepSeek 的孤例,而是系统性绕行:蚂蚁走新加坡实体
在这场争议里有一个几乎没人提的不对称:指控 DeepSeek 的公司把模型焊得死死的,而 DeepSeek 把权重、工具库、如今连整套 agent 框架都以 MIT 协议开源——它大大方方地让全世界来蒸馏它自己。于是问题不再是简单的"偷没偷
从 2025 年初到现在,指控 DeepSeek "蒸馏"的名单越来越长,数字一个比一个具体:1600 万次交互、2.4 万个账号、DeepSeek 逾 15 万次。但把这些指控排成一列会发现一个反常识的事实——一年过去,没有任何一方拿出可
DeepSeek 是被 Anthropic 服务条款明令禁用的中资实体,其开源框架的官方 CI 里却持有 Anthropic 生产密钥——这把"个别工程师私下用"升级为"公司基础设施的设计"。但它不违反任何美国或中国法律:FT 的定性是绕道
DeepSeek 开源 agent 框架 DeepSeek Harness 当天,"抄袭泄露代码"的说法在中文社区迅速流传。我们把 Claude Code 与 dsh 的代码都拉下来做了一次可复现取证:字符串零交集、git 历史完整无倾倒、
DeepSeek于2026年8月12日发布V4 Pro正式版,已在OpenRouter等平台可用,代理基准测试表现突出。X平台基准结果快速传播,开发者对性能接近或超越Qwen的说法反应积极,但长期稳定性和企业部署案例仍需观察。该事件加剧开源
DeepSeek V4 Flash模型过去24小时内展开新测试,强调更低token成本与更快服务速度,在SWE任务中成本仅为GPT-5.6的1/3,此事已获多方证实。AI工程师社区迅速传播,焦点集中于性价比与部署效率。长期性能稳定性和生态兼
DeepSeek于2026年7月31日发布V4-Flash正式版API公测,支持Responses API格式并适配Codex,模型架构与预览版一致,仅重新后训练。V4-Pro正式版即将发布。该模型已集成至OpenCode Go等工具,用户
7月31日,DeepSeek发布V4 Flash模型,采用MoE架构并以MIT许可开放权重,支持100万tokens上下文,定位面向Agent任务的高性价比选择。开发者社区反响积极,但长上下文实际利用率与复杂场景稳定性仍待第三方验证。
Kimi K3与DeepSeek等中国低成本大模型表现引发国际关注,一则声称“中国领先AI竞赛”的帖文被嘲讽,凸显高端硬件必要性争议。辩论涉及多方参与,焦点在于成本与性能平衡如何重塑竞争格局。
DeepSeek宣布将V4-Pro模型75%的折扣政策永久化,将一次促销变成了长期定价。开发者社区普遍欢迎,但单位经济模型的可持续性仍是悬念。这一动作或将重新校准全球AI API市场的价格锚点,给OpenAI、Anthropic带来真正意义
赢政指数 v7 推出实验性维度 DCD(动态语境衰变),首次系统性测量大模型在多轮对话中守住初始约束的能力。30 道题、三轮对话、五类场景、规则判分零 AI 介入——这是国内外公开评测体系中第一个针对"AI 在长对话中会不会忘掉自己承诺过什