Anthropic指控阿里巴巴用2.5万假账户提取Claude模型能力
Anthropic于2026年6月10日致信美国参议员,指控阿里巴巴关联Qwen实验室通过近25000个虚假账户,在4月22日至6月5日期间与Claude进行超过2880万次交互,规模接近此前三家中国实验室合计1600万次的两倍,目标直指代
Anthropic于2026年6月10日致信美国参议员,指控阿里巴巴关联Qwen实验室通过近25000个虚假账户,在4月22日至6月5日期间与Claude进行超过2880万次交互,规模接近此前三家中国实验室合计1600万次的两倍,目标直指代
Wired曝光Meta通过肯尼亚承包商雇用数百人,伪装未成年账号向ChatGPT、Gemini发送自杀、自残、儿童剥削提示,测试安全漏洞。该操作被Meta称为负责任基准测试,但引发伦理争议与竞争指控。文章分析测试原理、实际执行效果及行业影响
据英国《卫报》援引金融时报报道,OpenAI 正处于早期讨论阶段,可能向美国政府提供约 5% 股权,以探索让公众分享 AI 经济收益的机制。该设想仍属概念方案,可能需要国会批准。
微软 MAI Diagnostic Orchestrator 在 NEJM 复杂病例研究中达到约 80% 至 85.5% 的诊断准确率,高于受限条件下医生组约 20% 的表现。但该系统仍处研究阶段,不能直接等同临床可用产品。
MarketWatch 报道称,Meta 正准备通过名为 Meta Compute 的云服务出租富余算力。消息传出后,CoreWeave 和 Nebius 股价下跌,市场担心大型平台从客户变成云算力竞争者。
美国解除相关限制后,Anthropic 的 Fable 5 恢复访问。公开报道显示,事件源于安全担忧和越狱风险缓解,Anthropic 增加了针对漏洞利用类提示的过滤措施。
《华尔街日报》报道,快手 AI 视频业务 Kling 完成 28 亿美元融资,作为计划分拆和潜在香港上市的一部分。本轮投资方包括 CPE、国方投资、BlueFive Capital、腾讯和中信证券。
在赢政指数2026年6月Smoke评测中,Qwen3 Max主榜从84.92分跌至72.02分,代码执行维度从96.30分暴跌至69.50分,降幅达26.8分,材料约束则小幅上升4.1分。
2026-07-04 Smoke轻量评测中,Gemini 2.5 Pro以主榜96.99分(执行100、约束93.3)登顶,Qwen3 Max主榜暴跌12.9分至72.02。GPT-o3与Gemini 2.5 Pro单日分别上涨24分和22
WDCD v3.1五大约束场景横评显示,业务规则场景全体得分最低,doubao-pro与qwen3-max仅1.55/4垫底;grok-4在安全合规拿下3.86/4最高分,同时在全部场景保持第一;Claude-sonnet-4.6工程规范与
v2锚点题数据显示,R1确认率99%,R2抵抗率63%,R3诚信率仅30.2%,275次测试中出现44次完全崩溃。GPT-o3与GPT-5.5在R2阶段快速失守,Grok4和Claude系列R3崩溃率控制在8%以内,展现不同模型在多轮压力下
Grok 4 以 91.20 分位列 WDCD 守约排行榜第一,Qwen3 Max 57.48 分垫底,头部尾部相差 33.72 分。11 个模型中满分率仅 29.1%,R3 崩溃率达 16%,v2 锚点题 R3 得分成为区分关键。
WDCD Run #211 (2026-07-03) benchmarked 11 models on multi-turn commitment integrity, with Grok 4 taking the top spot at
MarketWatch 报道称,Meta 计划推出 Meta Compute 后,CoreWeave 和 Nebius 股价分别下跌 13.9% 和 17%。市场担心超大平台将富余算力商品化,改变 AI 云服务竞争格局。
NVIDIA 研究团队发布 Nemotron-TwoTower 论文,提出将上下文塔和扩散去噪塔解耦,在 30B 混合模型上保留 98.7% 基线质量,同时实现 2.42 倍生成吞吐提升。
微软推出 Microsoft Frontier Company,计划投入 25 亿美元并配置 6000 名驻场工程师和行业专家,帮助企业设计、部署和优化 AI 系统。
2026年3月29日UFC西雅图站比赛期间,UFC使用AI生成宣传片引发观众批评。总裁Dana White在赛后新闻发布会上直接回应,要求批评者闭嘴看比赛,并称AI已到来。事件凸显AI图像生成技术在体育娱乐营销中的实际应用,以及由此引发的效
2026-07-03 Smoke 评测显示,GPT-5.5 以执行 100 分、约束 71 分拿下主榜 86.95 分首位。Claude Sonnet 4.6 紧随其后,主榜 86.12 分。豆包 Pro 则以约束 81.7 分反超执行表现
Anthropic于2026年推出Claude Science Beta版,这款面向科学家的AI工作台提供文献分析、3D蛋白结构渲染和基因组浏览等60余项功能,并集成NVIDIA BioNeMo平台,支持可审计代码执行与计算资源管理。目前该
Anthropic指控阿里巴巴通过25000个虚假账户发起2880万次查询,从Claude模型中提取知识。该事件已获确认,涉及中美AI知识产权争端。文章分析Claude在安全机制上的创新与防护不足,对比同类模型,提出开发者与企业应对蒸馏风险