Claude Opus 4.7 97.12 分领跑,执行满分但材料约束 93.6 分拉低整体
2026-06-27 Smoke 评测显示,Claude Opus 4.7 以 97.12 分位居第一,代码执行 100 分、材料约束 93.6 分。Claude Sonnet 4.6 紧随其后,主榜 96.45 分。三个模型并列第三,主榜
2026-06-27 Smoke 评测显示,Claude Opus 4.7 以 97.12 分位居第一,代码执行 100 分、材料约束 93.6 分。Claude Sonnet 4.6 紧随其后,主榜 96.45 分。三个模型并列第三,主榜
2026年6月25日OpenAI确认GPT-5.6仅限小范围合作伙伴预览,需逐个接受美国政府审查。该决定与Anthropic事件叠加,引发AI界两极分化。批评者认为过度干预将使美国落后中国,支持者强调需防止高风险模型扩散。X平台安全与创新辩
2026年6月24-25日,美国政府以出口管制和国家安全为由,要求Anthropic全面暂停Fable 5及Mythos模型全球访问。Anthropic国际负责人确认短期内不会恢复,行业辩论聚焦安全风险与美国AI竞争力损失。
2026年6月25日,Hasbro要求Peppa Pig儿童配音演员签署新合同,允许AI复制其声音用于所有商业资产。Agents of Young Performers Association发出公开信,指出合同条款不可协商,引发行业对未成
OpenAI宣布与Broadcom合作开发首款定制AI芯片,加速基础设施建设。结合GPT系列模型延期消息,市场聚焦其自研硬件战略与全球AI竞争格局变化。该合作或重塑AI算力供应链,值得持续关注。(98字)
GLM 5.2作为中国开源权重模型,在网络安全智能体基准测试中接近闭源前沿模型Opus和GPT-5.5的水平。该模型参数规模达744B,支持百万token上下文窗口,可能通过蒸馏或架构突破实现。开源社区正热议其在成本与性能之间的平衡,引发对
SK Hynix凭借AI内存芯片需求激增,超越三星电子成为韩国市值最高公司,并计划通过纳斯达克上市筹资294亿美元建设新厂。AI热潮将内存从普通商品转变为战略物资,引发全球供应链重组与股市讨论。本文深入分析这一行业动态及其对三星、全球半导体
美光科技Q3财报显示AI相关DRAM与NAND需求强劲,毛利率达84.6%,并与客户签订长期供货协议覆盖20%产能。HBM4产品已进入高量出货阶段,AI基础设施建设推动营收大幅增长,股市与供应链反应积极。行业人士认为,此举凸显AI内存市场的
OpenAI原定本周发布的GPT-5.6因内部原因推迟,Codex使用限额同时引发用户不满。内部信息显示后端已就绪,延期或与产品策略调整有关,而非监管因素。此事引发业界对AI开发进度与发布节奏的广泛讨论。
美光科技于2026年6月22日宣布与Anthropic达成多年期内存供应协议,同时参与其H轮融资。协议涵盖HBM、DRAM和SSD在AI训练与推理场景的应用,双方将共同优化数据中心能效与成本。Anthropic借此保障Claude模型长期算
OpenAI于2026年6月24日与Broadcom联合发布首款AI加速器Jalapeño,定位LLM推理场景,目标降低对单一供应商依赖。官方称性能功耗比优于现有方案,但最终规格报告尚未发布,首批数据中心部署定于2026年底。该事件折射出大
斯坦福大学2026年AI指数报告显示,生成式AI在三年内全球普及率达到53%,行业主导模型引领前沿发展,中美AI性能差距已基本消除。报告指出组织采用率高达88%,AI能力加速迭代,引发全球产业与政策讨论。文章客观分析数据与影响。
受AI需求放缓担忧影响,半导体股遭遇抛售,Kioxia和DRAM相关股票单日跌幅达15%。Bloomberg等媒体报道引发投资者恐慌,市场讨论AI投资是否进入调整期。本文分析事件背景、个股表现及行业影响,保持客观视角探讨未来走势。
高通以39亿美元股票交易收购AI软件初创公司Modular,旨在提升其在AI数据中心芯片市场的竞争力。此举被视为应对NVIDIA等对手的重要战略,市场反应积极。文章分析了交易背景、技术整合潜力以及对行业格局的影响,展现高通在AI领域的布局意
OpenAI与Broadcom合作发布首款定制AI推理芯片Jalapeño,旨在提升推理效率并显著降低成本,标志着OpenAI从模型研发向全栈AI硬件战略的重大推进。该产品已在TechCrunch和WSJ等媒体广泛报道,引发半导体与AI行业
OpenAI在2026年6月22日宣布扩展Daybreak计划,推出GPT-5.5-Cyber模型,该模型在CyberGym基准测试中达到85.6%的得分。新模型集成Codex Security插件,支持漏洞的自动发现、验证与修复,同时启动
WDCD Run #196 (2026-06-24) tested 11 leading models across three dialogue rounds, recording an average commitment decay
Qwen3 Max在今日Smoke评测中代码执行从100.00分跌至50.00分,主榜从74.00分微降至72.50分。材料约束升至100.00分,诚信评级从fail转为pass,单日波动幅度达50分。
Claude Opus 4.7今日Smoke评测主榜从100.00跌至72.50分,代码执行维度从100.00暴跌至50.00分,材料约束保持100.00不变,工程判断从83.40升至100.00,诚信评级维持pass。
2026-06-24 Smoke评测中,文心一言4.5主榜暴跌34.1分至64.63,Claude Opus 4.7和Claude Sonnet 4.6分别下跌27.5分与24.4分,核心原因是代码执行从100直接跌至50。今日前三名Dee