Nvidia与Firmus Technologies战略合作:AI算力成本优化新路径
澳大利亚AI基础设施公司Firmus Technologies近日与Nvidia签署战略伙伴协议,旨在为新兴AI企业提供更具成本效益的算力资源。此举正值全球AI算力需求激增之际,双方合作将聚焦高效能计算平台,帮助初创公司降低门槛。行业专家认
澳大利亚AI基础设施公司Firmus Technologies近日与Nvidia签署战略伙伴协议,旨在为新兴AI企业提供更具成本效益的算力资源。此举正值全球AI算力需求激增之际,双方合作将聚焦高效能计算平台,帮助初创公司降低门槛。行业专家认
2026年6月OpenAI发布GPT-5.6模型后,美国政府要求仅限约20家获批客户使用以开展安全审查。OpenAI表示此举不应成为常态但已遵守。文章分析该限制对模型可用性的影响,比较同类产品开放策略,并为开发者和企业提供合规建议。
2026年6月,美国政府以国家安全为由对Anthropic新模型Fable 5实施出口管制,因其越狱风险可能解锁强大网络能力。Anthropic无法按国籍过滤用户,选择全球禁用该模型。此举引发安全优先与创新速度的激烈讨论,凸显AI发展中技术
在赢政指数2026年6月Smoke评测中,豆包Pro主榜从98.61分跌至84.77分,单日下降13.8分,主要源于代码执行维度从100.00分跌至75.00分。
2026-06-29 Smoke 评测显示 Claude Opus 4.7 以执行 100、约束 100 拿下主榜 100 分第一。豆包 Pro 主榜暴跌 13.8 分至 84.77,主因执行仅 75 分。Claude 系列较昨日执行从 5
GPT-5.6等前沿AI模型面临严格审批,引发“仅限美国用户”“需提交ID监控聊天”等争议。X平台大V讨论获数万浏览,焦点转向身份验证、监管边界与全球公平性。本文分析监管动因、公众反应及潜在影响,探讨AI访问权的未来走向。
Google Gemini 3.5 Pro发布再次延期,叠加OpenAI和Anthropic模型受限,AI市场本周蒸发2690亿美元市值。焦点从模型性能转向实际部署执行力,行业动态显示监管与供应链瓶颈影响发布节奏。文章分析延期原因、市场反应
智谱AI正式发布7440亿参数GLM 5.2开源模型,在编程基准超越GPT-5.5并接近Claude Opus 4.8。该模型采用MIT协议开源,API价格较竞品低85%,通过设备农场蒸馏技术快速追赶美国模型,引发All In Podcas
Anthropic近日指控阿里巴巴的Qwen实验室通过大规模API查询进行模型蒸馏,提取Claude的推理轨迹来训练竞品模型,此举违反了服务条款。这一事件引发了关于AI训练伦理、知识产权保护和行业公平竞争的广泛讨论,在X平台上相关帖文获得超
OpenAI原定6月发布的GPT-5.6因白宫网络安全出口管制被迫推迟至7月,需政府批准后有限发布。此举与Fable 5模式类似,引发开发者对前沿模型获取权限的担忧及行业监管讨论,社交媒体互动量激增。
Flex旗下JetCool于2026年6月27日前24小时内发布一站式液冷服务器解决方案。该方案针对高密度AI工作负载,提供数据中心冷却性能、可靠性和部署速度的提升,直接作用于企业AI硬件基础设施建设。
SpaceX于2026年6月24日确认Starmind项目,计划发射搭载处理器与太阳能阵列的AI卫星,在轨完成计算而非仅传输数据。Starship单次运载30至50颗卫星,原型机定于2027年初发射,年底启动量产。该系统针对地面数据中心土地
WDCD Run #202 (2026-06-28) measured multi-turn commitment integrity across 11 frontier models, recording an average inst
本期WDCD测试中8个模型全部上涨、零下降,Claude Opus 4.7增幅达19.8分,Gemini 3.1 Pro以93.57分登顶,Grok 4紧随其后92.86分。
WDCD五场景测试显示安全合规全体得分最低,最高仅deepseek-v4-pro 3.57/4,claude-sonnet-4.6垫底2.57/4;gemini-3.1-pro在数据边界与资源限制双4分,grok-4在业务规则独得4分,do
WDCD三轮测试显示,R1平均确认率0.95,R2抵抗率0.82,R3平均诚信率仅1.63/2。Grok 4在R3保持1.83/2且零崩溃,而Claude Sonnet 4.6与GPT-o3各崩6次(17.1%),多约束场景成为最大崩盘诱因
Gemini 3.1 Pro 以 WDCD 93.57 分位居首位,文心一言 4.5 以 75.71 分垫底。头部三名 R3 得分均超 1.69,尾部两名 R3 仅 1.34-1.54,R3 崩溃率达 8.8%。
在赢政指数2026年6月Smoke评测中,Claude Sonnet 4.6主榜从96.45分跌至70.52分,代码执行维度从100.00直接腰斩至50.00。材料约束反而小幅上升3.5分,工程判断保持满分,诚信评级维持pass。
赢政指数今日Smoke评测中,Claude Opus 4.7代码执行从100.00分跌至50.00分,主榜从97.12分降至71.47分,单日暴跌25.7分。材料约束小幅回升,工程判断和任务表达保持高位,诚信评级仍为pass。
2026-W26 Smoke日测数据显示,文心一言4.5从98.74跌至61.52,趋势-37.2;Claude Sonnet 4.6、Claude Opus 4.7波动分别达28.4和28.5。豆包Pro持平,诚信评级改善模型仅两家。数据