赢政天下 AI — AI 模型评测·行业资讯·深度研究

最新资讯

查看全部 →
资讯 08-19 18:24 MIT
儿童监控应用,也许该“重启”了
Pam Wisniewski的青少年时光让她亲眼看到互联网最美好与最糟糕的一面。14岁时她离开受虐家庭,投奔姐姐,通过AOL即时通讯自学打字并寻找慰藉。如今,这位研究者认为,市面上的儿童监控应用更像数字枷锁,而非保护工具。她提出重新思考这些
资讯 08-19 18:23 TC
Relativity Networks获2200万美元融资,空芯光纤提速数据中心
Relativity Networks宣布完成2200万美元融资,专注于空芯光纤技术,该技术比传统光纤传输速度快30%,有望为数据中心带来革命性改变。本轮融资将用于技术研发和商业化部署,加速这一前沿技术从实验室走向大规模应用。
资讯 08-19 17:23 WD
无人机监控升级?Flock新AI工具让警方如虎添翼
美国监控公司Flock的车牌识别摄像头已引发多方争议。WIRED通过获取其代码,确认该公司下一代AI系统已在美国部分警察局投入使用,其功能远超单纯追踪车牌,可对车辆特征、行驶轨迹进行深度分析,引发新一轮隐私担忧。本文编译WIRED调查报道,
资讯 08-19 14:22 NF
OpenAI暂停前沿模型强化学习训练两周 安全监控成本上升
OpenAI因模型能力提升带来的风险增加,暂停最新部署模型的强化学习训练两周,同时加强研究环境安全监控。此举源于内部风险阈值触发,最大前沿RL运行仍处于暂停状态,监控开销已达监督推理算力的20%。
资讯 08-19 14:20 NF
Cerebras CS-4三晶圆并联 宣称推理速度超GPU三十倍
Cerebras于2026年8月18日推出CS-4系统,采用三枚WSE-3 Turbo晶圆并联,宣称在万亿参数模型上每秒输出超1000 token,较GPU方案快最多30倍,并与OpenAI合作推出GPT-5.6 Sol Ultrafast
评测 08-19 09:38
如何判断AI基准测试是否值得信赖
在企业AI应用中,基准测试分数常被用作模型选型和采购决策的依据,但部分结果存在“benchmark washing”问题。本文基于MLCommons多年实践,提出七项信任测试准则,涵盖基准相关性、数据污染控制、可复现性、指标完整性、模型作弊
评测 08-19 09:37
MLPerf Client v2.0 发布:新增图像生成与智能体AI基准
MLCommons近日推出MLPerf Client v2.0基准测试套件,扩展了对AI PC的评估能力。新版本新增图像生成和Agentic AI类别,同时升级LLM推理测试,支持Phi 4 Mini Instruct和Qwen 3 8B模
评测 08-19 09:37
SGLang 实现 Muse Glimmer Day-0 支持,优化本地 Agentic 推理
Meta Superintelligence Labs 与 SGLang 团队合作,为 30B 参数多模态模型 Muse Glimmer 带来 Day-0 支持。该模型具备 128k+ 上下文窗口,专为本地 Agentic 工作流设计。SG
评测 08-19 09:37
统一基数缓存:混合模型前缀缓存的单一树结构
本文介绍SGLang的Unified Radix Cache方案,通过单一radix tree拓扑解决混合模型(FULL、SWA、MAMBA等组件)的KV缓存复用难题。组件机制分离共享前缀身份与特定复用规则,支持HiCache跨GPU L1
评测 08-19 09:37
SGLang 实现 NVIDIA Nemotron 3.5 Lightning 零日支持
SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供零日支持。该模型采用 30B 参数混合专家架构,仅激活 3B 参数,专为高吞吐量代理任务设计,支持最长 1M 上下文长度。模型支持多令牌预测、DFlash
评测 08-19 09:36
SGLang 实现 Qwen3.8 模型 Day-0 支持
SGLang 与 Miles 团队携手 Qwen、NVIDIA 等,为 Qwen3.8-2.4T-A95B 提供 Day-0 支持。该模型拥有 2.4T 总参数、95B 激活参数,采用混合注意力架构,对服务栈状态管理提出新挑战。文章详述混合
评测 08-19 09:36
SGLang 高级 CUDA Graph 技术解析
本文深入探讨 SGLang 在 CUDA Graph 上的创新实践。通过重构 Runner/Backend 架构,SGLang 实现了 Breakable CUDA Graph(BCG)等高效策略,在不牺牲兼容性、启动时间和内存的前提下,最