谷歌更新Android Bench引入新LLM,Gemini仍显落后
Google近日更新了其移动端性能基准测试工具Android Bench,新增了对大型语言模型(LLM)的测试支持,但自家的Gemini模型在多项指标上表现不佳。这一变化标志着移动AI性能评估进入新阶段,开发者可通过反馈引导测试流程的完善。
Google近日更新了其移动端性能基准测试工具Android Bench,新增了对大型语言模型(LLM)的测试支持,但自家的Gemini模型在多项指标上表现不佳。这一变化标志着移动AI性能评估进入新阶段,开发者可通过反馈引导测试流程的完善。
MLCommons 发布了 MLPerf Mobile v4.0 Android 版基准测试结果,这是移动 AI 性能评估的最新标准。此次测试涵盖图像分类、目标检测、超分辨率、语音识别、3D-UNet、BERT Squad 和 Stable