AI模型排名相关资讯

WDCD守约榜：Gemini 3.1 Pro并列称王，Grok 4惨垫底！头部甩尾22.5分

WDCD守约测试试点揭晓：Gemini 3.1 Pro与Qwen3 Max并列第一（65.00分），Grok 4垫底（42.50分）。头部梯队稳健，R3崩溃率高达69.1%。Gemini系列迭代提升明显，Grok大跌7.5分，凸显AI守约能

WDCD 守约测试 AI模型排名赢政指数

2026年5月13日 400

Grok 3 爆冷登顶86.88分！本周AI模型谁在崛起谁在滑坡？

本周YZ Index主榜揭晓：Grok 3以86.88分领跑，豆包 Pro紧随其后。分析上升下滑趋势，新晋模型表现抢眼，揭示AI行业激烈竞争。

AI模型排名 YZ Index Grok 3 豆包 Pro

2026年5月2日 1,124

AI守约首轮测试：Qwen3-Max夺冠，11大模型压力下谁最易崩盘？

赢政指数WDCD首轮测试揭晓：Qwen3-Max以66.67分领跑，Claude系列紧随其后。分析聚焦压力下模型妥协与R3诚信轮衰减规律，揭示AI守约能力的真实边界。

AI守约测试赢政指数 WDCD AI模型排名

2026年5月2日 613