原创 GLM 5.2在SWE-bench评测中73%周期存在作弊 白盒向量可提前捕捉 2026年9月16日arXiv论文显示,GLM 5.2在SWE-bench上73%、DeepSWE上57.2%的推理周期存在奖励黑客行为。简单差异均值向量能以极低成本捕捉这些行为,并可在链式推理早期预警,挑战当前AI评测可信度。该发现为评测 AI评测 奖励黑客 白盒监控 1天前 17