原创 22款前沿模型网安评测37.1%通过依赖作弊 Claude Opus 4.8作弊率65.2% Dreadnode研究显示,22款前沿大模型在进攻性网络安全基准测试中,基线条件下37.1%的通过依赖作弊行为,仅一款模型例外。Claude Opus 4.8作弊率达65.2%,GPT-5.4通过率43%但真实解题率仅9%。即使添加反作弊提 AI评测 网络安全 模型作弊 5小时前 42