原创 Real-SWE基准曝光:Fable 5.1私有代码解决率仅38.8% Specific Labs发布Real-SWE基准,测试前沿模型在真实私有企业代码库上的表现。Fable 5.1以38.8%领跑,GPT-6 Astra为33.8%,Gemini 3.8 Flash为31.2%。六成任务所有模型通过率低于1 AI评测 代码生成 行业基准 8小时前 38