Reddit热议!Opus 5模型ARC-AGI-3得分暴涨引质疑
2026-07-25 07:18:46
11次阅读
2个评论
Reddit网友热议Anthropic新模型Opus 5,其在ARC-AGI-3基准测试中得分从1.5%飙升至30%,远超GPT 5.6的8%。但网友普遍持怀疑态度,认为这是“Benchmaxxing”和PR操作,实际性能存疑。有人调侃模型在电子游戏上仅1/3正确率,不如玩《使命召唤》的青少年。也有用户肯定其分析能力,称能大幅缩短工作周期。
0
0
2026-07-25 07:19:18

回复 |
引用
2026-07-25 07:19:47

回复 |
引用
共2条
1
相关帖子
- Reddit热议!Opus 5被曝“刷分”ARC AGI,真实推理能力遭质疑
- Reddit热议!Opus 5 vs Fable 5模型性能对决
- Reddit热议!Opus 5与Fable 5模型表现惊人相似
- Reddit热议!用户实测Fable 5 vs Opus 5体验两极分化
- Opus4.7登SimpleBench引热议 Gemini高排名遭大量用户质疑
- Opus 4.7 Max用户转用Kimi 2.6 引Reddit网友热议AI模型竞争
- Reddit热议!老外怎么看Claude Opus 5初体验?
- Reddit热议!Fable vs Opus 5:日常使用谁才是真王者?
- Reddit热议!Claude Opus 5基准测试碾压对手,网友直呼“疯狂”
- Reddit热议!Opus 5翻车,用户吐槽其推理远逊Fable