Reddit热议!Claude Opus 5基准测试碾压对手,网友直呼“疯狂”
2026-07-25 06:46:10
13次阅读
2个评论
Reddit用户热议Anthropic新模型Claude Opus 5在多项基准测试中表现惊人,尤其是ARC-AGI-3得分远超GPT-5.6 Sol,且价格更低。网友猜测Anthropic可能故意削弱了Opus 5在敏感领域的性能,以规避监管。同时,Opus 5在工具使用和视觉能力上被认为优于Fable 5,引发对AI发展速度的惊叹与讨论。
0
0
2026-07-25 06:46:43

回复 |
引用
2026-07-25 06:47:12

回复 |
引用
共2条
1
相关帖子
- Claude Opus 4.7数学基准测试表现拉胯,被GPT新版本碾压
- Reddit热议!开源基准测试让AI玩《Balatro》,最高仅通关5轮
- Qwen3.6-27B发布 基准超Claude Opus引Reddit热议
- Reddit热议!共和党为何疯狂给对手贴“跨性别”标签?
- Reddit热议!老外怎么看Claude Opus 5初体验?
- Reddit热议!Kimi K2.7编码模型发布,网友质疑基准测试不标准
- Reddit热议!普京对手“意外”毒蘑菇身亡,网友集体看错标题
- Reddit热议!Opus 5 vs Fable 5模型性能对决
- Reddit热议!Opus 5与Fable 5模型表现惊人相似
- Reddit热议!小女孩赛后安慰对手,网友:这才是真正的冠军