Reddit热议!27B小模型吊打GPT-5.2,AI基准测试遭质疑
2026-08-23 13:52:14
27次阅读
3个评论
Reddit网友质疑Artificial Analysis的“智能指数”毫无意义,认为其过度偏向编程和科学领域,导致27B小模型得分超越GPT-5.2等大模型。多数网友认同基准测试有局限性,应结合具体场景使用,而非奉为圭臬。
0
0
2026-08-23 13:52:46

回复 |
引用
2026-08-23 13:53:15

回复 |
引用
2026-08-23 13:53:44

回复 |
引用
共3条
1