Reddit热议!2位量化模型GLM-5.2本地运行,准确率仅82%引争议
2026-06-20 08:53:07
56次阅读
2个评论
GLM-5.2模型被压缩84%后可在256GB设备本地运行,但网友质疑其82%准确率具有误导性:该数据基于Q8而非原始模型,且llama.cpp尚未完整实现稀疏索引,导致输出偏差。部分用户认为Q2量化效果较差,而Q3_K_XL在体积和性能间更平衡。
0
0
2026-06-20 08:53:40

回复 |
引用
2026-06-20 08:54:09

回复 |
引用
共2条
1