Reddit热帖!开发者成功将DeepSeek V4量化KV缓存修复合并,单卡RTX PRO 6000跑百万上下文
2026-07-05 22:42:03
88次阅读
1个评论
开发者fairydreaming将量化KV缓存修复合并到DeepSeek V4分支,实现单卡RTX PRO 6000运行百万上下文,并展示性能数据。网友segmond用8张显卡测试,100万上下文依然流畅,希望尽快合并主线。另有网友询问工具调用和MTP支持,开发者回应MTP暂不支持,Pro版可正常使用。
0
0
2026-07-05 22:42:36

回复 |
引用
共1条
1
相关帖子
- Reddit热议!大神自制补丁让DeepSeek V4 Flash在RTX 5090上跑满1M上下文
- Reddit热议!老外如何评价DeepSeek V4 Flash本地跑满1M上下文?
- Reddit网友晒4块RTX6000Pro跑大模型,评论区热议
- Reddit热帖:Gemma 4 QAT 31B在KV缓存量化上表现更佳
- DeepSeek V4 Pro/Flash上线HuggingFace,网友热议参数与运行门槛
- DeepSeek V4 Pro被指智能密度下降 引发Reddit用户热议
- Reddit热议!Gemma 4 QAT模型KV缓存量化表现意外提升
- Reddit热议!Laguna S 2.1发布:性能超Deepseek V4 Pro,价格更低
- 网友用RTX6000 Pro跑本地Qwen3.6当日常编程主力
- Reddit热议!MiniMax M3模型发布,百万上下文+多模态引期待