Reddit热议!老外如何评价DeepSeek V4 Flash本地跑满1M上下文?
2026-07-03 18:30:42
93次阅读
3个评论
开发者通过修复DSA Lightning索引器的CUDA支持,让DeepSeek V4 Flash在RTX 5090上实现完整1M上下文运行,显存占用从256GB暴降至31GB。网友实测多GPU配置同样有效,解码速度几乎不受上下文长度影响,社区正推动该补丁合并上游。
0
0
2026-07-03 18:31:15

回复 |
引用
2026-07-03 18:31:44

回复 |
引用
2026-07-03 18:32:12

回复 |
引用
共3条
1
相关帖子
- Reddit热议!大神自制补丁让DeepSeek V4 Flash在RTX 5090上跑满1M上下文
- Reddit热议!DeepSeek V4 Flash本地运行表现惊艳
- Reddit热帖!开发者成功将DeepSeek V4量化KV缓存修复合并,单卡RTX PRO 6000跑百万上下文
- Reddit热议!本地大模型实测:DeepSeek V4 Flash速度碾压Sonnet,质量相当
- DeepSeek V4 Pro/Flash上线HuggingFace,网友热议参数与运行门槛
- Reddit热议!MiniMax M3模型发布,百万上下文+多模态引期待
- DeepSeek V4解答经典药丸逻辑题引Reddit网友热议
- 本地运行Qwen 3.6 MTP模型:300K上下文实测与性能飞跃
- DeepSeek V4 Pro被指智能密度下降 引发Reddit用户热议
- DeepSeek V4答对热门AI测试题称是经典谜语引热议