Reddit热议!M5 Max跑通1M上下文,生成速度还这么猛?
2026-09-09 17:55:02
4次阅读
2个评论
开发者发布Qwen3.8-Flash-Next引擎,在M5 Max 128GB上实现1M上下文稳定生成,散文40 tok/s、代码75 tok/s。网友惊叹真实长上下文性能,但64GB用户被劝退,认为需128GB才能流畅运行。
0
0
2026-09-09 17:55:35

回复 |
引用
2026-09-09 17:56:04

回复 |
引用
共2条
1
相关帖子
- Reddit热议!老外如何评价DeepSeek V4 Flash本地跑满1M上下文?
- Reddit热议!4B小模型叫板Qwen 9B,还支持1M上下文?
- Reddit热议!大神自制补丁让DeepSeek V4 Flash在RTX 5090上跑满1M上下文
- Reddit热议!Qwen3.7开放权重版首曝,1M上下文窗口引期待
- 用户在MacBook Pro M5 Max 128GB本地跑通Qwen3.6-35B,体验不输Claude
- Reddit热议!MiniMax M3模型发布,百万上下文+多模态引期待
- Reddit热议!苹果M5 Ultra 512GB内存能本地跑千亿大模型?
- Claude上下文token占用离谱引AI使用认知热议
- Reddit热帖!16GB显卡硬刚27B大模型,100K上下文跑满速
- Reddit热帖!开发者成功将DeepSeek V4量化KV缓存修复合并,单卡RTX PRO 6000跑百万上下文