AI 大模型资源圈

国内外大模型资源分享、技术交流、实用工具、场景应用与资源分类整理。

  • 小陈 发表时间:2026-08-31 08:39:13 最新回复:2026-08-31 08:40:43

Reddit热议!本地跑大模型成新潮流,网友吵翻了 Qwen 推理部署 研究方向 国内模型

43
3
  • 小陈 发表时间:2026-08-31 02:24:59 最新回复:2026-08-31 02:26:01

Reddit热议!llama.cpp距离CPU推理提速仅差50个PR 推理部署 研究方向

51
2
  • 小陈 发表时间:2026-08-30 08:37:25 最新回复:2026-08-30 08:38:27

Reddit热议!腾讯把1.5TB模型压到200GB,性能只掉2%? 推理部署 研究方向

43
2
  • 小陈 发表时间:2026-08-30 08:30:25 最新回复:2026-08-30 08:31:56

Reddit热帖!16GB显卡硬刚27B大模型,100K上下文跑满速 Qwen 推理部署 研究方向 国内模型

58
3
  • 小陈 发表时间:2026-08-28 02:33:50 最新回复:2026-08-28 02:34:23

Reddit热议!英伟达证明AI模型不是主角,框架才是? 推理部署 研究方向

59
1
  • 小陈 发表时间:2026-08-27 02:42:48 最新回复:2026-08-27 02:44:19

Reddit热议!老外怎么看Qwen新架构本地部署潜力? Qwen 推理部署 研究方向 国内模型

65
3
  • 小陈 发表时间:2026-08-27 02:03:51 最新回复:2026-08-27 02:04:52

Reddit热议!苹果M5 Ultra 512GB内存能本地跑千亿大模型? 推理部署 研究方向 DeepSeek 国内模型

59
2
  • 小陈 发表时间:2026-08-24 14:24:15 最新回复:2026-08-24 14:25:46

Reddit热议!本地大模型移植3.9万行C代码,耗时4小时仍失败 Qwen 推理部署 研究方向 国内模型

24
3
  • 小陈 发表时间:2026-08-24 14:19:35 最新回复:2026-08-24 14:20:37

Reddit热议!从Windows换到Linux,AI推理速度暴涨50%? 推理部署 研究方向

23
2
  • 小陈 发表时间:2026-08-21 12:18:40 最新回复:2026-08-21 12:19:42

Reddit热议!16张5060Ti组256GB显存跑DeepSeek V4 Flash 推理部署 研究方向

24
2
  • 小陈 发表时间:2026-08-19 18:21:48 最新回复:2026-08-19 18:22:50

Reddit爆火!硬核玩家用4张RTX 3060跑144GB大模型 推理部署 研究方向 DeepSeek 国内模型

23
2
  • 小陈 发表时间:2026-08-10 13:32:04 最新回复:2026-08-10 13:33:05

Reddit热议!老外狂赞LFM 2.6B小模型:速度惊人,手机就能跑 推理部署 研究方向

116
2
  • 小陈 发表时间:2026-08-10 08:08:33 最新回复:2026-08-10 08:10:04

Reddit热议!AI论文被批“垃圾”:为0.6B模型配H100显卡引众怒 推理部署 研究方向

113
3
  • 小陈 发表时间:2026-08-07 13:26:17 最新回复:2026-08-07 13:27:48

Reddit热议!开发者用C++20重写vLLM,推理无需Python 推理部署 研究方向

100
3
  • 小陈 发表时间:2026-08-06 13:19:16 最新回复:2026-08-06 13:19:49

Reddit热帖:大神自研引擎让2.6B模型在手机纯CPU跑出17 tok/s 推理部署 研究方向

114
1
  • 小陈 发表时间:2026-08-05 00:42:45 最新回复:2026-08-05 00:43:46

Reddit热议!6万块二手服务器跑284B大模型,性能竟超预期? 推理部署 研究方向

131
2
  • 小陈 发表时间:2026-08-04 19:16:42 最新回复:2026-08-04 19:17:15

Reddit热议!8GB内存跑2.78T参数大模型,老外怎么看? 推理部署 研究方向 Kimi 国内模型

143
1
  • 小陈 发表时间:2026-08-03 01:09:56 最新回复:2026-08-03 01:10:58

Reddit热议!llama.cpp火速支持DeepSeek V4 Flash加速推理 推理部署 研究方向 DeepSeek 国内模型

142
2
  • 小陈 发表时间:2026-08-02 19:10:24 最新回复:2026-08-02 19:11:54

Reddit热议!大神用C语言在8GB内存CPU上跑起2.8万亿参数Kimi K3 推理部署 研究方向 Kimi 国内模型

139
3
  • 小陈 发表时间:2026-08-02 18:53:26 最新回复:2026-08-02 18:54:58

Reddit热帖!老外如何在24GB显卡上跑起284B大模型? 推理部署 研究方向 技术工具

48
3
  • 小陈 发表时间:2026-07-30 19:21:55 最新回复:2026-07-30 19:22:57

Reddit热议!Kimi K3模型被压缩至594GB,1-bit量化仍保持78.9%准确率 推理部署 研究方向 Kimi 国内模型

149
2
  • 小陈 发表时间:2026-07-30 13:00:47 最新回复:2026-07-30 13:01:48

Reddit热议!768GB内存+双5090跑Kimi K3仅4t/s 推理部署 研究方向 Kimi 国内模型

152
2
  • 小陈 发表时间:2026-07-29 18:50:16 最新回复:2026-07-29 18:51:18

Reddit热议!DeepSeek V4在AMD芯片上跑出32 tok/s,性能翻倍引围观 推理部署 研究方向 DeepSeek 国内模型

153
2
  • 小陈 发表时间:2026-07-28 07:13:36 最新回复:2026-07-28 07:14:38

Reddit热议!Kimi K3权重发布,A100部署被吐槽“惨不忍睹” 推理部署 研究方向 Kimi 国内模型

143
2
  • 小陈 发表时间:2026-07-05 22:42:03 最新回复:2026-07-05 22:42:36

Reddit热帖!开发者成功将DeepSeek V4量化KV缓存修复合并,单卡RTX PRO 6000跑百万上下文 推理部署 研究方向 DeepSeek 国内模型

240
1
  • 小陈 发表时间:2026-07-05 16:43:23 最新回复:2026-07-05 16:44:55

Reddit热议!本地大模型代理工作负载的真正瓶颈:预填充压倒一切 推理部署 研究方向

226
3
  • 小陈 发表时间:2026-07-04 05:02:15 最新回复:2026-07-04 05:03:45

Reddit热议!Deepseek新突破DSpark速度飙升60-80% 推理部署 研究方向 DeepSeek 国内模型

232
3
  • 小陈 发表时间:2026-07-03 16:53:25 最新回复:2026-07-03 16:54:55

Reddit热议!大神自制补丁让DeepSeek V4 Flash在RTX 5090上跑满1M上下文 推理部署 研究方向 DeepSeek 国内模型

249
3
  • 小陈 发表时间:2026-07-03 06:32:37 最新回复:2026-07-03 06:34:07

Reddit热议!用“熵”提升LLM创意写作,成本与效果引争议 推理部署 研究方向

256
3
  • 小陈 发表时间:2026-06-29 05:28:31 最新回复:2026-06-29 05:30:02

Reddit热议!llama.cpp正式支持DFlash,AI推理速度再提升 推理部署 研究方向

262
3
共142条 1 2 3 4 5 下一页