32B 本地 vibe coding 有能用的模型吗

4 月 11 日
 RatioPattern

70B 以下 32B 左右的

2476 次点击
所在节点    Local LLM
7 条回复
ntdll
4 月 11 日
这种小模型的话,还不如用一下美团的垃圾模型( LongCat ),虽然垃圾,但是还是比这种小模型强多了。 整两三个手机号,一天的量足够了。
jark006
4 月 11 日
参数量太小,知识量和智力都不行,coding 能力不如 Openrouter 那些无限白嫖的模型。
真生产力还得是 claude/gpt ,或国产的 GLM5.1/Qwen3.6plus ,其他模型就真的不建议用。
如果只想白嫖,目前 trea 国版或 opencode 还能白嫖一些不错的模型。
yulon
4 月 12 日
30B 左右也就勉强做个文章概括
lujiaosama
4 月 12 日
你不会想用的。质量不说,吞吐速度都受不了。
rpish
4 月 12 日
@jark006 OpenRouter 免费模型差不多 10K 就限流了 Vibe Coding 就是狠狠烧钱
diudiuu
4 月 13 日
可能会把你气死.

最简单做个对比 gpt5-mini 写代码已经很拉了,你觉得本地 32b 会有比正常训练的 gpt5-mini 好?
coefu
4 月 14 日
要用好,需要很多绝招。比较难搞,但也并不是搞不成。

用多个 agent 并行,并且改造成隐式推理,用 LatentMAS 技术( https://arxiv.org/abs/2511.20639https://github.com/Gen-Verse/LatentMAS ),这个要改 模型的 transformer 架构,将 kvcache 流动起来,对显存也有挑战。 多个 agent 并行隐式推理,能保证速度,多个 agent 也能提升智能。

就算是 Qwen3.5-35B-A3B 的 BF16 ,也有 70GB 了,长 context 的 kvcache + LatentMAS 本身也要显存,估计单卡 128G ,可以搞。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1205176

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX