MacOS 上搭建了本地的 Gemma4,如何与它协作最高效?

4 月 10 日
 viskem

各位是如何做的?是使用什么对话窗口或是命令行、或者第三方工具? ClaudeCode / Cursor ? 平时我都用 Cursor 。(因为 ClaudeCode 屏蔽比较猛烈)所以本地的如何高效协作还希望参考下大家的优雅作风。

3258 次点击
所在节点    AI Agent 智能体
31 条回复
zoozobib
4 月 10 日
@viskem 没试过 27B 的 gemma4 , btw 有人觉得 qwen3.5 27b 很猛,我之前也用过一段时间,不过它性能一般且废话太多;另外,moe 和 dense 在复杂任务下还是有明显区别的,moe 我之前玩下来 还是可以的,不过上下文别太大,主打一个性能绝佳,跑跑 agent 任务还可以,开 reasoning 的情况下.
viskem
4 月 10 日
@zoozobib 不知道我 MacMini M4 64GB 内存 能否用得起
zoozobib
4 月 10 日
@viskem 配置不错,可以关注下 mlx + turboquant 的方案,现在玩家不少了
viskem
4 月 10 日
@zoozobib (头裂)刚交代了升级,又来了新知识~ orz……哈哈
kevan
4 月 10 日
昨天 5070ti+32GB 跑 26B 真的吃力。
Meteora626
4 月 10 日
别浪费自己时间跑这种小模型当大模型用。
Teresa789
4 月 10 日
前两天我同事给我安利,然后昨天我试了下,只能说体验极差,不知道网上说用 mac 跑这个 Gemma4 的是不是受了库克的钱🐶,随便问个简单的问题,都上几百秒的。想 vibicoding 算了吧
本人设备:mac studio m4 64GB
nidhogger
4 月 11 日
@zoozobib 老哥能分享一下用的什么硬件配置吗?想复刻试试
zoozobib
4 月 11 日
@nidhogger 32g + x570e + [4080s(或 3090 nvlink) + 3090] + c2000 2t ; 如果双显卡是 nvlink ,性能会比我当前还好,我现在是跑 pcie
zoozobib
4 月 11 日
@nidhogger pcie 35-38 左右的 token , --model ./google_gemma-4-31B-it-Q4_K_L.gguf --mmproj ./mmproj-gemma-4-31B.f16.gguf -ngl 99 --tensor-split 14,26 --ctx-size 204800 --flash-attn on --cache-type-k q8_0 --cache-type-v q8_0 --cache-ram 0 -np 1
nidhogger
4 月 11 日
@zoozobib 好吧,差显卡

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1204781

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX