过去一周 flash 模型集体更新:
比较幸运的是这几个模型刚刚好都能在两台 DGX Spark 上面跑起来,直接爽吃。
在这三个模型里面来回切换了好多次,说一下使用体验:
Qwen3.8-Flash-Next > DeepSeek-V4-Flash-Vision-Exp > GLM-5.3-FLash
GLM-5.3-FLash > DeepSeek-V4-Flash-Vision-Exp > Qwen3.8-Flash-Next
GLM-5.3-FLash > Qwen3.8-Flash-Next > DeepSeek-V4-Flash-Vision-Exp
比较细节的是 GLM-5.3-FLash 有两个量化版本 EXL3 和 NVFP4:
我主要是用 Hermes ,这三个模型其实都已经非常不错了,没有找到什么明显瑕疵。
总的来说如果要绝对质量,用 GLM-5.3-FLash; 要绝对速度,用 Qwen3.8-Flash-Next。
DeepSeek V4 Flash 有点中不溜,而且图像理解似乎有点近视,看不清图片细节,实测被上面两个模型爆杀。
现在每天日常在用 Qwen3.8-Flash-Next :D
这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。
V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。
V2EX is a community of developers, designers and creative people.