现在有哪个国产大模型可以拿来踏踏实实的写代码了吗?

6 月 1 日
 wilddog
不至于达到 CC 或者 codex 的水平,就是能作为生产力用。

现在有吗?
4139 次点击
所在节点    人工智能
38 条回复
wilddog
6 月 2 日
@dingawm 我想问的就是差多少
差 10%=能用
差 20%=将就着用
差 30%但是足够便宜=捏着鼻子用
差 50%=完全不可用

你的意思是 DeepSeek 目前是国产模型编程能力最强的吗
wangtufly
6 月 2 日
梁圣在大 A 割你韭菜,在模型上补贴回来。这不赶紧蹬,捞回本
94
6 月 2 日
最近因为公司在测试各家的 Teams 套餐。同时多开工作区共同开发同一个项目,所以国内模型也试了挺多。
个人感觉 GLM 的表现最符合预期的。deepseek 用起来总感觉一直在莫名其妙的深度思考……
Mimo 听同事说也不错,准备这两天切换过去主力用起来看看。
94
6 月 2 日
@zisen #10 ,确实 minimax 是体感最差的,用来写代码有点抽象……
murmur
6 月 2 日
glm 没有深度思考的时候比较好,一深度思考就完犊子
Vipcw95
6 月 2 日
cc 接 ds 不赖的
dingawm
6 月 2 日
@wilddog #21 每个人的使用场景和任务都不一样,所以每个人体感可能都不一样,简单任务可能主流模型都能完美解决,复杂任务上才能看到差距。我试过不算复杂的偏业务的前端和后端服务,体感上是 能用,更复杂的还没试过。
DeepSeek 不是国模最强,但是其他的国模比 DeepSeek 也没有强太多。意思是如果你觉得 DeepSeek 完全接受不了,那换成其他国模估计也差不多。
zenfsharp
6 月 2 日
我在 Opencode 中用下来,所有的模型里,kimi2.6 用得最踏实,基本都能按照意图去干活; DeepSeek 偶尔思路会跑偏,必须给它规划好所有实现方式,用来做实现也行; Mimo 路边一条,又慢又辣鸡,一个简单的实现,kimi 五分钟做完了,Mino 自己在那一惊一乍地“等等! wait !实际上,让我查查,太好了!简直完美”半小时。
BingoXuan
6 月 2 日
我常用的测试 case 中:Qwen3.6-27B 加上 Skills 可以很好完成任务,就是费上下文和执行起来有点固执,但 gemma 31B 编码一堆问题。DeepSeek V4 Pro 反而可以一次完成。
zhuoyan
6 月 2 日
GLM5.1 和 dsv4Pro 都还可以
jedeft
6 月 2 日
@shakaraka kimi 不行,有些问题,分析死循环,不停的说,不对,我再看看,我再看看。
snxq1995
6 月 2 日
最开始使用的是 glm ,模型本身不错,就是速度太慢,动不动中断,非常不适合跑长任务。作为老年费 pro 也被背刺就退款了。

上个月白嫖的 mimo ,综合体验很不错,执行力很强,理解力稍微差点。目前作为备用模型。

现在的主力是 gpt5.5 。不过不是国产就不评价了。
wilddog
6 月 2 日
@94 get,我去试试
wilddog
6 月 2 日
@dingawm 我准备试试 glm 先
wilddog
6 月 2 日
@zenfsharp 有画面感了哈哈哈哈
wilddog
6 月 2 日
@zhuoyan get
wilddog
6 月 2 日
@snxq1995 我主力也是 gpt5.5 ,但是感觉他太慢了...cc 总被封号,gemini 写项目差点意思,只能 debug ,所以准备研究下国内大模型
ljxyqlrr
6 月 3 日
deepseekv4pro
正在用,感觉还是不错的

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1217141

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX