deepseek-v4-flash 大家有感觉出问题吗?

9 月 5 日
 chongzi

我线上产品调的是 deepseek ,平时做开发用 codex ,gpt 额度用完后会拿 deepseek 来顶

所以体感比较明显,大概是从昨天开始,线上突然开始出低级问题,开发用 codex 也是如此甚至一度达到不可用的程度

5166 次点击
所在节点    程序员
24 条回复
greatghoul
9 月 5 日
我用 OpenCode 接入了 DeepSeek, 目前没感觉到什么问题。
jinsongzhaocn
9 月 5 日
长上下文堆积,涉及的问题越来越复杂吧,需要靠压缩和记忆体优化。flash 版本通常是缩小知识量的版本,所以解决有确定方案的问题,日常编码可以;但是探讨方案,解决未知问题,理解复杂逻辑,需要切换到 pro 版本,用更多的知识量更好。codex 至少 5T 的参数,dsv4flahs 不到 1T,知识量就差了一大截。
yeatmeret
9 月 5 日
我使用 cc-switch 上面接入官方的 dsv4flash ,感觉价格不便宜干活儿没那么好,我 ds 的话之前用 pro 多一点,ds 涨价感觉他就没什么竞争力了
airqj
9 月 5 日
现在花百来块钱买个 glm 丐版 code plan,glm 5.3 flash 免费蹬
白天安排好工作让 zcode 晚上再跑。
说实话这阵子找不到用 deepseek v4 flash 理由
airqj
9 月 5 日
@airqj 晚上十一点到次日九点免费蹬
yidinghe
9 月 5 日
大模型出问题都是概率性的,不出问题不表示没有降智,出问题不表示一定降智。
chongzi
9 月 5 日
@greatghoul 也是用的 v4-flash 吗?
chongzi
9 月 5 日
@jinsongzhaocn 我用的 skill 和文档较多,确实上下文会长,但是之前一直都顺利,就是从前天开始的,体感很明显
chongzi
9 月 5 日
@yeatmeret 太高贵了,pro 不敢用
chongzi
9 月 5 日
@airqj glm 丐版 code plan 大概有都少 token
chongzi
9 月 5 日
@yidinghe 难道大模型也得考虑高可用?一旦发现模型出问题,马上切换到别的模型
airqj
9 月 5 日
@chongzi #10 不是很多,但重点是 glm 5.3 flash 夜间免费蹬
所以白天审核 + 制定任务计划 + 验证,然后晚上再跑就很爽了
greatghoul
9 月 5 日
@chongzi 嗯,是的,v4 flash. api 总结文章和 coding 都用的这个。
chemzqm
9 月 5 日
> 用的 skill 和文档较多
大概率导致模型降智
everyx
9 月 5 日
同一会话,混用不同模型也会有问题
tuduweb
9 月 5 日
@airqj 晚上的运行速度咋样…之前送 3 亿 token 的时候,感觉跑的有点慢…
yidinghe
9 月 5 日
@chongzi 高可用不是你这么理解的,前几天一堆的大模型出故障,这个就是高可用的问题。我的意思是,不管什么大模型,都会有一些特定的场景,触发它的表现得降智的行为,这并不是模型本身被换了。
airqj
9 月 5 日
@tuduweb 不知道 反正一个大任务一觉起来差不多跑完了
jinsongzhaocn
9 月 5 日
DeepSWE v1.1 智能编程/软件工程智能体基准
Kimi K3:67.5%
GLM-5.3-Flash:63.4%
Qwen3.8-Flash-Next:58.7%
DeepSeek-V4-Flash-0731:54.4% (分数基本等于本地部署 Qwen3.8-Flash-Next Q4 量化版本)
ajaxfunction
9 月 5 日
光说前端代码,glm 明显强于 dp v4 flash 和 pro 。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1239608

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX