• 请不要在回答技术问题时复制粘贴 AI 生成的内容
jxl594
V2EX  ›  程序员

最新的 deepseek-v4-flash 正式版真的有这么强吗?

  •  
  •   jxl594 · Jul 31 · 11014 views

    deepseek-v4-flash 正式版卡在 7 月最后一天发布,看评测数据很强,受不了智谱这种涨价方式,梁圣才是中国 AI 真正的希望

    94 replies    2026-08-01 18:29:45 +08:00
    xqk111
        1
    xqk111  
       Jul 31
    看跑分,超过了 grok4.5 ,感觉很强啊
    xqk111
        2
    xqk111  
       Jul 31
    也超过了 glm5.2 ,有点牛
    seakingii
        3
    seakingii  
       Jul 31
    希望是真的.DS FLASH 才是真的用的起的模型
    xiaomushen
        4
    xiaomushen  
       Jul 31   ❤️ 22
    是很强,但是 V 站上大部分,不都是非 Fable5 或 5.6Sol 不用的高级用户么?
    DS V4 Flash 强不强,和他们似乎关系不大吧
    ghostman
        5
    ghostman  
       Jul 31
    刚试用了下非常快
    jxl594
        6
    jxl594  
    OP
       Jul 31
    关键是,v4-flash 版本如果能达到 GLM5.2 的水平,那真是太便宜了,GLM5.2 和 KIMI3 可以暂时拜拜了
    jokcylou
        7
    jokcylou  
       Jul 31 via Android
    glm 股价 200 可期
    TomatoCLI
        8
    TomatoCLI  
       Jul 31
    @jxl594 不仅便宜,而且还快
    jxl594
        9
    jxl594  
    OP
       Jul 31
    @TomatoCLI 对的,不过便宜比快更重要,后面看看小米 MIMO 能不能追上来。
    真是又期待,又害怕。能力强又便宜,那就能用得起了,但是,另一方面,程序员的含金量 K 线,感觉还在下降通道中。
    soulflysimple123
        10
    soulflysimple123  
       Jul 31
    deepseek v4 pro 如果有 gpt 5.5 的水平,友商就难了
    yiranw09
        11
    yiranw09  
       Jul 31
    刚才试了一下,感觉超过了之前的 dsv4pro ,关键似乎还降级了
    xiaomushen
        12
    xiaomushen  
       Jul 31
    503 了,
    vitozyl
        13
    vitozyl  
       Jul 31
    能用+够用才是正途. 智谱被称为中国的 Anthropic, 但也不能照搬全学呀
    Faintlike
        14
    Faintlike  
       Jul 31   ❤️ 1
    280b 秒了 740b ,肥鲸,现在的你,强的可怕...
    penll
        15
    penll  
       Jul 31
    非常牛逼,超过 GLM5.2
    cjhyy
        16
    cjhyy  
       Jul 31
    虽然 cc 和 codex 拉满了 但是自己总要搞点活啊 目前的感觉来看。模型的快速跃升期要到瓶颈了 60 分与 80 的差别可能不会那么大了 速度和成本应该下一个方向。之前自己充了 300 块 deepseek 用 pro 太慢了。flash 反而用的还顺手一点 做一些简单的活又便宜又快
    NealLason
        17
    NealLason  
       Jul 31
    体验下来很超预期
    jxl594
        18
    jxl594  
    OP
       Jul 31
    @cjhyy 确实,真正使用的时候,速度很重要,Qwen3.8-Max-Preview 运行一半就卡死在那里,GLM5.2 之前也慢的要死,正常工作几乎不可用。
    niceshell
        19
    niceshell  
       Jul 31
    @xiaomushen 不是这么说 真的用起来的时候 选最好的能节省时间
    jxl594
        20
    jxl594  
    OP
       Jul 31   ❤️ 1
    要是梁圣再开源一个好用的 harness 项目,那真是功德圆满了
    hanbaoji
        21
    hanbaoji  
       Jul 31
    真的假的?价格有变化吗?
    StudyFung
        22
    StudyFung  
       Jul 31
    试试就知道了
    FredWang
        23
    FredWang  
       Jul 31
    @jxl594 不是说即将发布么? deepseek harness
    utodea
        24
    utodea  
       Jul 31
    体验下来增强了不少,https://github.com/usewhale/whale
    xiaomushen
        25
    xiaomushen  
       Jul 31
    @niceshell 程序员的时间值钱么?
    menfrexu
        26
    menfrexu  
       Jul 31
    已经将 flash 作为主力模型了。牛逼 https://github.com/Menfre01/waveloom
    Dream4U
        27
    Dream4U  
       Jul 31   ❤️ 1
    @xiaomushen #4 主要是 20X Codex 用不完,天天重置,三个人分摊,一个人两三百,真是最便宜的套餐了。
    DS 看 API 价格是便宜,但如果用 Pro ,一天几十上百很正常。
    WashFreshFresh
        28
    WashFreshFresh  
       Jul 31
    不知道公司买的聚合服务什么时候更新
    jxl594
        29
    jxl594  
    OP
       Jul 31
    @WashFreshFresh 不知道 opencode go 上的 v4-flash 是不是官网直连的,那就更划算了
    stdout
        30
    stdout  
       Jul 31
    1kw token 不到 5 毛,用的越久 cache 命中越高,跟不要钱似的。
    jxl594
        31
    jxl594  
    OP
       Jul 31
    @stdout 目前跑了 3.4kw token ,价格 1.5 ¥,去 TM 的 coding planning ,用多少花多少才是真香
    yiranw09
        32
    yiranw09  
       Jul 31
    opencode go 可以用正式版本了
    但是需要在后台开启“启用部署在中国的模型”
    stdout
        33
    stdout  
       Jul 31
    @jxl594 国内唯一个能用的很爽的,能和 grok4.5 流畅,解决大部分问题不用反复问,我就非常满足了。deepseek falsh 已经满足我的需求了。我下个月把 grok 切换过来。
    xiaomushen
        34
    xiaomushen  
       Jul 31
    @Dream4U 这倒是..个人订阅根本用不完,奥圣动不动就重置。。
    listen2wind
        35
    listen2wind  
       Jul 31
    昨天站里还是梁÷,今天就成梁圣了
    stdout
        36
    stdout  
       Jul 31   ❤️ 7
    我做空了 minimax 和智谱,赚多少就充多少给 deepseek
    526457385
        37
    526457385  
       Jul 31
    我问一下各位啊,哪个模型出来跑分不是吊打其他所有模型,你们看看你们现在正在用的什么模型
    snowman231
        38
    snowman231  
       Jul 31
    特别,特别,特别的快。写起代码来很舒服。
    Aaron0705
        39
    Aaron0705  
       Jul 31
    试过了,很强,长任务方面比之前强了很多
    damila
        40
    damila  
       Jul 31
    我基本不看跑分,但是刚才体验了一下,效果远超个人预期,而且很快,这波是梁圣
    EngelEyes
        41
    EngelEyes  
       Jul 31
    反正比隔壁"性价比首选""对标美系旗舰"强。
    congminhcap246
        42
    congminhcap246  
       Jul 31   ❤️ 11
    刚好 deepseek 更新了,对比下同个 prompt 各个模型生成的效果。

    你是一个精通计算机图形学和前端性能优化的专家。请编写一个单文件( HTML + CSS + JavaScript ),实现一个惊艳的“3D 粒子动态涡流( Vortex )”视觉特效,支持移动端,支持动画暂停和重置另外带上我的署名。

    严格限制条件:
    1. 不允许使用任何第三方库(如 Three.js, Pixi.js, Canvas-nest 等),只能使用原生 HTML5 Canvas 2D Context 。
    2. 粒子必须在真正的 3D 空间内运动(拥有 X, Y, Z 坐标),并通过数学公式(透视投影 Perspective Projection )实时计算并映射到 2D 屏幕上,表现出近大远小的透视效果。
    3. 必须实现 3D 旋转矩阵,让粒子流能够随着鼠标的移动,围绕 X 轴和 Y 轴进行平滑的 3D 视角旋转。
    4. 必须处理深度排序( Depth Sorting/Z-indexing ):计算粒子的 Z 轴距离,远处的粒子先绘制,近处的粒子后绘制,并配合不同的透明度和模糊度,制造真实的纵深感。
    5. 包含色彩渐变或极光效果,粒子数量不低于 2000 个,必须使用 requestAnimationFrame 保证 60fps 的流畅度,代码要优雅、模块化,并写清核心数学公式的注释。

    https://llm.sweetui.com/opus5.html
    https://llm.sweetui.com/kimi3.html
    https://llm.sweetui.com/gpt5.6.html
    https://llm.sweetui.com/grok4.5.html
    https://llm.sweetui.com/deepseek.html
    maoqiucute
        43
    maoqiucute  
       Jul 31
    试了一下 确实又快又强
    jko123
        44
    jko123  
       Jul 31
    不知道 DeepSeek v4 pro 正式版能不能达到 GPT5.6 SOL 水平,能达到那就棒了
    albin504
        45
    albin504  
       Jul 31
    @congminhcap246 不懂题目是啥意思。但是看效果,deepseek 生成的更科幻、也更美观。
    gpt 和 kimi 生成的是啥玩意儿,至少有点糊
    albin504
        46
    albin504  
       Jul 31
    利好腾讯啊。 腾讯的 AI 产品能用好低价、开源的模型,真是福音
    jxl594
        47
    jxl594  
    OP
       Jul 31
    @congminhcap246 相对而言,还是 deepseek 效果差一点,不过总体要求基本都达到了吧
    BuffDog
        48
    BuffDog  
       Jul 31
    我试了下相当不错,比 v4 pro 预览版强不少
    kera0a
        49
    kera0a  
       Jul 31 via iPhone
    flash 都这忘了,pro 不得起飞咯
    mgcnrx11
        50
    mgcnrx11  
       Jul 31
    它自己公布的跑分下,有行小字:对于公开基准测试集中的 Code Agent 任务,正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness (即将发布)的极简模式作为框架进行测试,并使用 max 档位,topp=0.95 ,temperature=1.0;

    不能看跑分就认为是模型进步了的,harness 对跑分的影响也非常大的
    min
        51
    min  
       Jul 31
    那 pro 出来了的话还得了?
    catazshadow
        52
    catazshadow  
       Jul 31
    @albin504 deepseek 连右上角的 fps 都是瞎写的
    pinylin
        53
    pinylin  
       23h 5m ago   ❤️ 3
    我觉得智商不行, 非常简单的任务都错了。5.6 Luna-max 和 qwen3.7-max 都正常
    lovecodey
        54
    lovecodey  
       22h 39m ago
    @congminhcap246 k3 不应该是这个实力,我用第三方部署试的
    https://cuddly-chocolate-0yslyari.edgeone.dev/
    ZeroDu
        55
    ZeroDu  
       22h 17m ago
    deepseek ,glm 现在就差多模态。glm 这一涨价都赶上 gpt 了
    raphx
        56
    raphx  
       21h 58m ago
    不支持多模态......
    ota
        57
    ota  
       21h 52m ago
    @xiaomushen 可以作为 subagent 啊。和非富即贵的大模型不冲突。
    xiaomushen
        58
    xiaomushen  
       21h 30m ago
    @ota 苹果用户的高贵怎么可以被国产安卓模型玷污?( CodeX 用户只能算是半苹果半安卓)
    xiaomushen
        59
    xiaomushen  
       20h 51m ago
    苹果用户只用苹果模型( Fable5 ),绝对不会碰安卓模型。当然,苹果用户也许失业后送外卖,但部妨碍他们的高贵
    NNNNzs
        60
    NNNNzs  
       20h 46m ago
    @vitozyl #13 a 畜 z 畜 首尾呼应
    oIIo
        61
    oIIo  
       19h 53m ago
    在 Codex 里高强度用了 4 个小时,审核 3d 即时战略游戏战斗模块/寻路模块代码(找 bug 、优化项)以及某功能模块实现,更复杂的问题还没试过。感觉 gpt-5.6 terra 没多大区别,关键是干完这些才花了不到 4 块钱....
    DinnyXu
        62
    DinnyXu  
       18h 47m ago
    @congminhcap246 我看了一圈觉得 opus5 很好看,是一个旋风一样,gpt5.6 是不是没用对啊,也太撇了吧,我可是刚买的 plus 啊,这效果不应该啊,另外 ds 的很好看,想宇宙一样
    cue
        63
    cue  
       16h 11m ago via iPhone
    重仓算力和光通信的同学又有福了,好日子还在后面呢🫠🫠
    dododook
        64
    dododook  
       16h 1m ago via iPhone
    @listen2wind #35 第一次听呢,梁目前口碑还行的吧
    gdw1986
        65
    gdw1986  
       14h 12m ago via Android
    让你们说得热血沸腾的,在考虑要不要直接换 DeepSeek 了,也不用折腾 codex 了
    kuaner
        66
    kuaner  
       13h 46m ago   ❤️ 1
    精准狙击 GLM 涨价,显得无比滑稽
    lzylzylzy130
        67
    lzylzylzy130  
       11h 9m ago
    给后面的 pro 做铺垫来的吧
    kirbyzhu
        68
    kirbyzhu  
       11h 8m ago via iPhone
    @congminhcap246 如果 ds 编程能力能达到 opus4.8 的水平 那就无敌了
    germain
        69
    germain  
       10h 36m ago   ❤️ 1
    我做了一个实操的 code review 和纠错实验,我让 Deepseek v4 flash (OpenCode)去 review 我一个在 GPT 5.6 Sol Ultra 做的项目,Deepseek v4 flash 找出了 41 个问题并实施了修改。

    然后我再用 GPT 5.6 Sol Ultra 去 review ds v4 flash 做的修改,sol 最终报 ds 准确找出了 38 个问题,3 个问题 sol 认为它自己写的没错并 revert 了 ds 的修改。在 38 个问题里,ds 正确修复了 26 个,其余 12 个修复不完整或不安全,随后 sol 完成了 12 个剩余问题的修复。

    这个能力已经远远超出了我对 ds v4 flash 的能力的心理预期,再加上土一样的价格。。。
    HinamiAoi
        70
    HinamiAoi  
       10h 6m ago
    试了下不错,主要快。
    拿 AI 干活的就知道速度其实蛮重要的。
    做的某个功能 ios 代码 -> 安卓代码迁移,大概 2000 行代码,5 个模块,基本符合预期吧
    mingtdlb
        71
    mingtdlb  
       9h 41m ago
    @jxl594 #18 Qwen3.8-Max-Preview 慢的不行。。

    @congminhcap246 #42 ds 跑题了吗? k3 什么垃圾,opus5 可以
    MacsedProtoss
        72
    MacsedProtoss  
       9h 37m ago via iPhone
    @stdout 我看我一个月 gpt 40B 也就是说用 v4 flash 也要 2000 还是 codex 大善人啊
    Xi
        73
    Xi  
       9h 25m ago
    智谱抢不到、kimi 套餐涨价,一个个耍猴,还得是看梁圣,不知道 deepseek v4 pro 还能提升多少。
    icanfork
        74
    icanfork  
       9h 19m ago via iPhone
    利好程序员,其他家也会降价的
    seven777
        75
    seven777  
       9h 15m ago
    腾讯家的 buddy 里的 DeepSeek-v4-flash 早就有了啊,是同一个玩意儿吗? buddy 里的也随着转"正式版"了?
    Busy
        76
    Busy  
       9h 0m ago
    还行,日常使用看什么任务
    Timzzzzz
        77
    Timzzzzz  
       8h 41m ago
    @seven777
    那个是 4 月的,731 是后训练完刚发布的
    bigl9999
        78
    bigl9999  
       8h 32m ago via iPhone
    下周 ai 应用又要走一波吗
    cskeleton
        79
    cskeleton  
       8h 26m ago
    @Xi #73 反了吧,现在是 zai 涨价,kimi 买不到
    jackerbauer
        80
    jackerbauer  
       6h 59m ago
    相当的不错啊,基本指哪打哪,一次性通过
    Binwalker
        81
    Binwalker  
       6h 47m ago
    什么时候原生支持多模态就好了
    wzw
        82
    wzw  
       6h 39m ago
    @Dream4U 用 sub2api 共享, 然后用到 codex/cursor 等?
    Dream4U
        83
    Dream4U  
       6h 24m ago
    @wzw #75 是的
    wzw
        84
    wzw  
       6h 9m ago
    @Dream4U #83 cursor 你用吗? 套进去用, 效果如何
    yuhuij
        85
    yuhuij  
       6h 6m ago
    @congminhcap246 opus5 和 DeepSeek 的不错
    Dream4U
        86
    Dream4U  
       5h 56m ago
    @wzw #77 没用,几乎只用 Codex
    paranoiagu
        87
    paranoiagu  
       5h 11m ago
    试了一下,真的可以。。绝对可以当主力模型用。
    seven777
        88
    seven777  
       5h 2m ago
    @Timzzzzz #77 版本号都没改,用户应该认为"是一致的"吧?
    plmsuper8
        89
    plmsuper8  
       4h 13m ago
    @MacsedProtoss 但是缓存命中只收 1/50 ,这样算命中率高那就是 6 美元了。而且 deepseek 的缓存机制也比较优秀。
    Rorysky
        90
    Rorysky  
       2h 1m ago
    @congminhcap246 其实这种 角色式的 prompt 已经过时了
    Nasdaq
        91
    Nasdaq  
    PRO
       1h 57m ago
    快的起飞(搭配 pi ),但是受限于上下文长度,还是不如 fable5 (是不是要求太高了),哈哈哈。
    vicazuruhu97
        92
    vicazuruhu97  
       1h 52m ago
    试了一下,狗掉不是,和原来差不多,一度以为我用到了旧的,但是我买的是官方的,里面也就两模型,也不知道咋才能用上正品,改代码会错,说话也没啥逻辑,审核也不行。
    across
        93
    across  
       1h 30m ago
    发现支持 codex ,换 codex + v4 flash 试了下。
    刚好需要做两个知识星球群组帖子拉取到本地做 obisidan 知识库的,让 v4 flash 做方案+执行,全程 3 块···· 可以了,我没意见,以后估计我是 codex + qoder 的组合了。
    wangxiaoer
        94
    wangxiaoer  
       1h 27m ago
    不是很理解,这种大模型的评分,差那么一分两分有区别吗?
    About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2668 Online   Highest 6679   ·     Select Language
    创意工作者们的社区
    World is powered by solitude
    VERSION: 3.9.8.5 · 131ms · UTC 11:57 · PVG 19:57 · LAX 04:57 · JFK 07:57
    ♥ Do have faith in what you're doing.