deepseek-v4-flash 正式版卡在 7 月最后一天发布,看评测数据很强,受不了智谱这种涨价方式,梁圣才是中国 AI 真正的希望
deepseek-v4-flash 正式版卡在 7 月最后一天发布,看评测数据很强,受不了智谱这种涨价方式,梁圣才是中国 AI 真正的希望
1
xqk111 Jul 31
看跑分,超过了 grok4.5 ,感觉很强啊
|
2
xqk111 Jul 31
也超过了 glm5.2 ,有点牛
|
3
seakingii Jul 31
希望是真的.DS FLASH 才是真的用的起的模型
|
4
xiaomushen Jul 31 是很强,但是 V 站上大部分,不都是非 Fable5 或 5.6Sol 不用的高级用户么?
DS V4 Flash 强不强,和他们似乎关系不大吧 |
5
ghostman Jul 31
刚试用了下非常快
|
6
jxl594 OP 关键是,v4-flash 版本如果能达到 GLM5.2 的水平,那真是太便宜了,GLM5.2 和 KIMI3 可以暂时拜拜了
|
7
jokcylou Jul 31 via Android
glm 股价 200 可期
|
9
jxl594 OP @TomatoCLI 对的,不过便宜比快更重要,后面看看小米 MIMO 能不能追上来。
真是又期待,又害怕。能力强又便宜,那就能用得起了,但是,另一方面,程序员的含金量 K 线,感觉还在下降通道中。 |
10
soulflysimple123 Jul 31
deepseek v4 pro 如果有 gpt 5.5 的水平,友商就难了
|
11
yiranw09 Jul 31
刚才试了一下,感觉超过了之前的 dsv4pro ,关键似乎还降级了
|
12
xiaomushen Jul 31
503 了,
|
13
vitozyl Jul 31
能用+够用才是正途. 智谱被称为中国的 Anthropic, 但也不能照搬全学呀
|
14
Faintlike Jul 31 280b 秒了 740b ,肥鲸,现在的你,强的可怕...
|
15
penll Jul 31
非常牛逼,超过 GLM5.2
|
16
cjhyy Jul 31
虽然 cc 和 codex 拉满了 但是自己总要搞点活啊 目前的感觉来看。模型的快速跃升期要到瓶颈了 60 分与 80 的差别可能不会那么大了 速度和成本应该下一个方向。之前自己充了 300 块 deepseek 用 pro 太慢了。flash 反而用的还顺手一点 做一些简单的活又便宜又快
|
17
NealLason Jul 31
体验下来很超预期
|
18
jxl594 OP @cjhyy 确实,真正使用的时候,速度很重要,Qwen3.8-Max-Preview 运行一半就卡死在那里,GLM5.2 之前也慢的要死,正常工作几乎不可用。
|
19
niceshell Jul 31
@xiaomushen 不是这么说 真的用起来的时候 选最好的能节省时间
|
20
jxl594 OP 要是梁圣再开源一个好用的 harness 项目,那真是功德圆满了
|
21
hanbaoji Jul 31
真的假的?价格有变化吗?
|
22
StudyFung Jul 31
试试就知道了
|
24
utodea Jul 31
体验下来增强了不少,https://github.com/usewhale/whale
|
25
xiaomushen Jul 31
@niceshell 程序员的时间值钱么?
|
26
menfrexu Jul 31
已经将 flash 作为主力模型了。牛逼 https://github.com/Menfre01/waveloom
|
27
Dream4U Jul 31 @xiaomushen #4 主要是 20X Codex 用不完,天天重置,三个人分摊,一个人两三百,真是最便宜的套餐了。
DS 看 API 价格是便宜,但如果用 Pro ,一天几十上百很正常。 |
28
WashFreshFresh Jul 31
不知道公司买的聚合服务什么时候更新
|
29
jxl594 OP @WashFreshFresh 不知道 opencode go 上的 v4-flash 是不是官网直连的,那就更划算了
|
30
stdout Jul 31
1kw token 不到 5 毛,用的越久 cache 命中越高,跟不要钱似的。
|
32
yiranw09 Jul 31
opencode go 可以用正式版本了
但是需要在后台开启“启用部署在中国的模型” |
33
stdout Jul 31
@jxl594 国内唯一个能用的很爽的,能和 grok4.5 流畅,解决大部分问题不用反复问,我就非常满足了。deepseek falsh 已经满足我的需求了。我下个月把 grok 切换过来。
|
34
xiaomushen Jul 31
@Dream4U 这倒是..个人订阅根本用不完,奥圣动不动就重置。。
|
35
listen2wind Jul 31
|
36
stdout Jul 31 我做空了 minimax 和智谱,赚多少就充多少给 deepseek
|
37
526457385 Jul 31
|
38
snowman231 Jul 31
特别,特别,特别的快。写起代码来很舒服。
|
39
Aaron0705 Jul 31
试过了,很强,长任务方面比之前强了很多
|
40
damila Jul 31
我基本不看跑分,但是刚才体验了一下,效果远超个人预期,而且很快,这波是梁圣
|
41
EngelEyes Jul 31
反正比隔壁"性价比首选""对标美系旗舰"强。
|
42
congminhcap246 Jul 31 刚好 deepseek 更新了,对比下同个 prompt 各个模型生成的效果。
你是一个精通计算机图形学和前端性能优化的专家。请编写一个单文件( HTML + CSS + JavaScript ),实现一个惊艳的“3D 粒子动态涡流( Vortex )”视觉特效,支持移动端,支持动画暂停和重置另外带上我的署名。 严格限制条件: 1. 不允许使用任何第三方库(如 Three.js, Pixi.js, Canvas-nest 等),只能使用原生 HTML5 Canvas 2D Context 。 2. 粒子必须在真正的 3D 空间内运动(拥有 X, Y, Z 坐标),并通过数学公式(透视投影 Perspective Projection )实时计算并映射到 2D 屏幕上,表现出近大远小的透视效果。 3. 必须实现 3D 旋转矩阵,让粒子流能够随着鼠标的移动,围绕 X 轴和 Y 轴进行平滑的 3D 视角旋转。 4. 必须处理深度排序( Depth Sorting/Z-indexing ):计算粒子的 Z 轴距离,远处的粒子先绘制,近处的粒子后绘制,并配合不同的透明度和模糊度,制造真实的纵深感。 5. 包含色彩渐变或极光效果,粒子数量不低于 2000 个,必须使用 requestAnimationFrame 保证 60fps 的流畅度,代码要优雅、模块化,并写清核心数学公式的注释。 https://llm.sweetui.com/opus5.html https://llm.sweetui.com/kimi3.html https://llm.sweetui.com/gpt5.6.html https://llm.sweetui.com/grok4.5.html https://llm.sweetui.com/deepseek.html |
43
maoqiucute Jul 31
试了一下 确实又快又强
|
44
jko123 Jul 31
不知道 DeepSeek v4 pro 正式版能不能达到 GPT5.6 SOL 水平,能达到那就棒了
|
45
albin504 Jul 31
@congminhcap246 不懂题目是啥意思。但是看效果,deepseek 生成的更科幻、也更美观。
gpt 和 kimi 生成的是啥玩意儿,至少有点糊 |
46
albin504 Jul 31
利好腾讯啊。 腾讯的 AI 产品能用好低价、开源的模型,真是福音
|
47
jxl594 OP @congminhcap246 相对而言,还是 deepseek 效果差一点,不过总体要求基本都达到了吧
|
48
BuffDog Jul 31
我试了下相当不错,比 v4 pro 预览版强不少
|
49
kera0a Jul 31 via iPhone
flash 都这忘了,pro 不得起飞咯
|
50
mgcnrx11 Jul 31
它自己公布的跑分下,有行小字:对于公开基准测试集中的 Code Agent 任务,正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness (即将发布)的极简模式作为框架进行测试,并使用 max 档位,topp=0.95 ,temperature=1.0;
不能看跑分就认为是模型进步了的,harness 对跑分的影响也非常大的 |
51
min Jul 31
那 pro 出来了的话还得了?
|
52
catazshadow Jul 31
@albin504 deepseek 连右上角的 fps 都是瞎写的
|
53
pinylin 23h 5m ago 我觉得智商不行, 非常简单的任务都错了。5.6 Luna-max 和 qwen3.7-max 都正常
|
54
lovecodey 22h 39m ago
|
55
ZeroDu 22h 17m ago
deepseek ,glm 现在就差多模态。glm 这一涨价都赶上 gpt 了
|
56
raphx 21h 58m ago
不支持多模态......
|
57
ota 21h 52m ago
@xiaomushen 可以作为 subagent 啊。和非富即贵的大模型不冲突。
|
58
xiaomushen 21h 30m ago
@ota 苹果用户的高贵怎么可以被国产安卓模型玷污?( CodeX 用户只能算是半苹果半安卓)
|
59
xiaomushen 20h 51m ago
苹果用户只用苹果模型( Fable5 ),绝对不会碰安卓模型。当然,苹果用户也许失业后送外卖,但部妨碍他们的高贵
|
61
oIIo 19h 53m ago
在 Codex 里高强度用了 4 个小时,审核 3d 即时战略游戏战斗模块/寻路模块代码(找 bug 、优化项)以及某功能模块实现,更复杂的问题还没试过。感觉 gpt-5.6 terra 没多大区别,关键是干完这些才花了不到 4 块钱....
|
62
DinnyXu 18h 47m ago
@congminhcap246 我看了一圈觉得 opus5 很好看,是一个旋风一样,gpt5.6 是不是没用对啊,也太撇了吧,我可是刚买的 plus 啊,这效果不应该啊,另外 ds 的很好看,想宇宙一样
|
63
cue 16h 11m ago via iPhone
重仓算力和光通信的同学又有福了,好日子还在后面呢🫠🫠
|
64
dododook 16h 1m ago via iPhone
@listen2wind #35 第一次听呢,梁目前口碑还行的吧
|
65
gdw1986 14h 12m ago via Android
让你们说得热血沸腾的,在考虑要不要直接换 DeepSeek 了,也不用折腾 codex 了
|
66
kuaner 13h 46m ago 精准狙击 GLM 涨价,显得无比滑稽
|
67
lzylzylzy130 11h 9m ago
给后面的 pro 做铺垫来的吧
|
68
kirbyzhu 11h 8m ago via iPhone
@congminhcap246 如果 ds 编程能力能达到 opus4.8 的水平 那就无敌了
|
69
germain 10h 36m ago 我做了一个实操的 code review 和纠错实验,我让 Deepseek v4 flash (OpenCode)去 review 我一个在 GPT 5.6 Sol Ultra 做的项目,Deepseek v4 flash 找出了 41 个问题并实施了修改。
然后我再用 GPT 5.6 Sol Ultra 去 review ds v4 flash 做的修改,sol 最终报 ds 准确找出了 38 个问题,3 个问题 sol 认为它自己写的没错并 revert 了 ds 的修改。在 38 个问题里,ds 正确修复了 26 个,其余 12 个修复不完整或不安全,随后 sol 完成了 12 个剩余问题的修复。 这个能力已经远远超出了我对 ds v4 flash 的能力的心理预期,再加上土一样的价格。。。 |
70
HinamiAoi 10h 6m ago
试了下不错,主要快。
拿 AI 干活的就知道速度其实蛮重要的。 做的某个功能 ios 代码 -> 安卓代码迁移,大概 2000 行代码,5 个模块,基本符合预期吧 |
71
mingtdlb 9h 41m ago
|
72
MacsedProtoss 9h 37m ago via iPhone
@stdout 我看我一个月 gpt 40B 也就是说用 v4 flash 也要 2000 还是 codex 大善人啊
|
73
Xi 9h 25m ago
智谱抢不到、kimi 套餐涨价,一个个耍猴,还得是看梁圣,不知道 deepseek v4 pro 还能提升多少。
|
74
icanfork 9h 19m ago via iPhone
利好程序员,其他家也会降价的
|
75
seven777 9h 15m ago
腾讯家的 buddy 里的 DeepSeek-v4-flash 早就有了啊,是同一个玩意儿吗? buddy 里的也随着转"正式版"了?
|
76
Busy 9h 0m ago
还行,日常使用看什么任务
|
78
bigl9999 8h 32m ago via iPhone
下周 ai 应用又要走一波吗
|
80
jackerbauer 6h 59m ago
相当的不错啊,基本指哪打哪,一次性通过
|
81
Binwalker 6h 47m ago
什么时候原生支持多模态就好了
|
85
yuhuij 6h 6m ago
@congminhcap246 opus5 和 DeepSeek 的不错
|
87
paranoiagu 5h 11m ago
试了一下,真的可以。。绝对可以当主力模型用。
|
89
plmsuper8 4h 13m ago
@MacsedProtoss 但是缓存命中只收 1/50 ,这样算命中率高那就是 6 美元了。而且 deepseek 的缓存机制也比较优秀。
|
90
Rorysky 2h 1m ago
@congminhcap246 其实这种 角色式的 prompt 已经过时了
|
91
Nasdaq PRO 快的起飞(搭配 pi ),但是受限于上下文长度,还是不如 fable5 (是不是要求太高了),哈哈哈。
|
92
vicazuruhu97 1h 52m ago
试了一下,狗掉不是,和原来差不多,一度以为我用到了旧的,但是我买的是官方的,里面也就两模型,也不知道咋才能用上正品,改代码会错,说话也没啥逻辑,审核也不行。
|
93
across 1h 30m ago
发现支持 codex ,换 codex + v4 flash 试了下。
刚好需要做两个知识星球群组帖子拉取到本地做 obisidan 知识库的,让 v4 flash 做方案+执行,全程 3 块···· 可以了,我没意见,以后估计我是 codex + qoder 的组合了。 |
94
wangxiaoer 1h 27m ago
不是很理解,这种大模型的评分,差那么一分两分有区别吗?
|