为什么 deepseek flash 正式版的思考时间比原来长了很多很多,有的时候一个简单的任务能思考 2d 分钟,是我个人的问题吗,虽然 agent 能力的确 d 提升了 o 很多,但是这个过度思考有点烦
为什么 deepseek flash 正式版的思考时间比原来长了很多很多,有的时候一个简单的任务能思考 2d 分钟,是我个人的问题吗,虽然 agent 能力的确 d 提升了 o 很多,但是这个过度思考有点烦
1
zzutmebwd 1 day ago
deepseek flash 的官方 api 输出速度大概是多少?
|
2
jko123 1 day ago
我觉得面对复杂任务思考的还不够,所以只能执行
|
3
Younikes OP @jko123 我在我开发的一个 excel ai 侧边栏里面测试,以前让它美化下表格,速度很快,效果也不错,现在先思考很久我看了下思考内容,一堆 wait ,服了
|
5
exmario 1 day ago
昨天和今天都遇到 503 ,体验真的差
|
6
Wenlon 1 day ago flash 毕竟只是个 300B 不到的模型,moe 激活的只有 13B ,它必须依赖高强度思考才能制造局部稠密,从而实现超越参数规模的编码能力。目前看来参数规模、速度还有能力是个不可能三角
|
7
AlohaV2 1 day ago
是这样的。跟真人类似,如果不是特聪明的话要多思考几下。但如果最终能对也无妨,多花的时间可以用并发解决(约等于企业多招人)。毕竟参数量在这里。
所以还是期待 pro 能给到啥。 |
8
bbsingao 1 day ago
这主要看你的 harness 是什么东西, codex 好些, cc 就更久
|
9
XuDongJianSama 1 day ago
deeps 在 cc 会过度思考
|
11
JackCh3ng 1 day ago
我有一个每天定时的任务,自从更新之后,任务没完全执行成功过,两次都是有部分任务执行失败,而且 token 花费 x4 了,今天准备把任务关了。
|
12
limon 1 day ago
和 agent 有关,我用 grok 感觉明显快
|
13
maemolee 1 day ago 我在 WorkBuddy 里接了最新的 dsv4f ,发一个“你好”,打断,再点一下重试,他能思考上千字……
|
14
codehz 1 day ago
推理努力设置成 low ,然后自己编写需要推理的强度,,因为 high 和 max 就是提示词的差异,low 就是不给额外提示词,但允许推理的模式
|
17
Bssn 1 day ago
在 zcode 里挺好用的,推荐尝试
|
18
zhonghao01 1 day ago
感觉 GLM 才是过度思考,每次思考好长好长。
|
19
HotieCutie 1 day ago
快和质量二者不可兼得,gpt 就是出奇的慢,但是质量确实不错
|
20
maolon 1 day ago
因为模型小就只能靠思维链来提升性能,对于小模型来说这种不叫“过度思考”,5.6 sol 的 max 那种才叫过度思考
|
21
glaucus 1 day ago
我一直 503 ,我还以为 opencode 的问题
|
22
as9567585 22h 35m ago 很可能是 harness 内部的过度提示词的问题,我从 cc 切换到 pi ,体验好很多。cc 的作者也表示,最近的版本删除 80%的提示词。现在模型的智商确实提高了
|
27
brsyrockss 21h 27m ago 你教小孩子做数学题,做的快了错的多,你给一巴掌,说为啥不检查,现在做的慢了,每个题都要检查一遍,正确率高了,你又给一巴掌,问:为啥要检查?
你咋这么难伺候 |
28
defaw 10h 42m ago
用 pi 吧,我的 ds v4 flash 在 pi 里表现不错。
|