续 claude 降智严重后, codex 也在步其后尘

5 月 19 日
 lurenjiauser

你说这是为什么呀为呀么为什么?

6193 次点击
所在节点    OpenAI
39 条回复
NerbraskaGuy
5 月 19 日
感觉都在试探用户底线,测试降智到哪种程度会导致用户流失太多,用来制定成本。
x86
5 月 19 日
故意开白嫖的口子呗,这个月到期不续费,不如白嫖
iFlicker
5 月 19 日
新模型训练会占用大量算力
MEIerer
5 月 19 日
额度又少,还降智,难受
jackqian
5 月 19 日
我一直用 xhigh ,没感觉到降智
diudiuu
5 月 19 日
@JerningChan 方便分享一下哪个量化版本的吗
JerningChan
5 月 19 日
@diudiuu 就用 unsloth 的 Qwen3.6-27B-UD-Q4_K_XL.gguf 就很不错,我家里自己用的 35b-a3b 也很不错
teaguexiao
5 月 19 日
这种节点通常是新版本发布前后的算力调度问题,Claude Sonnet 4 发布前 3.7 也来过一次差不多的波动。等一周左右一般会恢复,实在不行就先请 ds v4 我来做客。
wdv2ly
5 月 19 日
同感,Opus 4.7 明显比之前苯了很多,现在有点像豆包了,说啥只会迎合
diudiuu
5 月 19 日
@JerningChan #27 一会在本地试下
commoccoom
5 月 19 日
@JerningChan 请问下 3060 12G 能跑吗😂
iorilu
5 月 19 日
不会把, 真不如本地

这两公司得瞬间破产
icaca
5 月 19 日
一两周前就降智了
JerningChan
5 月 19 日
@commoccoom 不太行喔,除非你把大部分的层卸载到 cpu+内存,这样稠密型的模型就会比较慢了,moe 的话,我就不太清楚,我之前是 1660s 6g ,跑那种 9b 模型,设大了上下文,就得卸载到 cpu ,就会很慢
JerningChan
5 月 19 日
@iorilu 你自己试试就知道了,问题是即便你想 27b 用的爽,不想折腾,单卡跑,成本是多少?随便起码一张 4090 吧,反正我自己用 2080ti 22g 跑 27b 模型,都只有 20t/s 左右,要用得爽,起码 60t/s 才有一点点效率
sead
5 月 19 日
最近写的确实缺点意思, 我还以为是错觉。。。
chen27
5 月 19 日
算力用来训新模型了
eventlooped
5 月 19 日
我最近觉得 claude 比 gpt 强太多了
mfsw
5 月 20 日
不知道恢复了没有。不敢用了。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1213794

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX