看了一位 v 站博主的 OpenAI 模型降智测试,于是也测测自己用的客户端模型是否被降智

9 月 14 日
 senyuLight

原贴:一些关于 openai 订阅降智,账号风控的独立测试

通过模型指纹识别:https://xqy2006.github.io/ModelTrace

识别结果如下,看到是 gpt6 就放心了,真害怕是 gpt6 收费,使用的是 5.6

6500 次点击
所在节点    程序员
54 条回复
senyuLight
9 月 14 日
@layxy 看了大佬你的回复了,我觉得这个是正常的。我用 gpt6 模型,或者 5.6 sol 模型的时候,做复杂任务,当前对话窗口回去开子 agent 执行任务,主 agent 管理,子 agent 就会根据任务派发到 gpt 其他模型。你在对话窗口是能够看到那些子 agent 执行的。
plants
9 月 14 日
@senyuLight 因为 openai 在重点打击非法中转站,中转站降智是重灾区
layxy
9 月 14 日
@senyuLight 我是用的 gpt6-astra medium,没有要求其开子任务,之前蹬过 gpt5.6 sol ultra ,子 agent 执行我知道右上角会有子任务列表图标,但是用了 gpt6 后我觉得挺快的,完全不需要子 agent,也没在右上角看到过子 agent 的图标,说白了就是后端直接给路由到 luna 了
yiranw09
9 月 14 日
测了一下中转站的几个渠道
1. 研究院渠道 GPT6

2. Pro 号池

3. Plus 号池

测试方法应该是蛮准的,并且消耗比醍醐糖果小多了,开一个 chat 就能进行测试
senyuLight
9 月 14 日
@yiranw09 可以的,那我更加放心了👍
pwinner
9 月 14 日
其实最简单的是鹈鹕测试,大部分人日常使用可能注意不到被降智而已...
zjttfs
9 月 14 日
@pwinner
降智体感很明显..
特别是 astra 降智.降智后明显弱智,做事做不全等
kianwww
9 月 14 日
有些客户端在触发风控或者高负载时也会静默降级
None123
9 月 14 日
astra max ,测出来是 gpt-5.6-luna
tim9527
9 月 14 日
还可以,看来家宽挺准的,我鹈鹕测试也过了
FakerLeung
9 月 14 日
丸辣,中转站 gpt-5.6-sol ,测出来是 gpt-5.6-luna
senyuLight
9 月 14 日
@FakerLeung 中转站必炸,官方重点关注的,以后中转,反代,肯定是能不用就不用了
tim9527
9 月 14 日
用 Astra 又测试了一次 稳
yinmin
9 月 14 日
openrouter 选 sol ,测出来 100% sol
jko123
9 月 14 日
自用订阅测的


中转站测的


中转站果然不能用啊
senyuLight
9 月 14 日
是的,中转以后肯定不能用了,一方面是对话数据可能会被卖,最新网上一个博主花 5 位数卖 6tb 的中转数据,大量的 ssh 等 key ,另一方面中转可能会注水,最重要官方会限制,可能会对自己的项目有影响。
Cruzz
9 月 14 日

我这的肯定没降智,因为让他给我测试下 hive 认证跑了我百分之 40 的额度。根本用不起,我也不开。5.6sol 够够的。
andie
9 月 14 日
很准
sampeng
9 月 14 日
@layxy 应该不是你要求,而是 codex 的背后会有模型任务,compact ,explore ,都可能是 lua 。。
layxy
9 月 14 日
@sampeng 如果没降智,咋会这么拉啊,感觉现在使用没有刚出那两天好使了,有时候还不如 gpt5.6 sol

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1241763

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX