以前挺相信 claude code 说的,现在不相信了,设计方案、代码都有大漏洞,找个代码都能瞎说

4 月 22 日
 Javin
5763 次点击
所在节点    Claude
25 条回复
giter
4 月 22 日
跟使用场景也有很大的关系,每个人的环境都不一样,提示词、使用的 Plugin 、用到的 Skill 以及需要遵循的规范都不一样,如果觉得 Claude Code 睁眼说瞎话,看下是不是可以规范一下你的使用方式或者优化提问内容
Javin
4 月 22 日
@giter 重度 claude code 使用,都大半年了,开始确实挺好,现在能睁眼说瞎话,很明显的降智;早都石锤了只是最近越来越明显: https://github.com/anthropics/claude-code/issues/42796
giter
4 月 22 日
@Javin 降智是实锤这肯定的,但也要有个规范使用的最佳实践,把降智带来的影响降到最低。可以多用一些指向性明确的词,强制约束 AI 必须遵守
penisulaS
4 月 22 日
我在想,降智了应不应该退一部分款
940i3s34v4F1HW41
4 月 22 日
对齐功能变差了,只能说模型的后期训练质量变低了,这和算力是否充足应该是没有关系的,纯粹是模型问题,但是作为外行不知道问题可能出在哪里
SantinoSong
4 月 22 日
@giter #3 真降智了靠提示词来约束也没效果了
coolxll
4 月 22 日
最近降智蛮严重的
andlp
4 月 22 日
降智了
whoosy
4 月 22 日
只有 opus4.7max 没降智,其他 claude 模型都不行
chenxytw
4 月 22 日
@giter 降智是多方面的,其中一个点是幻觉变严重,这个是无法靠提示词工程弥补的
beefhotpot
4 月 22 日
@sddyzm 感觉有关系啊,你怎么知道它会不会用低配置的机器跑量化了部分参数的模型,然后在某些时候路由到这些服务上?
sampeng
4 月 22 日
所以我把拓展思维管了。强行开 high/max 等级的思考等级。除了慢一点,最少洗车问题能过去了
940i3s34v4F1HW41
4 月 22 日
@beefhotpot 嗯,是参数不完整配置的模型
qiqw
4 月 22 日
现在 有 max / extra high / high, 我一般用 high, 写计划用 max, 执行时就降下来
assad
4 月 22 日
做了几次需求,都是没解决问题
teaguexiao
4 月 22 日
同感,现在写计划用 max thinking ,执行阶段降回标准模式,幻觉明显少了很多。
lmmlwen
4 月 22 日
设计方案有缺陷,具体哪里?代码有漏洞,什么漏洞,逻辑、安全? AI 具体怎么写和提示词还有使用者的编码水平正相关
sampeng
4 月 22 日
@lmmlwen 来来来,你让他做洗车实验
maocat
4 月 22 日


上面的别洗地了,什么弄不好找找自己原因,都是正常人,谁不会用啊,

看看我这个,谁家好人提交代码要把.env 给我提交了,把我逗笑了
zerovoid
4 月 22 日
早期开拓市场抢客户,肯定给最好的服务。
现在用户数到顶了,有了稳定的付费客户,肯定要开始降低服务品质了。

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1207648

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX