qwen 也用上 DeepSeek 的缓存技术了。我这居然有 90%了,套餐是 coding plan 的 qwen3.7 plus

6 月 22 日
 lynn1su
coding plan 的成本降下来后会不会向公众开放?
4301 次点击
所在节点    程序员
19 条回复
yh7gdiaYW
6 月 22 日
就前几天没有,被喷惨了后把自动缓存加上了。我这儿 cc+qwen3.7max 的缓存命中率有 92%+
bbbblue
6 月 22 日
缓存命中率和用不用 ds 的技术没关系吧
用 ds 的是超便宜缓存+长时间缓存(小时有时天级别)
ifoto
6 月 22 日
coding plan 还能抢到吗
chenluo0429
6 月 22 日
你在讲些什么啊?能不能先学习下什么是缓存?这些基础知识随便找个 AI 都能给你安排的明明白白,不要在公共场合暴露自己的无知
anivie
6 月 22 日
是阿里百炼的 coding plan 吗,之前去问他们有没有 qwen3.7 还说没有
xiaomushen
6 月 22 日
token plan 里有好模型
coding plan 好像买不到了
codehz
6 月 23 日
不能只看比例啊。DeepSeek 它的缓存的价格是比较低的。(相对来说)
mingtdlb
6 月 23 日
国产只有 deepseek 真诚。其他厂商都爱玩套路
TK6
6 月 23 日
coding plan 是按次数计费的怎么算缓存?
abc0123xyz
6 月 23 日
coding plan 给的是 qwen3.7plus 没给 max 版本
son012
6 月 23 日
qwen3.7plus 使用体验不太好吧?我用了 qodercn 的订阅,但是改个东西就一直乱改
lynn1su
6 月 23 日
@TK6 #9 我对接到我的 newapi 后发现上周是完全没有缓存的,这周缓存命中率突然变得和 deepseek 一样高了
JerningChan
6 月 23 日
缓存难道不是你每次调用 ai 的 api 时,你这次发送的内容和上几次的对话内容有高度重叠的内容,才会缓存命中吗?
yh7gdiaYW
6 月 23 日
@JerningChan qwen 还真有自己的想法,3.7 max 刚发布时没有其他家那种隐式缓存,必须显式创建要缓存的内容。后来被喷改了后还要嘴硬"隐式缓存命中率不确定(加粗)"。3.7 plus 不知道有没有类似的逻辑
JerningChan
6 月 23 日
@yh7gdiaYW 哦?这样吗?那还真坑,我是自己部署 qwen3.6 + 线上用 ds / opus 那些,之前用了几次线上的 qwen3.6-max 那些,消耗太快,一点都不爽😂
asd999cxcx
6 月 23 日
百炼的 tokenplan 经用么
nescirem
6 月 23 日
@asd999cxcx 我的百炼 tokenplan 标准版 一周用了 20%,感觉差不多刚好够用 1 个月
Rorysky
6 月 23 日
@chenluo0429 缓存就是重复信息输入,问的轮数越多缓存越高,缓存高说明上下文管理不当
abc0123xyz
6 月 24 日
阿里的 coding plan 是按请求计费的啊,缓不缓存都无所谓

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1222061

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX