小米真的是营销大师, mimo 降价了 又好像没降多少

5 月 27 日
 timeance

先上结论:

看别的论坛说命中率与 Deepseek 差不多(网上的内容,我没有实测)

理性来看,这次更新算正向的

说实话咋一看还以为是先涨价后降价 本来想发帖喷,后面仔细研究才发现其实也还好... 估计是鼓励更多的命中缓存

https://platform.xiaomimimo.com/docs/zh-CN/news/v2.5-price-update

3546 次点击
所在节点    小米
11 条回复
tf2
5 月 27 日
你才是标题党营销大师
beyond98
5 月 27 日
@tf2 楼主说的也没错吧,小米本来就没降多少,量多了消耗也变大了,哪有宣传力里说的增加了多少倍的用量
ifwant
5 月 27 日
看 api 调用价格已经和 deepseek 一样了,还是降挺多的了。印证了那句话,不超过 deepseek 的价格还比 deepseek 高的在 ai 时代必死(说的就是你 minimax )
sillydaddy
5 月 27 日
一般用 claude code 这类 agent ,缓存会占比很大,一般都会在 90%以上。因为它要经历 thinking..action..thinking..action 这样很多轮,轮次越多,缓存占比越大,因为每一轮都会把之前轮的那些输入喂给大模型,这些就是缓存。

假如每轮新输入 10000 个 token ,那么 10 轮后,未缓存的就是 100000 个 token ,缓存的呢? 10000+20000+30000+...+100000=5550000 ,缓存命中率=5550000/5650000=98%

实际要考虑上下文超出会压缩,导致原来的缓存失效。但缓存命中率只跟 Agent 工具的用法有关系,Agent 模式一般都能到 90%以上,除非你特意优化 Agent 的流程,减少缓存的占用,比如使用定制的流程去处理,例如那些 AI 视频生成管线,把流程前一环节的输出经过筛选,作为下一环节 API 调用的输入,而不是堆积信息,这样会减少缓存。

这是我用 claude code 调用小米 token plan 处理文本提取信息,这个场景下的消耗(缓存占比非常大,命中率 97%,这种情况下,可用量确实提高了 10 倍左右):
https://v2ex.com/t/1215750#r_17686925

不过,小米套路多倒是真的。
sillydaddy
5 月 27 日
@sillydaddy #4 上面的例子算错了😓,10 轮命中率=550000/650000=85%。
liaohongxing
5 月 27 日
看了一下价格, 完全对标 deepseek ,还行吧!

https://api-docs.deepseek.com/zh-cn/quick_start/pricing
myarsenal
5 月 27 日
这算怎么个营销法
Sezxy
5 月 27 日
@myarsenal #7 只要小米相关的新闻,不是负面的,都是营销
106npo
5 月 27 日
@ifwant minimax 的标价就没准备去卖 甚至他的标价页都是错的,这么久了也没人管。2.7hs 的缓存写入价格写的比输入还便宜 🤣
CuteGirl
5 月 27 日
上个月送了一个月 这个月 1 分钱续费一个月 我感觉已经很良心了
timeance
5 月 27 日
@CuteGirl 那确实,刚刚看到 v 站有个帖子,赶紧去续费了

这是一个专为移动设备优化的页面(即为了让你能够在 Google 搜索结果里秒开这个页面),如果你希望参与 V2EX 社区的讨论,你可以继续到 V2EX 上打开本讨论主题的完整版本。

https://v2ex.ih06.com/t/1215762

V2EX 是创意工作者们的社区,是一个分享自己正在做的有趣事物、交流想法,可以遇见新朋友甚至新机会的地方。

V2EX is a community of developers, designers and creative people.

© 2021 V2EX