V2EX = way to explore
V2EX 是一个关于分享和探索的地方
Sign Up Now
For Existing Member  Sign In
V2EX  ›  sillydaddy  ›  全部回复第 1 页 / 共 158 页
回复总数  3158
1  2  3  4  5  6  7  8  9  10 ... 158  
6 小时 49 分钟前
回复了 iwasthere 创建的主题 问与答 关于合力租算力搭建大模型
这个问题我觉得我已经有答案了:
「个人是否应该投资购买 DGX Spark 之类的硬件来跑开源模型?既是自用,也是某种防止硬件涨价的投资?」: /t/1234981

「两台 dgx-spark 部署满血 deepseek v4 flash 完全指南,稳定 60~70tok/s 单流」: /t/1232688

即使是 DGX-Spark 这样的显存带宽很低的,按照现在的 API 价格,跑满负载的话,也完全可以在 1 年左右回本儿。

但是,考虑到订阅价格普遍比 API 价格低 20 倍,即使按照 API 是 1 年回本来计算的话,按现在的低订阅成本,也需要 20 年才能回本。也就是说自己部署是永远也不如订阅划算的!

为啥订阅这么便宜呢?不太清楚。收集真实数据?通过入口留住用户?总之,这可能就是厂商的一种补贴吧。你能打得过补贴吗?

除非因为某些原因,无法使用订阅,比如隐私,比如订阅中缺乏替代模型,比如订阅会被限额限速。
7 小时 32 分钟前
回复了 skills 创建的主题 问与答 粱圣变小粱了,还有啥方便好用的 coding 套餐吗?
@PolarBears #29 看到 Muse Spark 1.2 Contributor 了,比原来的 Deepseek 都便宜。看样子这是 Opencode Go 在自救啊,找一个另外量大管饱的模型。
12 小时 45 分钟前
回复了 harveyM 创建的主题 程序员 AI Coding 时代作为面试官已经不会面试开发了
最近 v 友分享的: 「小学没毕业,每月爆赚 40 万」,https://youtu.be/jdE_ujwZGvA?t=220
这是他开发的网站「班级宠物园」: https://new-bjcwy-edge.cjgsup.com/
他说:「我不会。我看不懂代码。我到现在我都不知道这个项目用的是什么技术栈。那这些卡通图案呢?也是 AI 设计的。」
1 天前
回复了 sevenyangcc 创建的主题 问与答 你会拼魔方吗?
只会拼一个面。。但,估计已经超越了 50%的人。
1 天前
回复了 vergilgao 创建的主题 程序员 现在用 ai 辅助编程就跟吸毒了一样
再加个功能。。再完善一下。。再调整下细节。。再提高点性能。。
没有一点合同精神!订阅期内不影响用户的体验是最基本的要求吧。哪怕你在订阅结束后再变更呢。
即使你的 TOS 里面写明了“可随时变更”,也是一样的道理!谁会闲的去看你的 TOS !大家时间都很宝贵的。不符合常识的 TOS 就是无效的 TOS 。

昨天我退订了,退订理由选的“太贵了”。然后附言写的:订阅期内这么搞贪婪又愚蠢,我不用愚蠢的人做的产品。
现在看来果然是很愚蠢。
@kdwycz #40 是一个数据采集项目: https://v2ex.com/t/1215475#r_17684892
@kdwycz 我可以跑满,真的。而且还有 10 倍的缺口。每个人的情景和用法都不一样,跑连续自主的 Agent 非常烧 token 。
@msg7086 你是不是算错了😂,2 台 DGX Spark 跑 DeepSeek-V4-Flash ,一天至少 1000 万~2000 万纯输出 token 的。
不过订阅倍率这个,我确实给忘了,哈哈,如果按 20 倍倍率,那肯定是回不了本。 @liulihaocai
@sentinelK #7 就算按 7:3 ,也不是 15~20 年啊,最多翻个 3 倍,算 10 年。

主要是这种估算变数比较大:
那里面估算的时候,取的是平均单次 API 调用花费¥0.004 ,这本身就有些低估。而且现在涨价了,估计单价这项得翻个几倍。
再加上多路并发,也可以有个几倍。
@sentinelK 简单估算了下跑满的 token 产出量: https://v2ex.com/t/1232688#r_17950784
2 天前
回复了 yiranw09 创建的主题 程序员 opencode go 的 deepseek 涨价并缩减了用量
OpenCode 真不要脸啊,订阅期内就这么搞,昨天我这还显示的用了 3%左右,今天就 30%了!太不要脸了。
视频里不是说了嘛:8 分运气,2 分实力。
2 分实力里面有 1 条,抓住需求的能力。
大概因为,不知道缓存怎么算,以为缓存高是 Agent 甚至 LLM 的功劳。
下面对话,都是 3 轮,输入 token 都是 40K,(其中 A、B、C、D 都代表 10K token,用|分割轮次):

缓存率 44%: 按照 A|BC|D ,缓存率就是(AA+B+C)/(AAA+BB+CC+D)=40K/80K=50%
缓存率 55%: 按照 AB|C|D ,缓存率就是(AA+BB+C)/(AAA+BBB+CC+D)=50K/90K=55%
是不是 AISlop ??网上丁点消息也没搜到。
6 天前
回复了 fcten 创建的主题 DeepSeek DeepSeek 涨价方案正式公布了
好记,2333 。。。:2 倍,3 倍,3 倍,3 倍。
6 天前
回复了 Livid 创建的主题 Local LLM local.ai
Cursor 就是 bug 的代名词:连「计费」这么基础和重要的,都能三天两头出 bug 。
/t/1137758 : 大模型。。。保持。。意思。。不变,。。嵌入隐藏水印
心真大!门户敞开用中转,犹如 3 岁小孩,抱金砖行于闹市。
1  2  3  4  5  6  7  8  9  10 ... 158  
About   ·   Help   ·   Advertise   ·   Blog   ·   API   ·   FAQ   ·   Solana   ·   2753 Online   Highest 6679   ·     Select Language
创意工作者们的社区
World is powered by solitude
VERSION: 3.9.8.5 · 43ms · UTC 15:33 · PVG 23:33 · LAX 08:33 · JFK 11:33
♥ Do have faith in what you're doing.