rt,现在各家都在拼命卷价格,deepseek干到2输入3输出,glm也掏出了骇人的订阅套餐,北美的模型也在不断降价。
一直很好奇价格降到哪里会是个底
尤其是最近看到质谱的招股,api业务毛利已经负了,恐怕贴钱抢市场的日子就要到来了?
rt,现在各家都在拼命卷价格,deepseek干到2输入3输出,glm也掏出了骇人的订阅套餐,北美的模型也在不断降价。
一直很好奇价格降到哪里会是个底
尤其是最近看到质谱的招股,api业务毛利已经负了,恐怕贴钱抢市场的日子就要到来了?
质量还是比价格重要的吧w
开源模型你咋定价不行
要是硬件、电费再便宜些,那还有得降
黄仁勋已经说过了,如果将视角拉的很长,这玩意只和电价有关系..
最终拼的就是电费
也用了再说
模型的定价说到底还是看训练和推理的账单。当年 o1 定价 $60/M 输出,是因为它的推理过程不仅消耗大量标记,还有极高的推理阶段算力成本。后来随着技术摸透了算力利用率也优化上去了,成本自然就下来了。不过,现在价格能降得这么快,还有一部分原因是市场竞争打价格战
。
为什么cluade不降
opus4.5降价了啊,虽然还是很贵,还有一点可能是看中了自己coding的垄断吧,降价格就是少赚点
现在是AI大战争夺市场,恐怕等到以后几家垄断就是收割的时候了。毕竟算力、数据、人才可是一笔不小的成本。
价格战打起来不死点可是停不下来的
0,总不能倒贴吧
如果民用设备上比如5060ti 16g就能50tps 跑一个sonnet 4.5/gpt 5.2性能80%的llm 那就真的白菜价了(梦里什么都有
低价是电费和带宽费
时代不一样了。之前CPU数据中心拼电费,GPU数据中心买GPU的价格太贵了,主导成本的是购买GPU的钱。30万买一张B300,1.3kw的功率,全年拉满也就11300度电。买卡钱等于20年电费。
价格贵是地缘政治因素,设计出来后生产成本并不高
这个不是5.2和Gemini 3才提了价格吗,5.2提了40% Gemini 3是25%来着?
问题是所有厂商都把卡卖得这么贵。美国大厂买英伟达的卡也是按这个价格买的。华为寒武纪的卡单位算力价格也差不多。只能说在当下,即使电费是0,每token价格顶多打个9折。
参考手机套餐,不会太低的,智谱、Minimax这种一个月20快钱包月就差不多了。DeepSeek可能还会继续价格下探,但是1元/M·tok基本就是极限了。