llm价格的底线会在哪里?

rt,现在各家都在拼命卷价格,deepseek干到2输入3输出,glm也掏出了骇人的订阅套餐,北美的模型也在不断降价。

一直很好奇价格降到哪里会是个底

尤其是最近看到质谱的招股,api业务毛利已经负了,恐怕贴钱抢市场的日子就要到来了?

5 个赞

质量还是比价格重要的吧w

1 个赞

开源模型你咋定价不行

1 个赞

要是硬件、电费再便宜些,那还有得降

1 个赞

黄仁勋已经说过了,如果将视角拉的很长,这玩意只和电价有关系..

10 个赞

最终拼的就是电费

1 个赞

也用了再说

模型的定价说到底还是看训练和推理的账单。当年 o1 定价 $60/M 输出,是因为它的推理过程不仅消耗大量标记,还有极高的推理阶段算力成本。后来随着技术摸透了算力利用率也优化上去了,成本自然就下来了。不过,现在价格能降得这么快,还有一部分原因是市场竞争打价格战 :melting_face:

为什么cluade不降

1 个赞

opus4.5降价了啊,虽然还是很贵,还有一点可能是看中了自己coding的垄断吧,降价格就是少赚点

1 个赞

现在是AI大战争夺市场,恐怕等到以后几家垄断就是收割的时候了。毕竟算力、数据、人才可是一笔不小的成本。

1 个赞

价格战打起来不死点可是停不下来的

0,总不能倒贴吧

2 个赞

如果民用设备上比如5060ti 16g就能50tps 跑一个sonnet 4.5/gpt 5.2性能80%的llm 那就真的白菜价了(梦里什么都有

3 个赞

低价是电费和带宽费

时代不一样了。之前CPU数据中心拼电费,GPU数据中心买GPU的价格太贵了,主导成本的是购买GPU的钱。30万买一张B300,1.3kw的功率,全年拉满也就11300度电。买卡钱等于20年电费。

1 个赞

价格贵是地缘政治因素,设计出来后生产成本并不高

这个不是5.2和Gemini 3才提了价格吗,5.2提了40% Gemini 3是25%来着?

2 个赞

问题是所有厂商都把卡卖得这么贵。美国大厂买英伟达的卡也是按这个价格买的。华为寒武纪的卡单位算力价格也差不多。只能说在当下,即使电费是0,每token价格顶多打个9折。

参考手机套餐,不会太低的,智谱、Minimax这种一个月20快钱包月就差不多了。DeepSeek可能还会继续价格下探,但是1元/M·tok基本就是极限了。