想自部署一个glm5.2 拼车 按小时计费 一个小时成本大概12块 有人一起拼吗 FP8量化版本
不是要每个人出12啊啊啊啊 总成本12/h 按拼的人数平分
实在抢不到codingplan了 出此下计
打算先用一个小时看看能不能跑通再说
27 个赞
这怕是收不回成本吧
能打得过opencode go这个么
10 个赞
这个硬件成本得多少了,你确定划算吗…![]()
![]()
![]()
1 个赞
8卡H20的成本也要60一小时了,12一小时咋做到的
2 个赞
国产卡很便宜的 就是这个价格 八卡
12一小时,能供给多少人是个问题
还是说打算凑多少人
2 个赞
先凑12个人蹬,一人一块钱,看看情况
3 个赞
这个想法还挺新颖哈哈哈,能供给多少人是个问题
3 个赞
每分钟并发能干到多个给每个人?而且按小时计费性价比远不如多买几个别家的套餐
没并发明确,没吐字速度兜底,如果有想法,先确定好这些再定价,或者抛出不同价位对应的并发/吐字速度
17 个赞
每秒token数,够12个人分吗?
那你为什么不去咸鱼买别人搭设的用。
你先摊一天,来个中转站发个扬帆起航让大伙尝尝鲜
好用一定来,说不定你还有得赚 ![]()
2 个赞
感觉可以商业化啊,你自己先部署好,然后自己写个平台,让用户注册。然后比如说用户可以充值一点额度。然后可以选择启动额度,就自动开始扣费,按照时间扣费,然后不用了停止计费。需要限制并发。就是提供个思路。不知道 gpt给的配置准不,他说 20 万上下文的情况下,八卡h200并发也就 3-6。佬,要是有意,我可以做原始股,我也想用glm
3 个赞
那大概一个月快9000,假设45人拼,一个月200吗
1 个赞
自己部署这成本太高了吧,电费都够呛
成本只有显卡的吗,1m上下文要内存要硬盘,运行还要电费捏
1 个赞
抢不到就用ocg之类的,或者大厂的
你这种情况很显然是无法收回成本的
一般这些都是云平台配搭配好的,价格都算在里面了
什么,敢不限制并发,我直接再用他的渠道开个中转站 ![]()
