用量真是自己都还不太清楚,反正自己一直玩tgbot做agent,
一个月2个opencode go勉强够用。
现在还要开发个中小型项目自家用,
感觉起码要开199/月的kimi,
有没有用过的佬友推荐下?
准备走主agent规划指挥、子agent用deepseek-flash执行这种路线。
在找香港亲戚帮忙9.22当地抢一台丐M5 Ultra 96G本地部署qwen3.8-27b和35b-a3b了,
不知道到时候能不能替代子agent干活呢?
用量真是自己都还不太清楚,反正自己一直玩tgbot做agent,
一个月2个opencode go勉强够用。
现在还要开发个中小型项目自家用,
感觉起码要开199/月的kimi,
有没有用过的佬友推荐下?
准备走主agent规划指挥、子agent用deepseek-flash执行这种路线。
在找香港亲戚帮忙9.22当地抢一台丐M5 Ultra 96G本地部署qwen3.8-27b和35b-a3b了,
不知道到时候能不能替代子agent干活呢?
35b A3b的模型还是不敢放心用吧,激活参数太小了
qwen3.8 27b的那个dense模型不错
但是kimi 199貌似额度不多,而且如果超了256k貌似还会更贵 ![]()
或许可以用ocg的GLM-5.3指挥?
我看极客湾那个手机续航测试的agent就是qwen3.6-27b做规划指挥,35b-a3b做执行。
当然我准备还是用kimi-k3做主规划指挥,我意思是用qwen3.8-27b做执行
kimi 199 档跑 agent 编排够用,但并发多就卡,我拿它跑过 20 轮工具调用,token 烧得飞快
如果佬本身用opencode且主用ds的话,ollama和commandgoat可以考虑一下
以及tgbot要两个opencode吗,看来佬的tg群挺活跃
极客湾那个测试首先肯定是要模拟真实人类操作才会选更小更快的模型啊……
qwen3.8 27b执行我觉得没问题
主要就是拿k3当主agent指挥和规划,执行都是交给dsv4fv去执行
一台GB10的小砖头好像可以满血部署256k的qwen3.8-27b了
只是m5u多点功能,以后玩法也多
配一个mimo-v2.5理解图片效果就可以吧
理解图片应该不对模型智商要求太高
Kimi额度看上去真的很少诶
不是不是,是玩nanobot当主力AI agent了,不是tg群。
就是平时用简单问答直接手机app qwen那些都免费。
但是做些小项目或者兴趣的东西,就用tgbot控制nanobot做事,宿主机都是mac,很方便
极客湾追求的就是即时交互测试啊
肯定首字越低越好
而且上下文越长要算的就更多,tps就会更低
现在两个opencode go的用量远没有一个ollama pro多,或者可以看看command code goat,不过最近有部分反应command code有降速降智的问题,不过可以先充个一刀体验下
我感觉也是,之前用ocg的k3 review一下我的小项目马上就没半个月额度了,周额度当场归零
a3b 的模型查 bug 可以,改 bug 就慌了。
kimi 我感觉比 deepseek 和 GLM稳,这两天在用 glm5.3 感觉 5.3 改 bug 不如 deepseek。定位问题很慢
我没用过glm5.3,dsv4f倒是用了200RMB了,真的好用到飞起,不敢相信200多b怎么能这么好用的。
我的用途情况下,几乎没遇到过什么瓶颈,很小很小情况。
所以想着kimi-k3既然这么厉害,用来规划指挥,用不了多少量,199/月套餐我感觉应该够
kimi k3激活参数104B,顶ds-v4f一半少点参数量了,力大砖飞,肯定是好用的
但是上下文超256k貌似计费*2?
deepseek pro 比 flash 要稳很多。不过我感觉 kimi 更稳。
稳的意思是不容易搞定这头弄坏那头
开kimi不如开gpt plus。qwen3.8 27b的效果还不错,世界知识比不上,但是局部编码确实是有Claude4.6水平了
还有这种计费方法?我晕,其实199/月,已经不算便宜