GPT / Codex 中 “Selected model is at capacity” 导致频繁中断的缓解方案讨论(以 sub2api 为例)

相信不少佬都遇到过如下图所示问题:

Selected model is at capacity. Please try a different model.

我在站内检索了一下,发现这个问题似乎从 5 月 6 日起开始较大范围出现。一般情况下,手动发一句“继续”之后,模型又能继续正常工作。

所以想发帖和各位佬友们讨论一下,有没有更好的解决方案,或者至少能降低被频繁打断的影响。

目前观察下来,这个错误对应的上游返回大概是:

upstream response failed
Our servers are currently overloaded

问题在于,客户端收到这个错误后通常不会自动重试,导致 vibe coding 过程中经常被中断。

我尝试在 sub2api 里配置错误透传规则,把这个错误改成 upstream failed。这样客户端就会触发自动重试机制,最多重试 5 次。实际体验下来,被频繁中断的情况确实明显减少了。

配置如下图:

而 newapi 似乎只有状态码覆写,暂时不知道如何解决。

32 个赞

搜一下站内有佬提到通过config.toml配置下,可以有新的/goal指令,可以自动重试直到目标完成,当前应对这个问题好像还挺好用的

3 个赞

确实有用,本来两分钟一停,现在能持续跑了

1 个赞

刚知道了这个方法,立马就被发出来了 :innocent: :melting_face:

2 个赞

cpa能配置吗?找了半天没找到在哪里配置这个重试规则

现在似乎没有遇到
大概是上班时间高负载?

没有遇到这种问题,就是经常遇到上下文太短了,问一会问题就会报error":{“message”:"Missing required field ‘model’,只能重开新对话读取记忆才能继续跑,求解

今天下午free号池遇到好几次at capacity,每次都被打断,感谢佬友提供方案

没找到在哪里配置啊,网关服务里只有服务等级过滤规则

没事了,找到了,在账号管理,错误透传规则里面。

1 个赞

具体位置:点击账号管理,在页面最上面"自动刷新"边上有个"错误透传规则",点进去添加规则就好了

4 个赞

没遇到过,但就是感觉昨天的5.5好慢,比平时慢一大截

5 个赞

请问下我这样配置可以吗,我感觉这么配置更准确点,但是不知道能不能命中规则

错误码 保持空;

关键词 填写:
Our servers are currently overloaded
at capacity

匹配模式:
错误码 或 关键词
状态码匹配任一错误码,或消息包含任一关键词

自定义错误信息 填写:
upstream failed. Selected model is at capacity.

我也是,不过好像都是在开了goal的时候出现。就正常用的时候没有遇到过

请问怎么配置哈,有关键词吗佬,没找到:face_holding_back_tears:

挺多的方法介绍,搜codex goal就有啊

最近下午2点高峰期准时出现。目前看了一圈似乎除了改写错误规则没有其他方案了。因为是sse流式请求中断,这类问题很多中转站都无法解决

@ch31ly_dim @moon_sun

好兄弟我想问一下,为什么我开了 goal 也没办法自动重试呀?我看其他人开 goal 就能自动无限重试。

想让它自动无限重试应该修改什么呀? :tieba_087: :tieba_087: :tieba_087:

不到哎,我当前也属于"其他人"的范畴
不过我看你有429,是中转做的限制吗?
当前我是自用的自建的中转没做任何限制,没遇到过这个

好奇怪,我的 sub2api 甚至也没有报错,改方案也会遇到这个问题