有什么方案让模型根据请求复杂度智能路由的吗

有什么方案让模型根据请求复杂度智能路由的吗,比如复杂推理走GPT5.4,日常对话用快速模型,是不是用一个超快速小模型来分流好一些,还有其他方案吗,求佬们推荐

是的,我就是让一个小参数模型做任务分流 :white_check_mark:

佬,你分流用的什么模型?调的API还是本地部署的

我觉得没有办法智能路由,现有的最佳实践就是硬编码任务类型,比如在调研的时候用小模型快速检索知识。
如果让大模型自行辨别分发任务,倒是可以通过调用cli执行。但是集群沟通又成了问题。
目前集群做得好的就是kimi和cluade.但是都没有开源出来。

我是调的 api,gpt-5.4 mini