CommandCode反代出来的deepseek-v4.1-flash感觉好难用

让他回答个水杯题 推理时间长了 就各种报错 我修了半天 在pi里可以了 结果换成cherryStudio又不行了 真是心累 :face_exhaling:
这是水杯题,max要思考十几分钟 太能思考了 :melting_face:

有一个水杯配对游戏。共有 4 种不同颜色的水杯,每种颜色各有两个。将同色的两个水杯分别放在上下两层,因此上下两层各有 4个水杯。下层 4个水杯按某个未知顺序排列,挑战者无法看到它们;上层水杯的颜色和位置则完全可见。游戏开始后,挑战者可以反复进行以下操作:

  1. 向裁判询问当前有多少个位置满足“上下两个水杯颜色相同”。裁判只回答匹配位置的总数,不透露具体是哪些位置。
  2. 根据目前获得的所有信息,挑战者可以选择交换上层任意两个相邻位置的水杯,注意只能是相邻,不能是任意两个。当 4个位置全部匹配时,游戏结束。
    问题:挑战者应采用何种策略,才能保证对于下层水杯的任意排列都能完成配对?所有能保证成功的策略中,最坏情况所需的交换次数最少是多少?
    回答时请不要进行联网搜索,也不要写代码来辅助计算(包括思考过程中)。
    假设答案是 x ,你需要给出严格的证明,为什么 x 可行,为什么小于 x 不可行。
    输出时第一行必须严格使用 FINAL=<整数> 的格式,其中填写你推导出的 x;随后再给出严格证明。
4 个赞

感觉不是官方的。

1 个赞

其实就是官方的,官方挂也一起挂..速度也和官方一致..第三方推理商没有一家能达到200tps的同时缓存命中率超过99%..deepseek在推理服务方面的优化就是秒杀同行的..

10 个赞

可能是因为思考强度不对等?反代的high强度远远少于官方的high,应该用max的

1 个赞

max的雷霆大思考 真的很难绷得住

我在dsh上用,反代的high只有两三行的思考:thinking:

1 个赞

目前发现的问题有 限流、连接时间超过几分钟自动给你断开

1 个赞

有一个水杯配对游戏。共有 4 种不同颜色的水杯,每种颜色各有两个。将同色的两个水杯分别放在上下两层,因此上下两层各有 4个水杯。下层 4个水杯按某个未知顺序排列,挑战者无法看到它们;上层水杯的颜色和位置则完全可见。游戏开始后,挑战者可以反复进行以下操作:

  1. 向裁判询问当前有多少个位置满足“上下两个水杯颜色相同”。裁判只回答匹配位置的总数,不透露具体是哪些位置。
  2. 根据目前获得的所有信息,挑战者可以选择交换上层任意两个相邻位置的水杯,注意只能是相邻,不能是任意两个。当 4个位置全部匹配时,游戏结束。
    问题:挑战者应采用何种策略,才能保证对于下层水杯的任意排列都能完成配对?所有能保证成功的策略中,最坏情况所需的交换次数最少是多少?
    回答时请不要进行联网搜索,也不要写代码来辅助计算(包括思考过程中)。
    假设答案是 x ,你需要给出严格的证明,为什么 x 可行,为什么小于 x 不可行。
    输出时第一行必须严格使用 FINAL=<整数> 的格式,其中填写你推导出的 x;随后再给出严格证明。

用这个提示词问他

哈哈,思考了五分钟中断了重新开始…
我这是欧洲服务器上搭建的DSH,也不存在网络不稳定的问题

他们的竞品 Opencode 那边的 v4.1 比起来咋样

我觉得应该是官方的吧,因为它的缓存率非常高,第三方的缓存率明显低很多,比如workbuddy还有孙割AI.
commandcode 跑个长任务,能到99%,剩下两个只有95%上下

GO并发不高,限流,goat直接用API好像高些,也快一些

这几天在 dsh 上跑了五个 go 账户,我是加了规则走直连的,速度很快且缓存率都是 99%+,已经快要抛弃 gpt 了

对的对的 就是这样 思考久了就不行了

笑死我了,我不测了还不行吗 :sob:
25分钟重试第五次了一个正文都没输出 :rofl:

我正准备入手commandcode,那我还是准备考虑下了

哈哈哈哈哈哈

跟我一模一样,官方的几分钟就出结果了

这个command code goat能反代到codex使用不?现在gptplus的额度太拉了,想用便宜的国模替代一下了

怎么说呢,我是用的GOAT的API,然后是比较常规的开发任务吧,基本是能用的,只是没法甩手。水杯题这种我一般不测试,因为一般来说我让他聚焦的具体任务逻辑复杂度达不到这个程度