现在已经结束了这个比赛 比赛题目 在这里 Problem - A - Codeforces
今天看到 感觉还挺有趣的 我没有尝试AI能做到何种地步 不过应该参赛选手都有用AI去辅助
之前看 AI在数学领域 解决不同的数学猜想 以为现在的AI水平做这个应该是都差不多
不过看这个比赛排名 发现还是有差距的 那么这个差距是体现在哪里呢?
现在已经结束了这个比赛 比赛题目 在这里 Problem - A - Codeforces
今天看到 感觉还挺有趣的 我没有尝试AI能做到何种地步 不过应该参赛选手都有用AI去辅助
之前看 AI在数学领域 解决不同的数学猜想 以为现在的AI水平做这个应该是都差不多
不过看这个比赛排名 发现还是有差距的 那么这个差距是体现在哪里呢?
AI在数学领域 解决不同的数学猜想 以为现在的AI水平做这个应该是都差不多
不太明白你是怎么从AI解决数学猜想推出各个AI的能力都差不多的… 并不是所有模型都解决了很重要的猜想
先不说不同模型本来就实力不同,就算同一个模型,上下文工程,harness,提供给模型的工具、subagent并行数量、subagent规划方式都会影响效果
哦 抱歉佬友 我表达不清晰了 我想说的是 对于现在的顶尖模型 已经可以去解决 数学猜想了 当然那些模型还没有公布 这个比赛上肯定用到的不是
但是很多选手应该会用到astra 或是fable 感觉这些模型的能力已经很强了 至少在传统算法题上似乎已经能解决大多数了?
以为以这些模型的实力 可能分数相差不大 不过看榜单 感觉在不同的协作下 还是有很大差距的
因为这个代码 最大限制为64kb 感觉并不需要像一个项目 考虑长期维护 写spec 做好记忆等等
就是权重影响不高 反而对于人和ai协作 更好的去优化 思路的打开 感觉很有趣