科研论文代码实现工作流和模型选择

研究生一名,AI信道均衡方向,最近在搞论文的实现,开通了一个pro 5×的账号,目前已经和网页端pro讨论出我的论文设计,并分成了五个阶段的执行方案,包括仿真数据生成、几个baseline算法实现和我的算法方案实现、性能指标对比。

关于工作流,我目前了解的就是mattpocock的skills工作流和trellis。

在使用matt的时候发现生成的spec和tickets的内容都偏向于精简和测试,不会具体记录已经定下来的信道设计和算法公式,执行的时候都不确定是否按照已定算法公式来实现的。

然后又试了下trellis,划分的父子task感觉不错,记录的都比较具体,并且在执行的时候帮我发现了一个问题,就是网页端Pro给我设计的完整仿真数据生成要占用500GB,给我看呆了,我寻思我就想要一个信号的数据能占多大空间,感觉是给设计过头了。不过trellis在执行各个task的时候感觉任务之间的衔接不流畅,前面一个任务发现有问题需要修改,然后后面的任务也要跟着修改适配,任务一多靠后的任务就一直需要修改。并且用astra medium配合trellis执行任务额度会消耗的很快,gpt pro的额度感觉也被砍了,执行完五六个子task周额度很快就用完了。

现在不太确定是用现成的工作流还是直接模型裸实现。我觉得这是一个从零实现的工程,所以我想第一版能够稳定实现出来,这样后续的算法改进也更方便。

想求教下佬们,对于论文代码实现的需求,使用什么工作流比较好,并且怎么选择分配任务的模型和执行任务的模型

AI信道均衡,是wireless AI,拿NN来替代ZF/MMSE这些吗哈哈
我一直用的这个仓库的工作流:wanshuiyin/Auto-claude-code-research-in-sleep,主要是一些调研、实验管理、画图skill,个人感觉astra也不需要trellis这些了
Astra额度不够的时候我就用pro写计划,让ds flash或者glm flash干活

3 个赞

对的,不过是水声通信方向,也在硬着头皮干哈哈。感谢佬的建议,我去看看这个仓库。
想问下佬的方案一般是用astra裸实现吗,效果怎么样,我很怕执行过程中模型反复修改,到最后还要大修。

你说把方案落实成代码吗,裸实现应该问题不大,我也是做通信的,不过一般是写python,这代码ds flash跟glm flash也完全可以胜任,astra更不用说了,ds和glm我有时候还用一下plan模式,astra我直接就让他写了

1 个赞

这玩意得多次检查实现吧,一个工作流包办多个功能很难精准达到要求吧,必定有疏忽的。光是baseline 得适配实现自己的模型 就可能出现很多问题。为啥不一个一个模块实现呢。

1 个赞

好的谢谢佬的建议,我先裸实现看看效果。

我觉得大多数工作流基本也都是拆分任务然后依次实现的流程。因为我已经有自己的模型方案了,让网页端pro生成了从头到尾几个阶段的方案,所以想用工作流将这几个方案划分成很多子任务,然后依次实现。我感觉这也算一个一个模块实现了吧。