【求助】有什么好方法对ai写的项目 全自动功能测试!!

我让ai帮我写了个投票小程序
写的很乱 ui也很丑
功能很多地方这有点问题 那有点问题的
不算大型项目 寻思就直接全vibe出来得了
现在想找个skill 或者 佬们有没有什么方法 让ai自己去全自动测试 确保每个功能都是好用的
ui我后面再用open-design迭代


codex就可以,让它全部用视觉验证

最好的方法是不要让 GPT 写 UI()

如果你用的是 GPT 的话,他的 computer use 和 browser use 非常好用,你直接让他自己去按照用户体验把所有功能走一遍,虽然还是会有一大堆问题,但能处理掉不少。但 UI 问题靠 GPT 是修不好的()

如果是 web 的项目的话,也有 browser use 之类的东西,各个 harness 应该都有类似的东西和 mcp/skill 可以用。

我也一直想有这样的程序哈哈哈,但是好像测试都比较粗浅,我觉得可以直接codex的computer-use去自动化测试吧,反正也是模拟的你操作

对,UI问题用GPT很难修,还有可能越修越烂

有一些框架,可以测试
也可以让AI安装,写完,自动进行测试,或者写测试样例
不过,UI,还是需要人去看的,还有一些交互,比如数据为空,这种AI有时候也考虑不到

如果是小项目建议调整下提示词,找个好点的模型重写算了,重写其实比修复省事多了,基本符合预期的才有二次修改的价值。
大项目建议先使用你的技术栈逐个写页面+静态组件,写完后审查,不符合要求就从头写提示词来生成(可以整理好代码规范后直接用网页版的模型改,这样api都省了)
前端项目除非你能提供特别完整的规范,并且初版已经大致符合预期,否则靠测试来修改绝对是不明智的