大佬们平时是怎么用AI实现自动化测试的?现阶段的AI能接管测试工作吗?

问下各位佬平时在使用codex时,是怎么让AI帮忙测试功能的?:thinking:

我目前是TDD的流程,AI写功能之前会先写一个自动化测试接口,不过这个方法更多还是用来增加开发时的代码准确率的,没办法代替测试,所以最后还是要回归浏览器点击测试。

我有想过生成测试用例,然后嗲用codex的chrome插件,让他在浏览器里面自己点击测试,不过实际试了一下发现效率太低了,经常一个用例搞三四分钟,还白烧了一大堆token(我用的5.5xhigh):innocent:

不知道是用的模型的问题还是SKILL的问题,各位大佬这块是怎么解决的?有没有对应的SKILL?以及用什么模型跑测试比较好?5.6-luna-low怎么样?如果用5.4mini会不会出现测试搞错的情况?

请各位大佬指教!:saluting_face:

这个又费token又不能准确发现问题,可以去试试Playwright测试框架


skill现在基本上已经没什么用了,现在好一点的模型可以说都内置了skill,强行加skill反而还会增加token消耗
真要用的话就设置好 Workflow用 Workflow来渐进式披露skill
而且skill最好根据项目微调

[!success]会搞错的,尽可能用5.5吧,实在不行就grok4.5

是指codex自带的这个Skill吗?