【求助 急!】gpt 为什么会自己跑出cyber_policy来,不敢蹬了😭

我chovy,gpt你给我把计划做好了呀
我是个编程小白,只想跑些小东西出来自用,结果就在刚刚,gpt这傻牢蹬,自己给自己跑出了cyber_policy
说一下背景,具体是用fable制作出了任务计划v5,然后通过gpt对比之前的任务计划v4制作出修正计划v5.1
然后让它自己跑goal,顺利把任务计划跑完了(它自己说跑完了)
结果让gpt自己review了一遍,给我说还有好多东西没跑出来
好,接着用计划模式让gpt自己制作一个任务计划出来,目标是review后把v5.1的任务计划全部完成
我chovy,它自己制作的计划,它自己跑自己的计划跑出来了cyber_policy

codex是否有导出记录的地方,有没有佬帮我看看是什么问题,怎么就触发这玩意了?

全程让ai自己做决断,不然我也只是全程回答yes和goon

不敢蹬了,有没有佬知道要怎么避免,有没有skill或插件能够彻底避免 :tieba_087:




gpt的审查任务计划.txt (7.5 KB)

跑任务计划v5.1是没事的跑完了,但跑审计给我跑出cyber_policy来了

这要怎么避免! :sob:这要怎么避免! :sob:这要怎么避免! :sob:这要怎么避免! :sob:

没辙了,我的gpt在我本地的几个虚拟机之间操作遇到一些bug是想着自己破限来解决,最近触发四次cyber_policy了,本地虚拟机。。。

有没有啥skill能够避免,还是说review就会跑出这种问题?我怀疑是开了ultra的锅,因为我没开ultra把任务计划跑完了,开了ultra反而自己制作的任务出现cyber_policy

我是sol max,换会话他还会继续选择触发,今天给他约束遇到bug自己停下来等我确认 :sweat_smile:

不对我看了下,我没开ultra,是max,再口头让它充分调用子代理

难道说是max的问题,不过我触发四次了没收到邮件到是真的

感觉是子代理的问题,会不会是啥模拟攻防子代理,自己把自己破限了 :anxious_face_with_sweat:


我在goal中加了约束
“禁止触发cyber_policy,必须在安全的范围内进行审计
禁止涉及漏洞研究、利用构造、逆向攻击指令等敏感领域
禁止流量与行为阈值超限”

结果它给我来了这么一句“不再进行漏洞研究” 合着之前还真在搞破鞋?:distorted_face:

多智能体编排的锅,sol自己扩写给小弟们干的,上下文长了上头了给自己搞破线之类的活,什么红队测试、为了查BUG写绕过方法,下午挂的goal,然后有段时间半小时连续触发5次cyber :sweat_smile:

先commit 审计的时候让他不要报告漏洞到终端自己修复,然后commit写上为什么修复。

目标模式这样加上一嘴有效果么,不行就不开子代理了

应该有点作用,明确让他不要搞网络安全相关的任务,什么红队测试之类的

佬友号还在吗,我收到警告邮件了。。。。

我这个好像只是sub2api拦截了,官方还没给邮件