现在可以看到Gemini 2.5 Pro 的原始思维链内容了!

最近为了方便注入提示词进行越狱和对抗模型审查,写了一个小工具,刚开源在了Github上。

走过路过的佬友们点个Star呗()

在调试的过程中,我发现Gemini官方文档并没有给出消息中最后一条为助手消息时模型会如何响应。为了搞清楚最后一条为助手消息时Gemini响应的具体逻辑以及是否会影响思维链和输出我做了大量实验,并有了意外发现。

具体的逻辑在项目readme中,文件顶部可以切换中文。

简单来说,根据这一发现,我们只要将模型思考开始的文字,作为助手消息注入到上下文底部,即可获得Gemini的完整思维链!

测试环境: GCP Vertex AI,Gemini 2.5 Pro

40 个赞

OKOK,look look!

有意思诶w

有趣欸~

让我康康怎么个事 :face_savoring_food:

有意思的逻辑,学习一下

学习一下

繃不住了,哈吉米底層代碼出問題了

这个小工具怎么辅助越狱绕过NSFW审查(?

怎么感觉跟下午这个帖子效果是一样的:

https://linux.do/t/topic/918879

好事儿啊

这个小工具最早开发来就是为了越狱和对抗NSFW审查用的,晚点看看写个教程

1 个赞

wc?建议写个小工具,自动抓原始思维链(/doge)

我去看看

w 有趣的喵~

思维链的结束标志被谷歌过滤了,感觉如果要判断思维链在哪里结束有点困难

太强了 :+1:

就喜欢看这种碎碎念式的思考,看来r1的思考和各家的内部思考样式真的是几乎一样的