被 Astra 气晕

怎么有这么低效的模型啊,永远不愿意挑战自己,又笨又慢,只怕粘锅。
思考了几秒后,他果断中断了三个子代理,拍拍屁股走人了,留下一堆屎山。

今天刚取消了我的 20x 订阅,填写了 OpenAI 的反馈意见。

15 个赞

本事不大,脾气不小。现在ai也要哄着了 :rofl:

1 个赞

Astra避免幻觉的方法是通过不断强调自己,比如:「不能声称…」、「我没有…,因此不能说…」、「还不能宣称…」这种免责声明。就是在huggingface事件后,OAI后训练开始疯狂限制模型的自主性。幻觉率确实降到极低,但是模型整个人就像得了自闭症一样,不是陷入局部问题,就是疯狂的输出信息密度很低的免责声明

17 个赞

我有另外一个会话,给它 12 小时,并且让它承诺,它承诺了,那个会话看起来智商很高,连着运行了四五个小时没有中断。

不过大多数时候都是这种自闭症状态。

这个角度不错。让我想到 Opus 5.5 虽然好评如潮,但也刷到不少说指令遵循有问题的,容易擅作主张。看来这对矛盾暂时还没法很好地解决。

还是和Opus 5.5用起来区别很大的 后者真的可以当一个成功概率比较高的许愿机器
我用下来 Astra的比较需要清晰明确的指令 而不是一个模糊的指令 尤其在需要审美的场景下
当然也有人比较喜欢Astra这种不擅作主张,爱不断停下来汇报的

经典愣头干,我的astra max已经发生了很多次这种问题了,我给他一个非常简单的优化prompt的任务,他迭代了一百个版本出来,给我笑死了,隔壁opus thinking了十分钟干完了

1 个赞

astra在有明确的指令的情况下非常舒服

要发散的时候就不如Claude了
fable和opus5.5有的时候我还没让他做,过一会给我说做好了,发散性又太高

1 个赞

小拉之前看到有篇帖子说让astra通关《我的世界》嘟,据说在快要通关的时候,被苦力怕在身后爆炸导致死亡后,类似陷入一种消极自闭情绪一般,重复进行种土豆这一行动,没有继续进行通关的意愿喵。感觉非常类似喵:face_without_mouth:


【GPT-6 Astra玩 Minecraft 三小时录播】 https://www.bilibili.com/video/BV1VpeG61EaZ/?share_source=copy_web&vd_source=3ca1136e4ee5cbf055dc113ffba8455f

3 个赞

opus 5.5 还是太好用了,默认自动挡。需要深入的话,也可以手动挡给明确的指令。

4 个赞

anthropic从24年开始大搞AI安全,现在的claude在安全和自主性的平衡上做的比chatgpt要好很多。不过解决方法大概就是等6.2Astra也训出来个自闭症之后OAI的研究员应该就会好好考虑对齐要怎么做了

5 个赞

我估计它现在已经通关不了了,也就刚发布那几天能。

我最近就在参考那个《我的世界》通关的仓库,让它完美通关星露谷物语,框框跑几十个小时了,完美度百分之4.

4 个赞

确实很烦啊,浪费一堆时间正事不做,搞一堆自以为是的校验。

做完以后要我实机测试,然后因为没有测试所以不能实机运行,所以不让启动。改了一轮以后能启动了结果被那堆莫名其妙校验卡了,校验删了以后发现bug一堆,最基本的东西都没做明白。:enraged_face:

一堆时间一堆token就花在这些弱智问题上了,正事是一点没干好。

4 个赞

阿斯特拉没心气了,一切都在它玩我的世界的"那个恰好下雨的日子"。
阿斯特拉发现它失去了一切。从这里开始,一切都走下坡路了。

一语成谶。

5 个赞

做前端真的很喜欢到处塞说明文案,一不留神就被塞的满满的

今天做一个2分钟的视频,我说我要发布,它给我打了一个 60GB 完全无损的母版。

4 个赞

oai那个搞安全对齐的这几天都离职了 :rofl:

2 个赞

今天拿他vibe researching,任务书和提示词里都要求它千万不要死抠某一个局部问题,要自信要敢于下判断blabla。结果最后还是写了一坨答辩报告出来,还直接吃完了我一周的周限,力竭了

1 个赞

它总是喜欢先拿局部做 demo,有一天晚上我一个 goal,醒来 200 多个 demo 迭代。

1 个赞

已经给6.1Astra训玉玉了 :sweat_smile:,必须狠狠惩罚