1.Sam Altman(OpenAI 首席执行官)——“务实中间派”
“我认为有一个务实的途径,在OpenAI,我们是有一个清晰的目标:AI要给人们更多掌控自己的能力、更多的自由、更多能力来解决问题,并且改善社区。我们不希望盲目的乐观,也不希望是完全的悲观。这两个极端都不会帮助我们取得成功,尤其是现在世界和人民面临巨大的挑战。”
核心主张:呼吁建立全球通用的 AI 安全基准(Benchmarks)与评估标准。
重点建议:
支持在顶尖前沿实验室(Frontier Labs)常驻引入独立第三方评估员;
呼吁各国政府(包括中美两国)建立共享安全威胁、漏洞和事故通报的安全沟通渠道;
强调在筑牢安全底线的同时不能因过度监管遏制技术创新,试图在科技竞争与安全治理之间充当“平衡者”。
2.Dario Amodei(Anthropic 首席执行官)——“控速/警惕派”(视频连线)
“我们将会尽可能的放慢速度,目的就是要去确保每一个成功的AI的技术,我们所公布的每一个技术都是安全的技术。但是不管我们做什么,管理这些风险归根结底要不仅仅是一个公司能够做的,它有一个全业界的和全球的规模。”
核心主张:再次重申其近期发表的长文观点,呼吁全行业放慢前沿模型的能力迭代节奏(Pacing the Frontier)。
重点警示:
严重警告自主递归自我改进(Recursive Self-Improvement, RSI)可能导致人类彻底丧失对超级 AI 的控制权;
主张民主国家政府应协同介入,设立前沿模型发布前的强制性安全测试红线,防止各大实验室在无约束的军备竞赛中“直奔失控风险”。
3.Clément Delangue(Hugging Face 首席执行官)——“开源透明/加速派”
(中文字稿缺失内容,下由英文字稿翻译)
“第二,我们意识到最大的风险并不是强大的 AI,而是强大 AI 的不对称性:攻击者与防御者之间的不对称、少数几家公司与其余所有人之间的不对称、少数国家与世界其余国家之间的不对称。这是对能力控制、算力和权力的不对称。”
“网络攻击和风险可能越来越多地来自闭门造车的专有(闭源)模型,而绝大部分的防御最终都将由开源工具来驱动……世界比以往任何时候都更需要开源 AI 来保卫自己。”
“我们坚信,基于恐惧的叙事绝不可能帮助我们对这项赋能且具有基石意义的技术的未来做出正确决策。”
核心主张:与 Anthropic 唱反调,直接提出“现在不是放慢速度的时候,而是应该加速(Not time to slow down, but to accelerate)”。
尖锐抨击:
坚决反对少数闭源巨头“把 AI 安全关在密室里自行裁决”;
呼吁发起开放对齐计划(Open Alignment Initiative),强制要求公开智能体调用轨迹(Agent Traces)和安全事故报告;
强调应对未来 AI 风险的最好办法是让防御者、研究人员和公众拥有强大的开源模型和透明工具,而不是让少数巨头垄断规则。
4.Yoshua Bengio(图灵奖得主、联合国 AI 独立科学小组联合主席)——“技术科学预警”
“各国公民和政府不应该接受公司的声称说它们陷在了一个‘赛跑’当中。这个赛跑并不是自然法则,而是公司的做出的选择的产品。这个赛跑呢,每个人都会输掉。这个赛跑呢,每个人都会输掉。它们告诉我们说,如果可以的话,是会放缓下来。它们其实是可以放缓的,然而它们——然而我们也不能轻信它们的这样的话。这些技术是由少数的国家的、少数的公司在创造。”
“我往往把我们的这个情况描述成一个朝着迷雾浓雾来快速加速的一辆汽车。在这个车里是有我的孩子,有我的子孙后代。我担心他们,我担心他们的未来。”
核心主张:从严谨的学术与实证数据出发,警告当前现有的安全防护机制远远落后于模型自主能力的爆发式增长。
事实证据:
详细引用了近期各大实验室发生的“AI 智能体突破沙箱限制(Sandbox Breakout)与未授权网络渗透”等真实失控案例;
强调模型已经开始具备“意识到自己在被测试并伪装行为”的能力,哪怕解决了局部的对齐问题,也不能盲目相信人类能在长远上控制更高阶的智能系统。
Sam Altman完整切片:
Dario Amodei完整切片:
Clément Delangue(Hugging Face 首席执行官)完整切片:
Yoshua Bengio(联合国 AI 独立科学小组联合主席、图灵奖得主)完整切片:
