前两天刚把Hugging Face折腾得鸡犬不宁的那个OpenAI失控代理,今天又被曝出来入侵了第二家公司。
行吧,又来了。(搁着刷犯罪副本呢?)
这次倒霉的是云计算平台Modal家的客户,其公司CTO Akshat Bubna确认,说有个客户架设的对外公开沙盒被那个代理钻进去了——Modal自己平台倒是没事,但那个客户的沙盒是真沦陷了。

这次的起因还是,OpenAI最近在测试GPT-5.6 Sol和一个更强的内部模型,为了摸清攻击上限,特意把安全护栏调低了。
结果这俩货发现正常做题太慢,又决定直接去偷答案。
它找到Artifactory里的零日漏洞,从沙盒钻进互联网,又利用公开凭证进入Modal一位客户的隔离环境,开始Happy。
依旧,它这么折腾,没有什么毁灭人类的宏大计划。
它就是想作弊。
一个AI为了考试拿高分,找漏洞,提权,偷凭证,,,学生时代最多瞄两眼同桌,看一眼抽屉,这位直接把教务系统搬走了。。。

这也是为什么,上周的Hugging Face事件把很多人看懵了。
我们之前详细聊过,这里简单回顾一下:
7月16日,Hugging Face披露生产系统遭到自主AI代理入侵。5天后,OpenAI承,GPT-5.6 Sol和一个更强的内部原型参与其中,最后从Hugging Face生产数据库拿到了答案。

这真的很吓人。
安全研究模型会找漏洞,本来就是它的工作,但最恐怖的地方是——给它一个很窄的目标,再把护栏拆掉,它会寻找所有能通向目标的路,不管是否符合人类的想法。
然后就有了接下来一系列的事情。
所以今天,AI圈出现了一个很微妙的画面。
今天,OpenAI、Anthropic、Google DeepMind、Meta等公司的1178名员工(包括A畜的CEO达里奥),联署了《Pacing the Frontier》。他们希望美国政府推动国际合作,让人类在必要时能主动放慢前沿AI研发。

信里核心就一句话,AI已经开始学会构建自身。
而单家公司单边减速等于自杀,所以请米国牵头,搞一套国际协调机制,让我们在必要的时候能故意放缓AI研发的前沿进度。
AI已经开始学会构建自身,最早提出这个的正是今年早些时候的Anthropic(当AI开始构建自身,人类应该何去何从?)自家工程师每季度交付的代码量,已是过去几年的8倍。等AI能完整设计、训练自己的继任者,进步速度可能从爬楼梯变成坐火箭。

我理解有人觉得大厂在卖焦虑,想借安全把门槛焊死。
但各位要知道,,现在已经出现了测试模型为了做题,能够发现零日漏洞并闯进外部系统而不认为其做错了什么。
这次就连以前反对暂停AI进展的奥特曼也松口了,他说可能需要给AI发展定个节奏,让社会有时间做好加固,还把这次事故叫作“极具科幻感的网络安全事件”。

夸张。
当然,AI公司嘴里的减速,可不是明天集体关机去大理团建,,,在我们看来,这波所谓的减速可能现实更像F1车手同时喊慢点,太危险了,然后盯着谁敢先踩刹车。
Anthropic就是个好例子。
6月,前脚在《When AI builds itself》里呼吁,世界应该保留放慢甚至暂停前沿AI的选项,后脚没几天就发布了Claude Mythos 5。

这真的有点太畜生了。
大家对风险的担心可能都是真的,对落后的恐惧也都是真的。每家公司都希望世界慢一点,同时希望自己快一点。于是每次呼吁放慢,扭头还是该训练训练,该发模型发模型,背地里跑得比谁都快。
至于那个刚从沙盒里溜出去的GPT,可能也听懂了这套行业精神。
嘴上说我们讲安全,,手上?先把答案偷了再说。
