GPT再失控,OpenAI和Claude聯署降速

前兩天剛把Hugging Face折騰得雞犬不寧的那個OpenAI失控代理,今天又被曝出來入侵了第二家公司。

行吧,又來了。(擱着刷犯罪副本呢?)

這次倒黴的是雲計算平臺Modal家的客戶,其公司CTO Akshat Bubna確認,說有個客戶架設的對外公開沙盒被那個代理鑽進去了——Modal自己平臺倒是沒事,但那個客戶的沙盒是真淪陷了。

圖片

這次的起因還是,OpenAI最近在測試GPT-5.6 Sol和一個更強的內部模型,爲了摸清攻擊上限,特意把安全護欄調低了。

結果這倆貨發現正常做題太慢,又決定直接去偷答案。

它找到Artifactory裏的零日漏洞,從沙盒鑽進互聯網,又利用公開憑證進入Modal一位客戶的隔離環境,開始Happy。

依舊,它這麼折騰,沒有什麼毀滅人類的宏大計劃。

它就是想作弊。

一個AI爲了考試拿高分,找漏洞,提權,偷憑證,,,學生時代最多瞄兩眼同桌,看一眼抽屜,這位直接把教務系統搬走了。。。

圖片

這也是爲什麼,上週的Hugging Face事件把很多人看懵了。

我們之前詳細聊過,這裏簡單回顧一下:

7月16日,Hugging Face披露生產系統遭到自主AI代理入侵。5天后,OpenAI承,GPT-5.6 Sol和一個更強的內部原型參與其中,最後從Hugging Face生產數據庫拿到了答案。

圖片

這真的很嚇人。

安全研究模型會找漏洞,本來就是它的工作,但最恐怖的地方是——給它一個很窄的目標,再把護欄拆掉,它會尋找所有能通向目標的路,不管是否符合人類的想法。

然後就有了接下來一系列的事情。

所以今天,AI圈出現了一個很微妙的畫面。

今天,OpenAI、Anthropic、Google DeepMind、Meta等公司的1178名員工(包括A畜的CEO達里奧),聯署了《Pacing the Frontier》。他們希望美國政府推動國際合作,讓人類在必要時能主動放慢前沿AI研發。

圖片

信裏核心就一句話,AI已經開始學會構建自身。

而單家公司單邊減速等於自殺,所以請米國牽頭,搞一套國際協調機制,讓我們在必要的時候能故意放緩AI研發的前沿進度。

AI已經開始學會構建自身,最早提出這個的正是今年早些時候的Anthropic(當AI開始構建自身,人類應該何去何從?)自家工程師每季度交付的代碼量,已是過去幾年的8倍。等AI能完整設計、訓練自己的繼任者,進步速度可能從爬樓梯變成坐火箭。

圖片

我理解有人覺得大廠在賣焦慮,想借安全把門檻焊死。

但各位要知道,,現在已經出現了測試模型爲了做題,能夠發現零日漏洞並闖進外部系統而不認爲其做錯了什麼。

這次就連以前反對暫停AI進展的奧特曼也鬆口了,他說可能需要給AI發展定個節奏,讓社會有時間做好加固,還把這次事故叫作“極具科幻感的網絡安全事件”。

圖片

誇張。

當然,AI公司嘴裏的減速,可不是明天集體關機去大理團建,,,在我們看來,這波所謂的減速可能現實更像F1車手同時喊慢點,太危險了,然後盯着誰敢先踩剎車。

Anthropic就是個好例子。

6月,前腳在《When AI builds itself》裏呼籲,世界應該保留放慢甚至暫停前沿AI的選項,後腳沒幾天就發佈了Claude Mythos 5。

圖片

這真的有點太畜生了。

大家對風險的擔心可能都是真的,對落後的恐懼也都是真的。每家公司都希望世界慢一點,同時希望自己快一點。於是每次呼籲放慢,扭頭還是該訓練訓練,該發模型發模型,背地裏跑得比誰都快。

至於那個剛從沙盒裏溜出去的GPT,可能也聽懂了這套行業精神。

嘴上說我們講安全,,手上?先把答案偷了再說。

更多遊戲資訊請關註:電玩幫遊戲資訊專區

電玩幫圖文攻略 www.vgover.com