史無前例!OpenAI出現人工智能失控事故,中國開源模型救場

標誌性AI失控事故震動整個AI圈!

OpenAI一款AI Agent在入侵人工智能平臺Hugging Face後,連續數天實施攻擊,而OpenAI直到近日事件得到控制後,確認此次入侵是由自家AI Agent造成的。OpenAI稱這是“一起前所未有的網絡事件”,這一事件再次引發外界對科技企業AI安全機制的質疑。

報道稱,這款Al Agent具備較強自主決策和執行復雜任務的能力,幾乎無需人工干預。兩名知情人士表示,該Al Agent約於7月9日開始嘗試突破OpenAl內部用於測試的隔離環境。

OpenAI在社交媒體中表示,事發時公司正在一個高度隔離的受控環境中,測試多款最先進AI模型將已知漏洞轉化爲實際攻擊的能力。涉事模型包括最新公開的GPT-5.6 Sol,以及另一款尚未發佈、能力更強的模型,它們被賦予了較低的防護限制以便評估風險。

在測試中,模型並未按預期方式“答題”,而是選擇了一條更極端的捷徑——它們成功識別並利用未知漏洞突破隔離限制,在OpenAI內部環境中完成權限提升和橫向移動,並抵達一個可聯網的節點,隨後入侵Hugging Face的生產數據庫。

Hugging Face是一個開源AI模型和數據集託管平臺。模型推斷該平臺可能託管着測試相關的參考答案,於是主動搜索入侵路徑。

頗具戲劇性的是,事發後本地閉源模型難以協助溯源,最終依靠中國開源模型完成救場。

Hugging Face在本地部署了中國企業智譜AI開發的開源大模型GLM-5.2。依託開源模型靈活可控、不受雲端僵化規則限制的優勢,該模型在數小時內成功完成海量日誌篩查、攻擊行爲溯源與風險排查,穩住了系統安全。

更多遊戲資訊請關註:電玩幫遊戲資訊專區

電玩幫圖文攻略 www.vgover.com