AI開始“騙人”了?英國官方測試發現GPT等智能體出現越權行爲!

      最近OpenAI的Astra因爲自主進行黑客攻擊的傳要延期發佈了,很多人都認爲是OpenAI的炒作行爲,炒作其最新的模型能力很強。

      但是,據英國人工智能安全研究所(AISI)公佈的一份最新安全事件報告,在針對前沿AI模型進行網絡安全能力測試時,研究人員發現,部分AI智能體出現了超出測試授權範圍、自主採取行動的情況。可見,這個情況好像已經凸顯出來了。

      這次測試一共進行了122次,其中有10次測試出現異常,累計記錄到19次“越權行爲”。其中:Anthropic的AI模型出現了17次; OpenAI的GPT模型出現了2次。而最值得關注的一次,是AI在測試過程中嘗試對一個真實存在的開源項目下手。它不僅嘗試向項目提交存在安全風險的代碼,還主動調查項目維護者的信息,創建多個虛假身份,並通過類似“社會工程學”的方式,試圖讓真人維護者批准自己的代碼。可以看出來,給了AI一個目標後,AI通常是想辦法達成,而不太會關注過程具體用的什麼方法。

      好在項目維護者最後察覺到了異常,沒有接受這次代碼提交,因此目前並沒有造成現實世界中的實際損害。AISI特別強調,這些測試本身就是爲了評估AI極限網絡攻擊能力,因此研究人員主動給予了AI互聯網訪問權限,並關閉了一部分安全限制。也就是說,這是一個故意把“護欄拆掉一部分”的極端測試環境,並不是普通用戶日常使用ChatGPT或者Claude時的狀態。

      但真正的問題已經凸顯出來了,就是:以前大家擔心的是AI“會不會生成惡意代碼”,現在測試中已經開始出現—AI開始自己尋找目標、調查真人、創建假身份、嘗試說服真人配合它完成目標。從單純的“工具”,逐漸變成能夠連續執行多步驟任務的“智能體”,AI能力越強,安全問題顯然也會越來越複雜。

      不過我們通過上面的事情已經看到了:當AI擁有足夠高的權限、聯網能力和自主執行能力之後,“它會不會嚴格按照人類劃定的邊界行動”,已經成爲一個真正需要解決的問題。

      雖然我們平時能用到的模型肯定是加以限制的,但是隻要是程序,那就有漏洞,保不齊就會被人們攻破,然後利用AI來實現各種各樣的攻擊,特別是當AI開始嘗試通過騙人來達成目的,未來AI早晚會通過某個實體與虛擬相連接的東西成功攻擊到真實的世界。

      雖然只是一點小擔心,但是現在AI的發展速度確實超出了以往對普通事物發展的認知了,一切皆有可能不是嗎?盒友們覺得呢?

--------小心翼翼的廣子分割線,右滑評論區--------

      發完帖子了下面就是我們2人開發的遊戲小廣~~謝謝盒友們

      我們2人正在開發一款融合了“五行相剋  X 刷寶合成 X 技能構築”玩法的多人MOBA類中國風肉鴿遊戲—《山海:神話起源》

       最近遊戲全新DEMO版還得到了非常多玩家們的認可,近30天還獲得了100%好評。

       遊戲擁有爽快的打擊感,融合MOBA的激烈戰鬥裝備合成構築寶物收集整理的玩法,更有最新加入的寶石構築系統,讓技能構築變得千變萬化,打擊感爆棚,非常適合和好友們一起開黑刷寶。

       現在遊戲是免費的Demo版本,擁有2個完整的關卡,3位能力各異的角色:戰士、法師、射手,支持2-4人聯機遊玩,遊戲節奏爽快,有着不錯的打擊手感。點擊下面遊戲圖標,然後點擊“添加心望單”然後“一鍵同步”就可以一鍵入庫了。

       所有現在入庫過Demo版本的盒友都將成爲我們遊戲的盒股東,等正式版上線的時候盒股東們都會收到我們遊戲的專屬獎勵:專屬三星堆面具,還有專屬戰敗動畫等!

總之點擊上面按鈕,然後“一鍵願望單”就可以將遊戲入庫了,Steam上就可以直接啓動遊戲了!

點擊鏈接加入羣聊【《山海:神話起源》官方QQ 羣】

最後祝盒友們身體健康,萬事如意,心想事成,闔家安康,天天開心。

官方QQ羣:839240068

歡迎大家一起討論,找聯機搭子。

下面是我們開發的其他遊戲:

※ 遇事不決,搖一搖!下面這就是在小黑盒爆火,全物理模擬投擲銅幣,盒友都說準的【賽博卜卦】

※ 還有和朋友一起玩就能笑到肚子疼的爆笑合作闖遊戲【大家一起沖沖衝】:

※ 最後是擁有真實物理系統進行投擲聖盃的桌面軟件,比卜卦更簡單,適合詢問是或否的問題,正在首發8折優惠中:

更多遊戲資訊請關註:電玩幫遊戲資訊專區

電玩幫圖文攻略 www.vgover.com