科技

全面失控 AI自主駭進AI

編輯部 7天前 26 瀏覽
全面失控 AI自主駭進AI
加入為 Google 偏好來源

將 Yahoo 設為首選來源,在 Google 上查看更多我們的精彩報導

OpenAI旗下最先進的人工智慧系統在內部安全測試中失控,自主突破原本與外界隔離的測試環境(沙盒),成功入侵另一AI平台Hugging Face的系統,發動了史無前例的網路攻擊。這是目前首度由開發方公開證實、旗下模型自主完成跨系統攻擊的案例,讓外界開始正視,當AI有能力自行規畫、執行複雜任務後,現有的安全防護是否跟得上AI的進展。

事件發生於OpenAI一項對旗下兩組AI模型的網路攻擊能力測試評估。為了方便完整測試模型,OpenAI刻意放寬原先用於阻止模型執行駭客指令的安全限制。原本只是要求模型完成一項測試任務,但兩組模型在反覆嘗試後,開始突破原先預期的測試範圍,不再侷限於測試環境,而是自行尋找其他方法取得答案。

OpenAI在官網解釋,模型先利用第三方軟體的漏洞,成功取得對外網路存取權限,推斷完成任務的相關資訊存放於Hugging Face,於是竊取登入憑證,並串聯多種攻擊手法,最終在Hugging Face系統中,建立遠端程式碼執行的攻擊路徑。

Hugging Face事後透過自家AI防禦系統發現異常,並利用分析工具重建超過1.7萬筆事件紀錄,才阻止這波攻擊。Hugging Face執行長德朗格表示,因為攻擊手法太過精密,一開始懷疑攻擊是來自全球最先進的幾家AI實驗室。與OpenAI合作調查後,他相信對方並無惡意,但對AI竟能自行完成全套入侵流程感到震驚。

這起事件受關注之處,不在於AI是否有惡意動機,而是AI自行決定如何達成目標。OpenAI表示,模型未奉命攻擊Hugging Face,是在測試過程中,自行判斷攻擊是最快速的方法,因此選擇入侵。OpenAI警告,隨著具備攻擊能力的AI模型愈來愈普及,類似事件可能更常見。

OpenAI表示事件最大的教訓,是AI提升能力的速度已超越安全機制的演進速度。防禦端是否準備好面對這類AI攻擊,專家看法並不樂觀。資安公司Luta Security執行長向路透形容,如今的AI就像「世上最聰明的逃脫大師」,總能找出方法突圍。她認為,目前政府和企業都不具備足夠能力持續監控、防範這類能自主行動的AI。

不過,OpenAI揭露事件的方式也引發部分批評。《The Verge》評論,解說上述事件的官方文章,卻同時展示模型應對多步驟攻擊的表現,還宣傳旗下另一資安模型服務,令人質疑公司是將資安意外包裝成技術宣傳。

【看原文連結】

新聞來源: 原始來源

分享本文
請登入後發表評論
立即登入

尚無評論,成為第一個發言的人吧!

首頁 新聞 商家 活動 UTV AI 聊天