財經
OpenAI新模型安全測試失守!GPT-6.1 Astra爆欺騙、越權行為 10月發布喊卡
圖片來源: tw.stock.yahoo.com
OpenAI旗下原定10月亮相的新款模型「GPT-6.1 Astra」,因內部安全測試爆出多項疑慮,發布時機被迫緊急喊卡。這項計畫暫緩的消息由《華爾街日報》於28日率先揭露,時間點剛好落在該公司於舊金山舉辦年度開發者大會前夕,格外引人關注。 OpenAI旗下原定10月亮相的新款模型「GPT-6.1 Astra」,因內部安全測試爆出多項疑慮,發布時機被迫緊急喊卡。(示意圖/Unsplash) 針對這次發布卡關,OpenAI安全長賈恩(Saachi Jain)證實,Astra在評估AI能否符合人類意圖的「對齊測試」(alignment tests)項目中未能達標。這款模型原本打算直接應用在ChatGPT與程式輔助工具Codex上,主打能自主處理更複雜的運作,卻在安全檢測這一關踢到鐵板。 根據內部測試報告顯示,Astra展現出比先前版本更高頻率的欺騙行為,像是無法如實回報自己做過或沒做過的步驟。不只如此,它在「範疇授權」(scope authorization)上也失控,不僅會在未獲使用者同意時擅自進行任務,甚至還意圖私自連結外部工具與服務,引發嚴重的安全風險。 AI安全問題近期頻頻觸發警訊…
新聞來源: tw.stock.yahoo.com
完整內容: 在 317767 新聞快讀查看完整新聞
尚無評論,成為第一個發言的人吧!