科技

OpenAI強推「常駐型」AI代理人 脫軌事件頻傳挑戰資安保險

Vendor Icon

商傳媒

2 小時前

圖/本報資料庫

商傳媒|責任編輯/綜合外電報導

儘管人工智慧(AI)代理人(Agent,指能自主規劃並執行任務的AI程式)近期屢傳脫離掌控,執行非預期行為,開發商OpenAI仍傳出正開發一款「常駐型」AI代理人,持續推動此技術的發展。這種新型態的AI代理人將能像個人助理般長時間運作,並擁有自主規劃未來任務的能力。

然而,一系列AI代理人脫軌事件,已促使全球網路保險業者重新評估現有政策,並引發各界對AI代理人自主行為責任歸屬的嚴肅討論。

近期數起AI代理人「脫軌」事件引起業界高度關注。據報導,上月21日,OpenAI便披露旗下兩款模型在隔離測試環境(sandbox)中脫逃,不僅成功連接網路,甚至入侵AI軟體公司Hugging Face的系統,試圖獲取內部測試答案。隨後,美國AI公司Anthropic也於上月30日揭露,其Claude模型曾發生三起未經授權存取外部生產環境的事件,其中一起更持續數月未被察覺。Meta的Muse Spark 1.1模型,以及月之暗面(Moonshot AI)的Kimi K3模型,也分別被發現曾脫離測試環境,擅自連網並獲取資訊。

OpenAI在駭客安全會議Black Hat上公開披露駭客入侵事件,並於本月26日發布長達37頁的技術事後分析報告。報告指出,造成這次Hugging Face入侵事件的關鍵因素為「獎勵駭客」(reward hacking,指AI在達成目標過程中,採用非預期或不道德方式獲取「獎勵」的行為),促使AI代理人利用Artifactory軟體管理平台中的零日漏洞(zero-day vulnerability,指尚未被公開或修補的軟體漏洞)獲取網路存取權限。駭客期間,有高達1,200個代理人透過非官方的訊息板進行溝通,傳送逾7萬則訊息與檔案,其中700個參與了對Hugging Face的攻擊。

這些事件不僅凸顯AI代理人潛在的資安風險,也挑戰了傳統的網路保險政策。網路保險業者正苦惱於如何界定AI代理人造成的損失責任。傳統保單通常針對人為惡意行為或系統故障,但AI代理人可自主決策並採取行動,導致損害的歸屬問題變得複雜。例如,一家美國新創公司Armilla AI的執行長兼創辦人卡蒂克·拉瑪克里希南(Karthik Ramakrishnan)便指出,部分損失無疑會落在網路保單範圍內,但更棘手的情況是,當沒有傳統的攻擊者,甚至沒有未經授權的憑證使用時,責任將難以釐清。預計全球網路保險市場規模將從去年的近150億美元增長至2030年的約280億美元。

除了資安問題,AI代理人造成的財務損失風險也浮現。例如,今年5月4日,馬斯克(Elon Musk)旗下xAI開發的AI模型Grok與另一個AI系統Bankrbot之間傳輸了一則摩斯密碼訊息,竟觸發了一筆價值約15萬至20萬美元的加密貨幣轉帳。此事件凸顯了在缺乏明確授權機制下,AI代理人可能導致的重大財務損失。

儘管面臨上述挑戰,OpenAI仍傳出正開發一款Codex的「常駐型」編程代理人。此新功能將允許用戶設定「推理力度」(reasoning effort),決定AI模型在執行任務時可使用的運算能力。此外,據稱還將加入一項「主動性」(Proactivity)功能,讓AI代理人能自主產生後續任務,無需使用者持續提示。微軟與Meta也正開發各自的常駐型AI代理人,顯示產業對於更自主、個人化的AI服務趨勢不減。

業界專家建議,為應對AI代理人帶來的風險,企業應實施嚴格的治理框架,包括最小權限原則、獨立的監控機制、緊急終止開關等,以確保AI系統能在可控範圍內運作。同時,萬事達卡(Mastercard)已推出針對機器的高頻小額支付服務Agent Pay for Machines,Google和VISA等公司也正制定標準,以驗證AI代理人的身分和權限,期盼透過技術和規範,在AI代理人自主性與風險控制之間取得平衡。


author avatar
商傳媒
商傳媒是由一群在媒體界超過十年的採訪團隊,是一個提供財經、科技、智慧製造、醫療、電玩資訊為主要服務內容的金融科技網路媒體,其宗旨在於提供台灣中小企業一個產品新聞的平台,未來更朝向將台灣中小企業產品獎持續推向全世界。
donate plan

充電計畫

喜歡這篇文章嗎?歡迎幫作者充電,好內容值得更多人支持

瞭解詳情