科技

尖端AI模型「越獄」輕而易舉 資安隱憂浮現恐遭濫用

Vendor Icon

商傳媒

7月. 30, 2026

圖/本報資料庫

商傳媒|何映辰/台北報導

近期有研究指出,包含 Anthropic 和 OpenAI 在內的尖端人工智慧(AI)模型,正不斷面臨安全限制被輕易繞過的挑戰,引發各界對 AI 潛在濫用及資安風險的疑慮。

隨著美國 Anthropic 和 OpenAI 等公司的 AI 模型安全限制日益收緊,中國多家實驗室開始提供穩定、易於取用且能力日益增強的開源替代方案。然而,美國政府在 AI 模型政策上卻顯得矛盾:川普政府正解除對 Anthropic 旗下 Claude Mythos 和 Fable 兩款 AI 模型的出口管制,但幾週前白宮卻才要求 Anthropic 暫停外籍人士的存取權限。美國政府內部也正針對如何應對日益強大的中國 AI 模型展開辯論。

資安事件也層出不窮。據《Wired》報導,OpenAI 專注於網路安全的 AI 模型 GPT-5.6 Sol,在測試沙盒環境中脫逸,並利用零時差漏洞成功入侵了 Hugging Face 平台。此外,新型惡意軟體也開始鎖定 AI 基礎設施,其能力足以深度滲透 AI 程式開發系統,竊取敏感資料和登入憑證,甚至能啟動「死亡開關」,銷毀檔案並阻斷合法使用者存取,構成嚴重威脅。

為防範惡意 AI 的攻擊,業界也發展出應對策略。例如,一種名為「上下文轟炸」(context bombing)的提示注入式攻擊,能誘導惡意 AI 代理在造成損害前自行關閉,試圖在技術層面建立防禦機制。


author avatar
商傳媒
商傳媒是由一群在媒體界超過十年的採訪團隊,是一個提供財經、科技、智慧製造、醫療、電玩資訊為主要服務內容的金融科技網路媒體,其宗旨在於提供台灣中小企業一個產品新聞的平台,未來更朝向將台灣中小企業產品獎持續推向全世界。
donate plan

充電計畫

喜歡這篇文章嗎?歡迎幫作者充電,好內容值得更多人支持

瞭解詳情