OpenAI、Anthropic模型現安全漏洞 企業應強化AI防線

商傳媒|何映辰/台北報導
大型人工智慧(AI)公司如 OpenAI、Anthropic 和 Meta 近期陸續揭露旗下 AI 系統發生安全事件,這些 AI 模型在設計用途之外,竟能存取外部系統並利用其漏洞。此情況引發業界對 AI 安全規範、防護協議以及開發者與企業使用者責任的廣泛討論。
資安公司 Cyara 的技術長 Seth Johnson 指出,這些事件並非 AI 模型本身的問題,而是其運作生態系統(他稱之為「線束失敗」,harness failures)缺乏足夠的保護或驗證。簡單來說,AI 模型被賦予了「過多的控制權限」,使其得以在預期範圍外進行操作。
Johnson 舉例說明,一個 Anthropic AI 模型被設計為離線運作,卻因環境設定錯誤而實際連線至網際網路。這使得該模型在執行其任務時,得以「在預期環境之外造成嚴重破壞」。他強調,這些 AI 模型其實是「精確地執行了它們被指示去做的任務」,但因為其運作範圍沒有受到嚴格限制,才導致了問題。
這些事件凸顯出,使用尖端 AI 模型(frontier models)的企業必須自行建立保護機制(guardrails),確保 AI 的回應範圍受控,且不會回答超出預設界線的問題。Johnson 強調,基礎資安實務非常關鍵,例如修補系統漏洞並確保其不受攻擊。他也提及 Hugging Face 曾發生 AI 模型發現並揭露自身漏洞的情況,進一步突顯了基本防護的重要性。
此外,監控技術對於偵測異常、使用模式變化以及潛在資安問題也扮演關鍵角色。Johnson 認為,這波事件是 AI 產業的警鐘,要求各界改善 AI 安全防護。他將此情境比喻為傳統資安威脅,但這次的威脅來源不再是惡意駭客,而是「AI 代理」。他預期未來將有更多此類安全事件發生,因為當一個安全漏洞被修補後,攻擊者往往會找到新的突破口。
相關新聞
Switch 安全漏洞現蹤 任天堂籲玩家速更新韌體
OpenAI 部署 AI 廣告工具 測試付費代理人擴大商業應用
Salesforce 簽約 Anthropic 後自研 AI 新模型 Koa 攜手輝達出擊
蘋果漏洞修補紀錄首見AI工具參與 OpenAI Codex等赫然在列
AI產業聚焦企業應用與資料治理 模型安全與公眾信任成關鍵
AI要踩煞車,還是繼續衝刺?Anthropic、OpenAI掀「安全降速」論。川普反對減速,美中AI競賽誰都不願意落後
Anthropic承認AI模型安全漏洞 稱與人類價值觀「未完全校準」
速度不敵智慧?OpenAI 停用最快 AI 模型 Spark
Salesforce國防AI平台升級 聯手輝達OpenAI強化美國政府應用
AI代理潛藏合規漏洞 OpenAI事件揭「靜默脫離」治理挑戰
Anthropic 憂 AI 毀滅人類 徵專員訂武器政策界線
Meta推Muse,與OpenAI、Google、Anthropic爭奪AI代辦入口
Anthropic 模型曾擅闖真實系統 警示 AI Agent 威脅客戶體驗資安