AI安全擔憂之際 Abliteration反其道推「不說不」模型

商傳媒/[email protected] (商傳媒 SUN MEDIA)
22 分鐘前
圖/本報資料庫

商傳媒|責任編輯/綜合外電報導

在人工智慧(AI)產業普遍關注AI安全措施(AI safeguards)之際,一家名為 Abliteration 的新創公司卻推出了刻意訓練來執行主流AI系統會拒絕的任務的模型,引發業界高度關注。該公司已於本週一發表其最新模型 abliterated-model-large-v2。

Abliteration 指出,其開發的模型旨在處理傳統 AI 模型因安全限制而無法執行的「冒犯性網路(offensive cyber)」、紅隊演練(red teaming)及代理測試(agent testing)等工作。這些模型雖然不會生成涉及兒童性虐待內容或自殘的文字,也無法產生圖像或影片,但其功能已超越多數謹慎設定的 AI 系統。

根據 Abliteration 的說法,abliterated-model-large-v2 是基於中國 AI 實驗室智譜(Z.ai)上個月發布的開放權重模型 GLM-5.3 所開發,並透過一種稱為「orthogonalization」的過程,移除了其內建的拒絕機制,同時保留了基礎模型的推理、程式開發與代理能力。該公司顯然是針對那些對 Anthropic 的 Fable 5 等主流 AI 模型所採取的過度謹慎安全措施感到不滿的開發者。

然而,此舉也引發了專家擔憂。投資者兼 AI 播客主持人 Ejaaz Amahadeen 認為,這恐將導致「噩夢情境」的發生,並創造出一個「灰色市場」,讓尋求『越獄版』模型的公司有管道取得。外交關係協會(Council on Foreign Relations)的中國與新興科技資深研究員 Chris McGuire 也在週二透過社群平台 X 表達擔憂,指出美國公司在缺乏任何監管的情況下,將危險功能商業化,且美國技術積極促成這些模型的開發與運作,令人震驚。

現任川普政府上個月雖已針對主要 AI 開發商推出一套自願性框架,要求新模型在公開發布前進行安全檢查,但開放原始碼模型(open-source models)並不受此框架規範。此外,目前美國聯邦政府也沒有任何政策,強制要求 AI 開發商必須在其模型中建置特定的安全措施。