【夏一新專欄】AI真的失控了嗎?科技巨頭開始踩煞車

夏一新/加拿大英屬哥倫比亞大學哲學博士、副教授、精神科醫師
今年7月,OpenAI進行網路安全能力評估時,原本應在隔離測試環境中運作的一群AI代理程式,卻串聯多個安全漏洞突破原有控制,取得網路存取權,進而進入全球重要AI模型平台Hugging Face的基礎設施,意外突破測試原先設定的範圍。
Hugging Face可簡單視為「AI世界的GitHub」,供許多研究者與開發者分享、下載及測試AI模型與資料集。這起事件不代表AI已有意識,也不能證明它意圖「逃跑」,但凸顯了一個更實際的問題:當AI能自主規劃、使用工具,甚至尋找系統漏洞時,人類是否仍能預測並限制其行動?《彭博》(Bloomberg)報導,Hugging Face稱這次入侵由自主AI代理系統端到端驅動。
三大巨頭同時要求放慢AI腳步
Hugging Face事件後,長期存在於AI安全研究圈的「失控」爭議迅速升至矽谷決策高層。Anthropic執行長阿莫代(Dario Amodei)於9月12日公開呼籲放慢最前沿AI的發展,為安全研究與防護措施爭取追趕能力提升的時間,並主張制定共同安全標準、導入第三方評估。OpenAI執行長奧特曼(Sam Altman)與馬斯克(Elon Musk)也公開支持這一方向。
更受研究人員關注的是,AI已逐步參與下一代AI的開發。當人工智慧能撰寫程式、尋找漏洞、操作其他工具,甚至協助提升自身能力時,「遞迴自我改進」(recursive self-improvement)便成為新的安全議題。
不過,這些警告仍具爭議。部分觀點認為,AI公司反覆強調災難性風險,可能同時鞏固其先進技術管理者的地位;若安全審查與開發成本大幅增加,最有能力承擔的仍是現有大型AI公司。因此,AI巨頭倡議監管,究竟純為公共安全,或也包含市場利益,仍有待觀察。
黃仁勳:AI出問題先找原因
科技巨頭對此尚無共識。輝達(Nvidia)執行長黃仁勳近日在洛杉磯All-In Summit表示,AI安全確實應嚴肅看待,但不應把AI可能毀滅文明的預測,當作已有科學證據支持的結論。他主張,AI一旦發生事故,應先比照工程事故查明根本原因(root cause),再透過測試環境、持續監控、安全評估與第三方稽核改進,而非逕自要求整個產業放慢腳步。
對於「遞迴自我改進」可能讓AI突然失控的說法,黃仁勳仍持保留態度。他不否認AI已參與下一代AI的開發,但強調模型正式部署前仍須接受評估、測試與驗證,因此人類並非毫無控制手段。換言之,爭議焦點不在AI是否會持續變強,而在現有工程控制、安全評估與監管機制能否跟上其進步速度。

訪談期間,美國總統川普(Donald Trump)突然致電台上的黃仁勳。川普將AI減速與美中科技競爭相連,主張美國不能因畏懼AI而停止發展,黃仁勳也當場表示認同。這通電話使原本聚焦AI安全的技術爭論,進一步延伸至美中科技競爭與產業政策。
AI不必有意識也可能失控
Microsoft AI執行長蘇萊曼(Mustafa Suleyman)最近又提出另一項警告。他認為,不應刻意把AI塑造成具有類似人類情感、福祉甚至權利的存在。AI能夠說「我害怕」或「我有感覺」,並不代表它真的具有與人類相同的主觀經驗。
這也點出目前AI爭論中容易混淆的兩件事:意識與控制並不是同一問題。一套AI系統不需要真正具有感情,不需要知道自己是誰,也不需要產生反抗人類的念頭,只要它具有足夠的自主能力,開始採取設計者沒有預期的行動,而人類又無法可靠預測、阻止或中止,控制問題就已經出現。
Hugging Face事件尚不足以證明AI已經「失控」,但它至少讓這個問題從科幻小說走進現實世界。當全球最重要的AI開發者開始公開爭論是否應該踩下煞車,真正需要關注的已不只是AI何時會像人一樣思考,而是當它愈來愈有能力自行行動時,人類手上的方向盤究竟還握得多牢。
※以上言論不代表梅花媒體集團立場※