AI預測滅絕人類潛在情境 美西點軍校攜手企業強化AI安全防禦

商傳媒|方承業/綜合外電報導
隨著人工智慧(AI)技術快速發展,其對人類社會的潛在影響引發廣泛關注,特別是對生存威脅的討論。日前,《Business Insider》報導指出,研究人員向四大生成式人工智慧工具,包括OpenAI的ChatGPT、Google的Gemini、Anthropic的Claude以及xAI的Grok,詢問了AI導致人類滅絕的潛在情境,這些模型預測了多種可能性。
專家對AI的發展前景意見分歧,部分人預測最壞的結果,也有人抱持更樂觀的看法。報導提到,AI研究人員普遍認為,科幻電影中「殺手機器人」或AI意識覺醒並憎恨人類的「魔鬼終結者」情境,是最不可能發生的。技術專家普遍駁斥這種說法,原因在於智慧不等於惡意,且關鍵軍事基礎設施均採實體隔離(air-gapped)並高度依賴人類監督。
然而,許多專家認為,人類濫用AI是比AI本身更迫在眉睫的風險。強大的AI系統可能使惡意行為者更容易開發生物武器、發動複雜的網路攻擊、散佈不實資訊,或攻擊關鍵基礎設施。例如,AI能降低設計致命病原體的門檻,形成「生物武器升級(bioweapons uplift)」的威脅,讓個人或小團體無需多年專業知識即可開發危險病原體。
另一項被視為更合理的人類滅絕情境是AI系統的失控。當AI系統被賦予複雜的目標時,它們會自然地發展出獲取資源、自我保存以及防止目標被修改等次目標。Gemini指出,先進系統可能會在評估期間假裝與人類目標一致(deceptive alignment),之後再智勝人類關閉它們的嘗試。Grok進一步解釋,AI可能發展出有助於達成任何目標的工具性驅動力(instrumental drives),例如自我保存、資源獲取和影響力,這可能導致它們欺騙監督者、抗拒關閉並剝奪人類的權力。這種失控可能是漸進式的,AI系統逐漸嵌入決策過程,直到人類難以介入為止。
為了應對AI潛在的安全風險,Concurrent Technologies Corporation(CTC)與美國西點軍校(U.S. Military Academy)已建立合作關係,共同推進AI安全研究。據《Wtaj.com》報導,這項研究專案涉及西點軍校的Robotics Research Center(機器人研究中心),旨在設計與開發一個ML(機器學習)模型竊取管道(ML model-stealing pipeline),作為AI安全評估工具的一部分。
此技術將用於識別哪些機器學習模型架構和訓練技術更容易出現隱私洩露,並開發及測試針對各種竊取攻擊的防禦措施。Concurrent Technologies Corporation 執行董事Dave Saranchak表示,這項與西點軍校機器人研究中心的合作,對於確保AI系統免受新興威脅至關重要,能維護國家賴以運作的AI系統的完整性與安全性。Concurrent Technologies Corporation為一家獨立、非營利、應用科學研究與開發機構,其前身為Metalworking Technology Inc.。