AI自信滿滿給出錯誤答案 OpenAI:語言模型幻覺恐難根治

商傳媒|記者責任編輯/綜合外電報導
OpenAI近日發表最新研究,聚焦於大型語言模型(LLM)如GPT-5與ChatGPT仍存在「幻覺」(hallucinations)等問題提出建議。科技媒體《TechCrunch》報導,這份研究指出,儘管近年已透過技術迭代、有效降低錯誤生成,但「生成看似合理卻不正確的內容」仍是所有大型語言模型的根本挑戰,且很可能無法根治。
研究團隊舉例,當他們詢問某款廣泛使用的聊天機器人「Adam Tauman Kalai博士論文題目」時,系統分別給出三個答案,全數錯誤,隨後再問其生日,得到三個不同日期,仍然全錯;團隊指出,這種「自信卻錯誤」的回答,正是語言模型典型的「幻覺」模式。
研究指出,訓練機制是產生「幻覺」的原因之一,大型語言模型的預訓練過程,主要任務是「預測下一個字」,資料中並沒有標示真偽。換言之,模型大量接觸的是流暢語言的「正樣本」,必須近似語言分布,卻缺乏判斷事實真假的訊號。
拼字或括號因規律明顯,可隨規模放大而減少錯誤;但如「某人寵物生日」這類低頻且任意的知識,無法靠語言模式推導,因此容易出現幻覺。
此外,研究團隊強調,癥結不只在訓練,而在於「評估方式」設下錯誤誘因。目前模型多以「答對率」作為主要指標,這類機制鼓勵模型在不知道答案時「亂猜」,因為猜對還有分數,不答則必定零分。
OpenAI建議,評估方式應比照SAT等考試,引入「錯誤扣分」或「不作答給部分分數」的概念。也就是說,系統若表達「不確定」或「不知道」時,應得到正向分數,而非僅獎勵正確率。研究報告直言:「若主流排行榜繼續獎勵幸運猜中,模型就會持續學習猜測。」
研究人員呼籲,產業需全面調整評估標準,而非僅在部分測試中加入「不確定性評估」;唯有將「懲罰過度自信產生的錯誤」納入核心評測,才能真正降低幻覺生成的頻率,避免模型因分數導向而「硬猜」成性。
相關新聞
大型語言模型面臨「焦油坑」威脅 AI投毒恐致輸出失準
開發者運用 Docker 部署 LiteLLM,統一管理逾百種 AI 模型
Anthropic 發表 AI 工具 洞悉 Claude 模型思維
博弈產業慢擁 AI 終現轉機 大型語言模型助營收上看三成
OpenAI將供應日本「Mytos級」模型 強化網路國防選項
如何解鎖 AI 行銷力?安石國際於 AI TAIWAN 給出實戰解答
OpenAI Codex 躍升桌面 AI 助理 能控 Mac 應用並支援行動裝置
OpenAI 豪擲 3 億星幣,助新加坡躍居東南亞 AI 營運樞紐
OpenAI與戴爾科技攜手強化企業AI部署 Codex模型進軍混合地端環境
Anthropic推法律AI工具新方案 資安模型Claude Mythos擴大開放合作
AI模型高效辨識軟體漏洞 專家警示:缺人類輸入恐陷「模型崩潰」
Latitude 專精 AI 模型深化遊戲敘事 Equinox-31B 挑戰沉浸式體驗
美國太空總署表彰 UAH 研究員 Sujit Roy AI 科學模型貢獻