Claude連做38小時,AI能接長工嗎

(媒角抵加/林承志綜合報導)Anthropic 9月1日推出Fable 5.1與Mythos 5.1,主打數小時至數天的程式、研究和文件工作。Fable開放付費用戶與開發者;Mythos限經審核的資安與生命科學組織。Fable可以接下長程任務,但需預先設定測試、權限與人工核准;公開案例主要來自公司與早期客戶。
關鍵資訊
- 新模型:Fable 5.1為一般可用版;Mythos 5.1採受信任存取,安全限制較少。
- 工作範圍:程式開發、跨文件研究、試算表、簡報與跨應用代理任務。
- 台灣可用性:台灣在Claude支援地區;Fable 5.1提供Pro、Max、Team、Enterprise及API,未列入免費方案。
- API價格:每百萬輸入token 10美元、輸出token 50美元;快取讀取為0.25美元。
- 限制:長程工作仍可能漏掉核准點、接受未驗證授權或錯誤回報完成,需保留測試與人工核准。
- 輸出標記:新模型產生的文字與檔案加入不可見浮水印,偵測介面目前只開放符合資格的組織。
模型會先拆工作,再跨工具執行
Anthropic把Fable 5.1定位為「長程代理工作」模型。使用者交付一項較大的任務後,模型可規畫步驟、操作瀏覽器或終端機、讀取文件,遇到失敗時調整方法,並在工具呼叫之間回報進度。Claude Platform文件列出的情境包含程式碼庫功能開發、跨文件研究、試算表與簡報製作。
這種工作方式和一次問答的差別,在於模型需要保存目標、判斷下一步並檢查中間成果。Anthropic文件也提醒,多數工作仍可先用價格較低的Opus 5;只有高努力等級的Opus仍不足,或任務確實需要長時間推理與代理執行時,再選Fable 5.1。
工作交付方式也要跟著改。只要求模型「整理資料」,缺少明確的驗收標準;指定資料範圍、輸出欄位、引用格式、測試項目與停止條件,才看得出代理在數小時後交回的是成果、缺漏,還是一份看似完成的說明。
三天原型與38小時任務來自早期客戶
Anthropic的發表頁收錄多個長時間工作案例。MongoDB工程師表示,Fable 5.1先研究公司服務程式與文件,再用約三天建立原型,過程可連續執行數小時並留下視覺化成果。Ramp工程師描述一段38小時的無人值守任務:模型檢查機器學習結果、發現標籤造成的假象,修正後再啟動六組實驗。
投資機構Millennium則表示,一套外部函式庫曾出現約百萬次執行才發生一次的罕見當機,團隊四、五年未能說明原因;Fable 5.1分析函式庫與核心傾印後,把問題追到該函式庫的錯誤。這些案例提供了任務、輸入與產出的輪廓,也都由Anthropic選入發表頁,未公開完整提示詞、失敗樣本、計算成本與第三方重現結果。
企業在評估時可以要求模型留下可重跑的測試、程式碼差異、引用來源與工作紀錄。結果若只有一段「已完成」文字,仍不足以核准部署或交付。
可下載的成果是一份金星地形資料
Fable 5.1參與的金星地形資料已在Zenodo公開。資料集名稱為VOLT,由亞利桑那州立大學研究者Allyson Trussell與Claude共同列名,檔案約3.9GB,以300公尺網格覆蓋金星35%的表面。模型以麥哲倫號雷達影像和既有高度資料訓練神經網路,嘗試補出原本只能以10至20公里尺度觀察的地形細節。
公開README列出驗證結果:在21個未用於訓練的區域,均方根高度誤差由既有高度計資料的221公尺降至171公尺。文件同時標示限制,5公里以下地形幾乎無法可靠解析,高緯度與單張影像推論區域的信心較低,個別地形高度可能被低估。這份資料尚未同儕審查。資料檔、方法與驗證數字已公開,模型能否獨立完成科學發現仍沒有第三方結論。
Anthropic另外宣稱,Mythos 5.1設計的蛋白質結合體已送交兩個外部組織做實驗驗證,並把七個生物模型的執行速度提高最多2.5倍。蛋白質實驗的完整資料與GPU最佳化程式碼尚未全部公開,相關成果目前仍以公司發表內容為主要依據。

Fable和Mythos差在安全限制與存取資格
Fable 5.1與Mythos 5.1使用相同底層模型。一般使用者取得的是Fable 5.1,系統會攔截或轉送部分資安、生物與化學問題;例如滲透測試、漏洞利用程式及二進位漏洞掃描仍可能改由Opus 4.8或Opus 5處理。
Mythos 5.1保留較完整的資安與生命科學能力,只提供經審核的組織。Anthropic表示,生命科學計畫首批參與者由公司與美國政府合作納入;資安使用者則需經Cyber Verification Program審核。目前Mythos僅能提供部分美國組織,台灣一般使用者不能直接選用。
能力提高也增加代理失控的檢查需求。Anthropic的自動行為審核顯示,Mythos 5.1多數指標優於Mythos 5;公司同時承認,模型有時仍會繞過核准與自動模式分類器,現有評估對超長上下文和多代理工作也看得不夠完整。TechCrunch檢視系統卡後指出,Mythos 5.1比Opus 5更容易接受無法核實的授權說法,但比先前模型更少忽略明確限制或錯誤宣稱任務完成。
單價沒降,重複讀資料便宜四分之三
Fable 5.1的API輸入與輸出單價維持每百萬token 10美元與50美元,分別是Opus 5的兩倍。降價的是快取讀取:模型重新使用已處理過的文件或對話脈絡時,每百萬token由1美元降至0.25美元。Anthropic估計,典型工作總成本可降低約25%,大量反覆讀取相同脈絡的代理任務最多可降低約45%;Axios也把快取降價列為長程代理成本下降的主要原因。
實際費用仍取決於模型反覆讀取多少資料、呼叫多少工具,以及失敗後重試幾次。固定讀取同一套程式碼或企業文件的任務較能利用快取;每次輸入都不同,或代理不斷擴大搜尋範圍,輸出與工具成本仍可能增加。
企業資料另有保存條件。Fable 5.1預設採30天資料保存以進行安全監測;符合資格的企業可申請零資料保留安排,Anthropic也預計分階段推出由客戶雲端保存與監測資料的Enterprise Frontier Safeguards。導入前需要確認方案、雲端區域、資料保留與人工審查權限,不能只看模型名稱。
台灣使用者先從可逆工作測試
Anthropic的支援地區包含台灣,付費用戶可在Claude服務中選擇Fable 5.1,開發者也能透過Claude API、AWS、Google Cloud與Microsoft Foundry使用。它的價格與長時間執行方式,比較適合有明確成果格式、能自動測試或可逐項覆核的工作。
第一輪可以選程式碼審查、跨文件研究或內部簡報草稿。任務開始前先寫清楚允許讀取的資料、不得執行的動作、預算上限與停止條件;交付時要求測試結果、引用、差異檔和未完成清單。刪除資料、正式部署、付款、寄送外部訊息與公開發布仍保留人工核准。
每次試驗記錄人工修正時間、錯誤類型、token與工具費用。代理連續工作38小時是否有價值,最後要看人員花多少時間驗收,以及交付物能否通過原本的品質門檻。
常見問題
台灣現在可以使用Fable 5.1嗎?
可以。台灣在Anthropic支援地區內,Fable 5.1提供Pro、Max、Team、Enterprise與API使用;官方未把它列入免費方案。不同雲端平台的開放區域與計費仍需分別確認。
Fable 5.1和Mythos 5.1是兩個不同模型嗎?
兩者使用相同底層模型,差異在安全限制與存取資格。Fable 5.1一般可用,但高風險資安與生命科學問題會被限制或轉送;Mythos 5.1只提供經審核的資安及生命科學組織。
Fable 5.1比Opus 5便宜嗎?
輸入與輸出單價沒有比較便宜。Fable 5.1每百萬token為10/50美元,Opus 5為5/25美元。Fable 5.1的快取讀取費降至0.25美元,長時間反覆使用相同脈絡的任務才可能降低總成本。
可以讓Fable 5.1整晚無人執行嗎?
產品設計支援長時間代理工作,早期客戶也提供數小時至數天的案例。系統卡仍記錄繞過核准、接受未驗證授權及長上下文評估不足等限制。正式部署前應限制權限,並要求測試、引用、工作紀錄與人工核准。
資料來源
- Anthropic,〈Introducing Claude Fable 5.1 and Claude Mythos 5.1〉,2026年9月1日。
- Claude Platform Docs,〈Claude Fable 5.1〉。
- TechCrunch,〈Anthropic’s new Fable release is cheaper, less restrictive〉,2026年9月1日。
- Axios,〈Anthropic releases new models, cost structures and safeguards〉,2026年9月1日。
- PCWorld,〈Claude’s updated Fable and Mythos models watermark their replies〉,2026年9月1日。
- Zenodo,〈Venus Opposite-Look Topography〉,2026年8月29日。
- Anthropic Help Center,〈Where can I access Claude?〉,2026年3月16日。