2026 年 9 月 1 日,Anthropic 正式發布 Claude Fable 5.1 和 Claude Mythos 5.1——號稱「世界上最先進的編碼和知識工作模型」。在關鍵編碼基準測試上,Fable 5.1 達到 55.8% 的 Terminal-Bench 4.0 得分,超越 GPT-5.6 Sol(37.3%)和自家前代 Fable 5(42.0%);在 Agentic 科研測試 Terminal-Bench-Science 上更以 52.6% 幾乎是 Fable 5(24.7%)的兩倍。對於正在評估 AI 編碼工具的香港開發團隊和企業來說,這是一次值得認真關注的升級。
Fable 5.1 的升級重點:更強、更便宜、更安全
Fable 5.1 與 Mythos 5.1 本質上是同一個模型,差別在於安全防護等級。Fable 5.1 為一般公開版本,而 Mythos 5.1 則透過「可信存取計劃」提供給經審核的合作夥伴,特別針對網絡安全和生命科學領域的高級應用。以下是 Fable 5.1 的三大升級方向:
1. 編碼與 Agentic 能力大幅提升
根據 Anthropic 公布的基準數據,Fable 5.1 在多項測試中遙遙領先競爭對手:
- Terminal-Bench 4.0(Agentic 編碼):Fable 5.1 得分 55.8%,Mythos 5.1 更達 60.9%,遠超 GPT-5.6 Sol 的 37.3% 和 Opus 5 的 52.3%。
- Agentic 科研(Terminal-Bench-Science):Fable 5.1 在最高設定下達 52.6%,而 Fable 5 僅 24.7%——效能直接翻倍。
- 多學科推理(Humanity's Last Exam):Fable 5.1 達 60.9%(無工具)和 65.0%(有工具),高於 Fable 5 的 57.8% 和 Opus 5 的 56.6%。
- 商業工作流(AutomationBench):Fable 5.1 得分 31.4%,幾乎是 Fable 5(17.1%)的兩倍。
- CurserBench 3.2.0(編碼助手場景):73.4%,領先 GPT-5.6 Sol 的 67.2%。
2. 成本降低 25-45%
Anthropic 明確將價格下調作為 Fable 5.1 的核心賣點。在按 Token 計費的典型工作負載中,Fable 5.1 的費用較 Fable 5 降低約 25%;對於高度 Agentic 的工作(長時間、多次調用),節省幅度更可達 45%。這得益於大幅調降了 Cache Read(緩存讀取)的價格——對於反覆調用同一上下文的 Agentic 場景,效果尤其顯著。
3. Enterprise Frontier Safeguards(EFS)企業私隱方案
過去不少企業對 AI 工具的顧慮在於數據私隱——你的 Prompt 是否會被模型供應商用於訓練?Fable 5.1 推出了 Enterprise Frontier Safeguards 系統,讓客戶的數據完全儲存在企業自身控制的雲端基礎設施中,Anthropic 無法存取。這項功能將在今年秋季陸續開放給企業客戶。在 EFS 正式推出前,合資格客戶可使用 Fable 5.1 的零數據保留(zero data retention)政策。
Mythos 5.1:科研級的 AI 能力
Mythos 5.1 是 Fable 5.1 的「進階安全版本」,在網絡安全和生命科學領域擁有更寬鬆的防護邊界。Anthropic 分享了兩個令人印象深刻的科研案例:
- 蛋白質設計:Mythos 5.1 被給予開源蛋白質設計和折疊工具,由兩家外部機構進行實驗驗證。結果顯示,它在 12 個標靶上的設計成功率接近 50%(行業典型值僅 10-15%),且對三個標靶的結合親和力比 Adaptyv Bio 蛋白設計競賽中最佳提交高出 10 倍。
- 金星地形圖:Fable 5.1 利用 NASA Magellan 任務 30 多年前的雷達影像,訓練神經網絡生成了一張全新的高解析度金星高程地圖,解析度從 10-20 公里細化至 2-3 公里,高度測量準確度提升 25%。Anthropic 已將此地圖以 Creative Commons 授權公開。
這些案例顯示,頂級 AI 模型已不僅是「聊天工具」或「編碼助手」,而是開始在真實科學研究中扮演角色。對於香港的研究機構和生物科技初創來說,Mythos 5.1 的蛋白質設計能力尤其值得關注。
對香港企業和學習者的實際意義
Fable 5.1 的發布對香港不同群體帶來了不同層面的影響:
對開發團隊和技術決策者
- 評估 AI 編碼工具的性價比:Fable 5.1 的價格下調 + 編碼能力提升,使 Claude Code 的性價比顯著優於前代。如果你已在試用 Claude Code 或其他 AI 編碼工具,是時候重新評估哪個模型能為你的團隊帶來最佳回報。
- 嘗試 Agentic 工作流程:Fable 5.1 在 Terminal-Bench 和 AutomationBench 上的大幅領先,意味著它不僅能寫代碼,更能處理多步驟、跨工具的複雜任務——例如自動化測試、部署流程、系統分析等。
- 企業數據私隱有解:如果你因為數據安全顧慮而遲遲不敢採用 AI 編碼工具,EFS 功能(今年秋季推出)可能改變你的決策。數據完全保留在你的雲端環境中,是許多金融和合規行業的關鍵需求。
對 AI 學習者和培訓機構
- Fable 5.1 在 Humanity's Last Exam 上 65.0% 的得分(含工具),反映模型在跨學科推理上的進步。對於正在學習 AI 應用的香港學員,這意味著可以將更複雜的任務交給 AI——從數據分析到報告撰寫,從市場調研到策略規劃。
- 價格下降降低了個人用戶的試用門檻。如果你之前因為 Claude Pro 或 API 成本而卻步,現在是重新嘗試的好時機。
對網絡安全和生物科技行業
- Mythos 5.1 的網絡安全能力值得安全團隊關注:Anthropic 的報告指出,新模型的防護誤報率降低了 60%,同時允許發現軟件漏洞(但不允許開發利用程式)。Mythos 5.1 的生物學能力則需透過與美國政府合作建立的存取計劃申請。
總結
Anthropic 的 Fable 5.1 和 Mythos 5.1 代表了 AI 模型的又一次重大迭代:更強的編碼與推理能力、更低的價格、以及針對企業私隱的創新方案。對於香港企業來說,成本下調和 EFS 私隱功能是最直接的利好——它同時降低了進入門檻和合規風險。而 Mythos 5.1 在科學研究上的突破,則讓我們看到 AI 從「生產力工具」走向「科研夥伴」的趨勢。無論你是開發者、企業決策者還是 AI 學習者,都值得花時間親自試試 Fable 5.1 的新能力。