Rex Tsang

Anthropic創造神話及寓言

Economy & Market


Anthropic在2026年6月初同一天發布了兩個模型:Claude Fable 5 與 Claude Mythos 5。 Mythos 來自希臘語,意思是「神話」:Fable來自拉丁語,意指「寓言」。神話被改寫,被濃縮、被加上訓誠之後,就變成了寓言。而這兩個模型之間的關係,正是如此。


image



共享權重 一個大腦兩種人格

它們共享完全相同的底層權重。Fable 就是 Mythos 5.只是被裝進了一層安全「圍欄」。遇到高風險領域的請求,系統就自動交由Opus 4.8處理。同一個大腦,兩種人格。一個向公眾開放。一個只對特定合作夥伴開放。然而,這一個決定所引發的漣漪,正在動整個AI產業的權力結構。

在软件工程標杆 SWE-Bench Pro 上,Fable. 拿下80.3%,遠超Opus 4.869.2%,更把GPT- 55 58.6%遠遠甩在身後。


Fable一日還移5000萬行程式碼

另外,在 Cognition推出的 FrontierCode Diamond這一個測試「程式碼能否被真實開源專案接受並併入主幹」的極難標杆,Fable取得 29.3%,而Opus 48僅13.4%,至於GPT-5.5更只有5.7%。

更令人震撼的是真實世界之驗證。Anthropic 為案例,在一個5000萬行程式碼的 Stripe Ruby資料庫中,Fable 5用一天時間完成了全庫遷移,而這項工作原本需要一整個團隊耗時兩個多月。

在生命科學領域, Mythos 5獨立執行生物學家的完整研究流程,設計的14個蛋白質標靶複合物中,有9個進入真實物研發,它甚至僅憑觀看 《寶可夢火紅版》的遊戲畫面,就能直接生成《賁吃蛇》、《割繩子》等可運行遊戲。

然而,在加州大學柏克萊分校推出的最高難度ALE「智能體的最後考試」中,包括Fable 5 在內的所有前沿智能體,通過率都是0%。ALE的結論一針見血:有用的AI代理時代已經到來,但真正能獨立勝任工的AI代理時代,還沒有到來。


定價高昂 為 Opus 4.8三倍

能力的背後是成本。Fable 5的定價為每百萬個token輸入10美元,輸出50美元,這大約是 Opus 48的3倍。

算一筆簡單的帳:一個對智能體每天處理一萬個任務,在Opus 4.8上每天成本約2300美元。同樣的工作量在Fable 5上升至7500美元。一年下來的差距就超過160萬美元。

更驚人的是用戶的真實消耗。在ALE測試中,Fable 5 平均每題花費約15.7美元,而GPT- 5.5僅3.8美元·Composer 2.5更只有1.33美元。 在性能相近的情況下,Fable 5 的單任務成本是競爭對手的4至12倍。據報道,Uber在短短4個月內燒光了整年AI預算,被迫對內部使用設上限。


Mythos 觸發美網安巨頭暴跌

如果說 Fable是公開的寓言,那麼 Mythos 就是被封存的神話。2026年6月22日,Anthropic 在全球範圍內暫停了Claude Fable 5的服務,並在API預覽期間對模型的思維作出編輯。美國政府以國家安全為由,下令 Anthropic撤銷外國對 Mythos 的訪問權限。

Mythos 被認為是一種能夠以專家級水平主動尋找並利用安全漏洞的AI模型。今年4月 Mythos 已展現出自主發現漏洞、分析漏洞、構造攻擊軟件的能力,導致美國所有安全巨頭股價集體暴跌。

Anthropic的內部測試記錄了該模型自主發現數千個零日漏洞的過程。英國AI安全研究所和歐盟 ENISA等少數機構獲得了訪問權限。全球約 150個組織已獲得部署。Mythos 還自主重新發現了一個存在17年之久的FreeBSD 遠端程式碼執行漏洞。

Fable與Mythos的雙重發布,揭示了AI時代最深刻的矛盾。能力與風險、開放與控制、創新與監管,這些衝突在同一個模型上被極端地放大。 對普通開發者而言,Fable 5代表了當前可獲得的最強AI代理能力。對網絡安全领域而言,Mythos 5的存在,本身就是一次對全球防線的壓力測試。 對整個產業而言,一個模型同時以「神話」和「寓言」兩種形式存在,本身就是一個關於未來的隱喻。我們渴望觸及神話般的能力,卻只敢讓它以寓言的形式進入日常生活。


註:Anthropic 於2026年6月9日發布了 Claude Fable 5 Claude Mythos 5.


原文請按這裡


曾啟邦 (Rex)

作者為 AlgoBot聯合創辦人