Anthropic推出Fable 5.1 緩存讀取費大砍75%複雜Agent任務最高省45%

AI新創Anthropic週二(1日)推出旗艦模型Fable 5.1,在維持主要輸入、輸出Token價格不變的情況下,大幅下調緩存讀取(cache reads)費用,同時強化長時間Agent任務、編程與科研能力。Anthropic表示,Fable 5.1可讓典型工作負載成本降低約25%,高度Agent化的複雜任務最高可節省約45%,試圖以「更強性能+更低成本」吸引企業客戶,也為即將到來的IPO進一步增加估值支撐。
Fable 5.1的核心定價變化集中在緩存讀取。Anthropic將這項費用下調75%,從上一代Fable 5的價格降至每100萬Token 0.25美元,而新輸入Token及輸出Token價格則維持每100萬Token分別10美元及50美元不變。Anthropic指出,對一般工作負載而言,Fable 5.1預計可降低約25%的實際使用成本;對高度Agent化、需要長時間持續執行及反覆讀取上下文的任務,節省幅度最高約45%。
Anthropic產品管理負責人Dianne Penn表示,在軟體開發、程式碼審查等工作中,模型往往需要反覆讀取整個應用程式的程式碼庫,緩存讀取因此可能消耗超過一半的Token。公司此次調整,正是針對企業客戶對成本的主要抱怨之一。
除了直接降價,Fable 5.1本身也經過優化,目標是在完成相同任務時使用更少Token。這對企業客戶尤其重要,因為企業開始大規模導入AI Agent後,成本不再只是單次問答的輸入、輸出費用,而是與模型執行時間、上下文長度及工具調用次數密切相關。Anthropic此時降低緩存讀取成本,有助於降低長時間Agent工作的總體推理支出。
性能方面,Anthropic將Fable 5.1定位為處理高難度推理、長時間Agent工作及大型編程、研究任務的模型。官方資料顯示,Fable 5.1擁有100萬Token上下文窗口,最大輸出長度達12.8萬Token,並可透過Claude平台以及Amazon Web Services、Google Cloud及Microsoft Foundry等管道提供給企業及開發者使用。
在科研能力方面,Fable 5.1的提升尤其明顯。在Terminal-Bench-Science 0.1測試中,Fable 5.1得分達52.6%,大幅高於上一代Fable 5的24.7%,也高於Opus 5的29.0%及OpenAI的GPT-5.6 Sol的22.4%。換言之,Fable 5.1在這項科研Agent測試中的得分較前代增加27.9個百分點,超過一倍。
編程能力同樣有所提升。在Terminal-Bench 4.0中,Fable 5.1得分55.8%,高於Fable 5的42.0%;限制較少的Mythos 5.1則進一步達到60.9%。CursorBench 3.2.0方面,Fable 5.1得分73.4%,較Fable 5的70.5%提高2.9個百分點。Humanity"s Last Exam在不使用工具的情況下,Fable 5.1得分60.9%,高於Fable 5的57.8%;使用工具時則為65.0%,前代為63.8%。
Anthropic同時強調,新模型並非單純追求一般知識問答能力,而是更加著重讓AI自主完成需要多步驟操作的工作。這包括跨越完整程式碼庫的大型軟體專案開發、系統性程式碼審查、實驗方案設計、實驗流程模擬,以及分析高密度圖表和研究資料等。
與Fable 5.1同日亮相的還有高階模型Mythos 5.1。兩款模型採用相同基礎模型,但安全防護等級不同。Fable 5.1已向一般用戶開放,而Mythos 5.1則採取邀請及可信任存取機制,目前主要面向網絡安全及生命科學等高風險、高價值專業領域的經過審核機構。
安全機制也是此次更新重點之一。Anthropic表示,Fable 5.1的網絡安全防護經過調整後,對良性網絡安全請求的誤攔截率大幅下降,讓從事網絡安全工作的用戶更少遇到不必要的限制;在基本生物學及醫學問題方面,模型觸發更嚴格處理機制的比例也有所下降。
這項調整具有特殊背景。今年6月,美國政府曾因安全疑慮限制Anthropic部分高階模型的使用,導致公司部署最強模型的進程一度受到影響。隨後Anthropic透過增加網絡安全分類器等措施改善安全防護,相關限制才逐步解除。如今公司進一步降低誤攔截率,顯示其試圖在模型能力與安全要求之間取得更適合企業市場的平衡。
企業資料主權則是Anthropic此次更新的另一項重大改變。公司宣布將推出Enterprise Frontier Safeguards(EFS),讓企業客戶能夠將資料保留在自己的雲端基礎設施上,同時接受Anthropic的安全監控與濫用防範措施。這項安排相當於回應大型企業對資料主權及零資料留存的要求,讓企業不必為使用Anthropic的高階模型而將敏感資料長期保存在Anthropic的伺服器上。相關功能將分階段推出,預計今年秋季開始提供。
對Anthropic而言,這些變化不只是模型更新,也反映AI企業爭奪企業客戶的競爭已經從「誰的模型更聰明」進一步轉向「誰能以更低成本、更高可靠性及更嚴格的資料控制完成實際工作」。在企業AI支出逐漸受到成本效益檢視的背景下,降低長時間Agent任務成本可能比單純提高基準測試分數更直接影響客戶採用。
Anthropic目前也正處於可能成為AI產業史上最大IPO之一的關鍵階段。公司此前已秘密提交上市申請文件,近期準備在美國勞動節後公開IPO招股書,上市時間可能落在9月底至10月初。
市場目前對Anthropic的估值預期已達到極高水準。部分投資人預期公司上市估值可能達到2兆美元甚至更高,若實現,將有望超越今年6月上市、估值約1.8兆美元的SpaceX,成為史上估值最高的IPO之一。
Anthropic的收入成長是支撐高估值的核心因素之一。Reuters此前報導,Anthropic截至2026年7月底的年化收入運行率已突破650億美元,較2026年5月的470億美元進一步增加,更遠高於2025年底約90億美元的水準。換言之,短短約7個月內,公司的年化收入運行率已經增加逾7倍。
不過,650億美元並非已實現的年度營收,而是根據當期收入速度推算的年化運行率。這項指標在高速成長的AI公司中被廣泛使用,但投資人仍需要透過正式招股書了解實際收入、現金流、資本支出及盈利能力。
Anthropic對未來的預期甚至更加激進。Reuters此前報導,公司預估2028年收入可能達到1900億至2000億美元,這也是目前部分投資人願意接受超高估值的重要依據。市場實際上是在用未來數年的收入潛力,而非目前盈利能力來衡量Anthropic的價值。
與此同時,Anthropic面臨的基礎設施成本也極為龐大。公司近期據報計畫投入450億美元,向Nscale租用AI雲端運算能力,合約期6年、涉及約460MW電力容量;此外,Anthropic也與SpaceX簽署大規模運算容量安排,每月支付約12.5億美元,合約延續至2029年5月。AMD也宣布計畫向Anthropic出售數百億美元規模的AI伺服器,並投資最多50億美元。
這也凸顯Fable 5.1降本的重要性。對Anthropic而言,若能在模型性能持續提升的同時降低每項任務所需要的Token及運算成本,不僅可以提高企業客戶的採用意願,也可能改善隨著AI使用量快速成長而日益沉重的推理成本壓力。
然而,Anthropic的2兆美元估值仍面臨競爭與盈利能力的雙重考驗。公司除了要與OpenAI正面爭奪企業AI市場,也要面對Meta Platforms(META-US)及中國開源AI模型等競爭者的價格壓力。Reuters指出,Anthropic收入年化運行率雖然快速成長,但增速已較今年春季有所放緩;同時,龐大的運算支出也對毛利率構成壓力。
因此,Fable 5.1此次並非單純的「小版本升級」。Anthropic同時從價格、模型性能、安全機制及企業資料主權四個方向出手,核心目的都是提高企業客戶的實際使用價值。若新模型能在編程、科研及長時間Agent工作中真正帶來更高生產力,同時把成本壓低25%至45%,Anthropic便有機會將快速增加的AI需求進一步轉化為可持續收入。
隨著IPO進入倒數,Anthropic接下來真正需要向華爾街證明的,將不只是模型能否在基準測試中擊敗競爭對手,而是能否把更強的AI能力轉化成更低的單位成本、更高的企業採用率,以及最終能夠支撐2兆美元估值的收入與利潤增長。