作者I山上何簡
Anthropic 於昨日凌晨(北京時間 7 月 25 日)發布 Claude Opus 5,聲稱該模型性能逼近 Fable 5,但價格僅為後者一半。
這可能是 Anthropic 第一次公開強調自家模型的性價比優勢。Claude Opus 5 定價每百萬輸入 Token 5 美元、輸出 25 美元,價格與前代 Opus 4.8 相同,但性能大幅提升。
即便與 OpenAI 的 GPT-5.6 Sol 相比,Opus 5 也有一定價格優勢。二者輸入價格相同,但 Opus 5 的輸出價格低了 16.7%。
Anthropic 稱 Opus 5 專為日常使用設計,比其他模型效率更高。Artificial Analysis 的測試顯示,Opus 5 綜合智能指數與 Fable 5 基本持平,在部分智能體知識工作測試中甚至領先,平均任務成本則低了 26%。
此前不久,中國大模型公司月之暗面發布擁有 2.8 萬億參數的開源模型 Kimi K3,在價格顯著低於 Fable 5 和 GPT-5.6 Sol 的前提下,性能則十分接近,一度引起美國科技產業恐慌,被視作「DeepSeek 2.0」。
得益於在編程場景下的領先,Anthropic 的模型定價向來高昂,今年初它的收入甚至反超用戶體量數倍於己的 OpenAI。但隨着如今頂尖模型性能差距逐漸縮小、企業們不斷收緊 Token 支出後,Anthropic 也不得不開始顧慮價格因素。
更早之前,Anthropic 的 Opus 4 模型曾高達每百萬輸入 15 美元、輸出 74 美元的高價,但自去年底的 Opus 4.5 將價格下降三分之二後,Opus 系列模型就再無調價,始終維持在 5/25 美元的水平。
現在,隨着 Opus 5 的到來,Anthropic 終於也有了性價比。
半價 Fable 5,加量不加價
如果只用一句話來形容 Anthropic 新發布的 Opus 5,可能就是「半價 Fable 5」。
Opus 系列曾經是 Anthropic 旗下性能最高、價格最貴的模型,但自今年 Mythos 及 Fable 模型推出後,Opus 似乎就退居二線。部分更新如 4.7 版本甚至引起開發者們的集體吐槽,彷彿越更新越低能,一度令人懷疑 Anthropic 是否將資源都用在 Fable 模型上。
首個 Mythos 級別的開放模型 Fable 5 於今年 6 月正式發布,性能大幅超越同期的 Opus 4.8,迄今仍為市面最強模型。但 Fable 5 的反響卻不盡如人意。高昂的定價、更高的 Token 消耗,以及 Anthropic 一貫以安全為由的降級騷操作,反而讓這款性能最強的模型收穫了最多的不滿。
Opus 5 算是 Anthropic 的一次撥亂反正。和過去每代 Opus 系列模型發布時 Anthropic 總要強調一番性能強悍不同,這次宣佈推出 Opus 5,Anthropic 開篇第一句話就是,「……智能水平接近 Claude Fable 5,但價格只有一半。」——生怕再把開發者們嚇跑了。
更低的價格,卻帶來不輸 Fable 5 的性能。在包括 Frontier-Bench 和 GDPval-AA 等多項編碼和知識工作測試中,Opus 5 都超越了 Fable 5,被 Anthropic 稱之 SOTA 模型。只有在網絡安全任務方面,Opus 5 稍顯落後。
中國人民的老朋友、啱啱評價 Kimi K3 「impressive」 的馬斯克,也對 Opus 5 發出來「Very impressive」的讚美。不過他另外強調,Grok 即將發布的 4.5 模型將更具性價比。
但或許是由於發布太過倉促,Anthropic 在最初的測試排行榜中錯誤地將 Opus 5 一項落後於 Fable 5 的成績標註為最優,也算深得 OpenAI 的翻車傳統。
更重要的仍然是成本。Anthropic 格外強調 Opus 5 在前代 Opus 4.8 相同的成本下實現了更優的性能。包括在內部測試中,Opus 5 完成相同任務所需的 Token 數量更少,平均成本比 Opus 4.8 降低約 30%。
比如 CursorBench 3.2 測試中,最高推理強度下,Opus 5 的表現與 Fable 5 峯值成績相差不到 0.5%,但單任務成本只有後者一半。在 OSWorld 2.0 測試中,Opus 5 甚至以約三分之一的成本超過了 Fable 5 的最佳成績。
Anthropic 還為 Opus 5 加入五檔推理強度,允許開發者根據任務複雜程度調整計算量。在低強度任務中,模型可以減少 Token 消耗,而在複雜任務中開啓更高推理能力。但即便在最高推理檔下,Opus 5 的平均單任務成本為 2.03 美元,也低於 Fable 5 的 2.75 美元。
總之,Opus 5 的一切優化都在致力於打造成本效率更優的模型。它的絕對性能或許仍落後於 Fable 5,但也足夠應付日常開發場景。與國產模型相比,Opus 5 仍稍顯昂貴,但在 Anthropic 的產品體系內,Opus 5 已經稱得上是性價比了。
它獲得的好評也顯著高於前代的 Opus 4.8。一些開發者認為 Opus 5 更適合作為日常開發的主力模型,有人甚至用「Fable 5 基本死了」來強調 Opus 5 的優秀。
不過,Anthropic 仍然沒有停止降級策略,Opus 5 部分情況下仍會靜默切換至 Opus 4.8。
Anthropic 被迫轉向
大模型行業和消費電子產品有些相似之處,上一代旗艦模型的能力會不斷下放至更便宜的產品線,模型成本也隨着迭代持續下降。過去,Anthropic 發布的Haiku 4.5、Sonnet 5 等模型,都實現了部分能力追平更高等級的 Sonnet 4、Opus 4.8。
但 Opus 5 並非簡單復刻此前的能力下放。此前低級別模型追平高一級模型,通常需要等待一輪甚至數輪迭代,而 Opus 5 在 Fable 5 發布僅一個多月後,就以更低成本追平 Fable 的性能。
部分原因或許與 Fable 過於昂貴相關。即便當前的 Token 價格相較幾年前已經大幅下滑,但由於 Agent 的 Token 消耗量更高,企業的 AI 支出不降反升,負擔日益加重。Fable 5 雖然性能出色,也很難作為企業大規模調用的基礎模型。
上個月,《華爾街日報》發布文章稱,「AI 價格戰已全面打響」,稱大公司和初創公司們越來越多轉向廉價的開源模型,令 OpenAI 和 Anthropic 面臨降價壓力。最直觀的壓力來自於中國開源模型,比如 Fable 5 的價格是 DeepSeek-V4 Pro 的 50 多倍。
AI 模型聚合平台 OpenRouter 表示,自 5 月中旬以來 DeepSeek 一直是平台 Token 使用量最高的 AI 公司。2025 年秋季至 2026 年春季,開源模型的 Token 使用量增速達到閉源模型的四倍,OpenRouter 稱已有超過 500 家機構棄用專有模型轉向開源。
Anthropic 過去能夠憑藉性能優勢獲得溢價,但現在已經很難繼續保持。開源模型與閉源模型固然存在 6-12 個月的性能差距,但企業並不總是需要最強大的模型。
Cursor 公司 CEO 邁克·薩克斯形容說,性能最強的模型並不是日常任務的必需品,「就像開着蘭博基尼去雜貨店買牛奶,而這款車本該用於賽道競速。」
美國企業過去的潮流是 Token maxxing,但現在《華爾街日報》認為新趨勢是 Thrift-maxxing,即極致省錢。公司不再把所有請求交給最貴模型,而是混合使用不同廠商和不同等級的模型。
Anthropic 超八成收入都來自於企業客戶,更容易受到行業轉向影響。今年 5 月,微軟在內部叫停使用 Claude Code,原因之一就是 Token 過於高昂。亞馬遜也在減少 Claude 的調用,將更多請求路由至自研模型,並通過緩存和確定性程序處理簡單任務。
Anthropic 還面臨 OpenAI 的激烈競爭。據此前媒體報道,OpenAI 正計劃大幅降價,以期從 Anthropic 手中爭奪客戶。OpenAI 內部認為,Anthropic 預計也將採取類似降價措施。
Opus 5 或許只是 Anthropic 轉向性價比的開始。隨着 Fable 及 Opus 模型相繼迭代至 5 代版本,更低等級的 Sonnet 及 Haiku 模型也將很快升級,同時價格也更低。
唯一的開源反對派
Opus 5 發布同期,英偉達 CEO 黃仁勳在 X 平台上發布了一封 AI 開源倡議書,稱美國在 AI 領域的領導定位不應只取決於一個最先進的閉源模型,而在於能否構建一個深入各行業的開放生態系統。「世界需要前沿閉源模型,也需要前沿開源模型。」
發布之初,倡議書就獲得了包括微軟、Meta、IBM、a16z 等 24 家科技巨頭、投資機構及初創公司的聯名支持。
此後兩天時間內,倡議書又新增包括 OpenAI、Google、GitHub、Cloudflare、Cisco 等 23 家企業支持,聯名支持開源倡議的企業名單擴大至 50 家。馬斯克的 SpaceX 雖尚未簽署,但他第一時間在 X 上轉發支持,稱「我完全支持」。
衆所周知,Anthropic 一直是整個美國科技界最反對開源模型的公司之一。Anthropic 長期強調模型權重安全、災難性風險測試和出口管制,動輒指責中國開源模型「蒸餾攻擊」自家模型,遊說美國政府封禁中國開源模型。
但現在,連微軟、OpenAI、Meta、英偉達等 AI 產業鏈核心企業都開始公開支持開放生態,Anthropic 所堅持的閉源路線正面臨越來越大的壓力。現在的 X 平台上,Opus 5 已經不再是人們最關注的焦點,反而是 Anthropic 的價值觀正受到越來越多的質疑。
截至發稿,Anthropic 仍未回應黃仁勳的開源倡議。不過,Anthropic 的一位研究員 Julian Schrittwieser 倒是公開揶揄黃仁勳,「我太激動了,黃仁勳現在是開源的信徒了,期待 CUDA 和 GPU 驅動的開源!」微軟 CEO 納德拉轉發支持黃仁勳的開源倡議後,他也揶揄說,「太期待 Windows 和 MS Office 的開源了。」
「那些歷史上極其反對開源的公司突然間全都支持開放了。」Schrittwieser 說。
如同過去 Anthropic 種種充滿爭議的舉措一樣,這位研究員的言論同樣在社交媒體上引起不小反對聲浪。一些評論認為,黃仁勳的開源倡議書更多在強調允許開源模型的存在,而不是強迫其他閉源公司轉向開源,但 Anthropic 似乎總是傾向於與整個開源世界對立。
Huggingface 聯合創始人兼 CTO Julien Chaumond 說,他不討厭 Anthropic,Anthropic 也完全有權利不將自己的東西開源,但同時,指出他們那些糟糕的觀點也是合情合理的。
更早之前,馬斯克評價 Anthropic 的價值觀時稱,你們的 AI 厭惡白人和亞裔群體,尤其憎惡中國人、異性戀與男性,「這是反人類且邪惡的。」