Anthropic 發表 Claude Opus 5:半價逼近旗艦性能,還讓你自己調「用力程度」

Anthropic 發表 Claude Opus 5:半價逼近旗艦性能,還讓你自己調「用力程度」

Anthropic 兩個月內的第四款模型來了。Claude Opus 5 的賣點不是又一次刷榜,而是一道很實際的算術題:接近旗艦的性能,一半的價格,外加一顆能自己調的「用力程度」旋鈕。

台北一位獨立開發者最近每個月月底都要做同一件事:打開 API 帳單,計算哪些功能該從旗艦模型降級到中階模型省錢。7 月 24 日 Anthropic 發表 Claude Opus 5 之後,他的算式多了一個新變數——這顆模型直接把「性能與成本」做成了一個三段式旋鈕,讓他不用再二選一。

事件背景

Anthropic 這波出牌的節奏快得反常:6 月接連推出 Mythos 5、Fable 5、Sonnet 5,7 月 24 日又端出 Claude Opus 5,不到兩個月內第四款模型。Opus 5 的定位很清楚——用約旗艦 Fable 5 一半的價格,提供逼近旗艦的能力。API 定價維持與上一代 Opus 4.8 相同:每百萬 input tokens 5 美元、output 25 美元,模型代號 claude-opus-5,發表當日即在 Claude API、Claude.ai、Claude Code 與 Claude Cowork 全面上線,沒有分區排隊。

官方公布的成績單(皆為 Anthropic 自家評測):在 Frontier-Bench v0.1 超越所有其他模型、達 Opus 4.8 的兩倍以上;ARC-AGI 3 是次佳模型的三倍;OSWorld 2.0 以約三分之一的成本超越 Fable 5 的最佳成績;程式輔助的 CursorBench 3.2 距 Fable 5 峰值只差 0.5% 以內。

本次重點

  • 定價:$5 / $25 每百萬 tokens,與 Opus 4.8 相同,約為 Fable 5 的一半。
  • effort 檔位:low / medium / high 三段,讓開發者在同一顆模型上自行調節智慧與成本的平衡。
  • Fast mode:2.5 倍輸出速度,價格為基本費率的 2 倍。
  • 安全面:官方稱其為「最對齊的 Opus 模型」,安全分類器觸發頻率預計比 Fable 5 低 85%,並推出 beta 的 automatic fallbacks——觸發安全機制時自動改由較低階模型接手,而不是直接報錯。
  • 界線:資安任務能力仍低於旗艦 Mythos 5,官方明確標注。

市場影響分析

對台灣使用者:一般訂閱用戶的直接改變是 Claude.ai 上多了一顆更強的日常主力模型。對進階使用者,effort 檔位的意義是「同一個訂閱有三種人格」——查資料用 low、寫東西用 medium、難題開 high,體驗上更接近「一顆模型打全場」。

對企業應用:這次發表最實際的受眾是成本敏感的中小企業。過去「要品質就上旗艦、要省錢就降級」的二分法,被 effort 檔位變成連續光譜;客服、文件處理這類大量但深淺不一的工作負載,可以在同一條 API 管線裡動態配檔。automatic fallbacks 對客服場景也實用——安全機制觸發時服務不中斷,只是降級回應,這比對使用者直接報錯友善得多。

對開發者:值得動手的有三件事。一是把現有 Opus 4.8 的工作負載直接換 claude-opus-5 跑一輪回歸測試,同價升級沒有理由不吃;二是把 effort 檔位納入架構設計,依任務難度路由,比自己維護多模型路由邏輯省事;三是留意官方自評的性質——上面那些倍數都出自 Anthropic 自家基準,上線前用自己的評測集驗證,永遠是基本功。

未來發展趨勢

兩個月四款模型,訊號很明確:頂級實驗室的競爭已經從「一年一次大招」變成「持續交付」,模型變成像軟體一樣頻繁迭代的產品。effort 檔位這類「使用者自調性能」的設計預期會被同業跟進,因為它同時解決了廠商的產品線複雜度和客戶的成本焦慮。對台灣的 AI 應用生態,模型層的性價比持續改善意味著競爭重心加速往應用層移動——模型會挑便宜好用的,護城河要自己挖。

TheAI學院 總結與評語

評語:Opus 5 不是最強的模型,卻可能是這一季「每一塊錢買到最多智慧」的模型;effort 檔位把成本控管從架構問題變成一個參數,這是對開發者最有感的創新。

給台灣讀者的具體建議:付費訂閱者直接把日常任務切到 Opus 5 用一週,親自感受跟旗艦的差距值不值那個價差;API 開發者本週就排一次同價升級的回歸測試。想把提示詞一起最佳化,站上的提示詞範本庫可以搭配服用。

資料來源

以上依公開資訊整理,以官方為準。

常見問題

Claude Opus 5 跟 Fable 5 怎麼選?

官方定位是 Opus 5 以約一半價格逼近 Fable 5 的性能,多數日常與開發任務可先用 Opus 5;對品質極度敏感的關鍵任務再上旗艦。最可靠的做法是拿自己的實際任務兩邊各跑一輪比較。

effort 檔位是什麼?會影響費用嗎?

low / medium / high 三段設定,控制模型投入推理的深度:檔位越高、輸出的 token 越多、回應越深入,費用也隨 token 用量增加。單價不變,變的是用量。

現在就能在台灣用了嗎?

可以。發表當日即在 Claude API(模型代號 claude-opus-5)、Claude.ai、Claude Code 與 Claude Cowork 上線,全球開放,沒有分區限制。

官方公布的評測成績可信嗎?

本文引用的皆為 Anthropic 自家評測結果,方向可參考,但廠商自評天然有利於自家產品。開發者上線前應以自己的任務資料做驗證,媒體流傳的具體分數若未見於官方公告,本文一律未採用。