Claude Opus 5功能、價格及香港企業選型文章封面

Claude Opus 5 正式登場:接近 Fable 5、價錢一半,香港企業應唔應該轉用?

懶人包(TL;DR)

  • Anthropic於2026年7月24日正式推出Claude Opus 5,定位係日常可用的高階coding、AI Agent及專業工作模型。
  • API標準價維持每百萬input tokens US$5、output tokens US$25,與Opus 4.8相同,約為Fable 5的一半。
  • 核心規格包括1M token context window、最高128K output tokens、預設啟用adaptive thinking,以及low至max五級effort。
  • 企業最合理做法唔係將所有任務一刀切升級,而係將Opus 5留畀高價值、長流程、需要自我檢查的任務;大量例行工作仍可用Sonnet 5。
  • 官方benchmark顯示Opus 5表現大幅提升,但仍屬供應商及早期客戶測試;正式採購前應用自己的廣東話、繁中、文件及工作流程做對照測試。
Claude Opus 5價格、context window、輸出上限及thinking設定
Claude Opus 5官方核心規格一頁看懂。

Claude模型更新得愈來愈快,但對香港企業而言,真正重要的問題唔係「邊個benchmark最高」,而係:同一項工作,用邊個模型可以用最少總成本,交到真正合格的結果?

Anthropic在2026年7月24日正式發布Claude Opus 5。官方形容它接近Claude Fable 5的前沿智能,但價格約為一半;同時將它設為Claude Max的預設模型,以及Claude Pro內能力最強的模型。這個定位相當清楚:Fable 5仍然追求最高能力上限,而Opus 5就想成為專業用戶每日真正會開來工作的主力。

以下會拆解Claude Opus 5的功能、價格、技術變化及限制,再用香港企業角度,判斷應該用Opus 5、Sonnet 5,還是Fable 5。

一、Claude Opus 5係咩?並唔係「最強Claude」咁簡單

Claude Opus 5是Anthropic為複雜agentic coding、企業分析及專業知識工作設計的高階模型,API model ID為claude-opus-5。它可透過Claude API、Amazon Bedrock、Google Cloud及Microsoft Foundry使用;一般用戶則可在Claude Pro、Max、Team及Enterprise方案使用。

要留意,Anthropic現時仍把Claude Fable 5列為能力最高的廣泛發布模型。換句話說,Opus 5並非取代Fable 5,而係在能力、速度及成本之間重新劃出一個更實用的位置。

一句講晒:如果Fable 5係「為極少數最高難度任務追求能力上限」,Opus 5就係「企業願意每日使用的高階主力」。

二、Opus 5真正升級咗邊五樣嘢?

1. 同價升級:維持Opus 4.8價格

Claude Opus 5的標準API價格是每百萬input tokens US$5、每百萬output tokens US$25,與Opus 4.8相同。Anthropic表示,Opus 5在Frontier-Bench、CursorBench、AutomationBench及OSWorld等coding、商業流程及computer-use評估中,以相同或較低每任務成本取得明顯提升。

不過,benchmark唔等於你公司的實際回報。長文件、工具調用、重試次數及人工覆核時間,都會影響最終成本。因此企業應看「每個合格交付物總成本」,而唔只看每百萬tokens單價。

2. Thinking預設開啟,effort變成重要控制桿

Opus 5預設使用adaptive thinking,模型會自行判斷每一輪需要思考幾多。開發者可以用lowmediumhighxhighmax五級effort,按任務價值平衡質素、tokens及等待時間。

這亦帶來遷移注意事項:max_tokens同時計算thinking及最終回覆;如果沿用舊模型的輸出上限,可能出現思考用盡預算、最後答案被截斷。另一方面,在xhighmax effort下,Opus 5不允許關閉thinking。

3. 1M context+128K output成為標準規格

Claude Opus 5提供100萬tokens context window,最高輸出128,000 tokens。對需要一次處理大型codebase、長合約、研究資料、財務模型或多份內部文件的團隊,容量限制明顯降低。

但「放得入」唔代表「一定搵得準」。公司仍然需要文件版本控制、來源標記、檢索策略及驗收規則,避免模型在大量內容中引用錯版本或遺漏重要條款。

4. Agent工作流程更靈活

Opus 5支援在對話進行中增加或移除工具,而毋須每次重發完整工具清單;這項mid-conversation tool changes功能目前仍屬beta。它亦支援server-side fallback測試功能,讓被特定拒絕類別攔截的請求按預設策略轉交其他模型。

Prompt caching最低門檻亦由Opus 4.8的1,024 tokens降至512 tokens。對反覆使用同一份system prompt、產品目錄、SOP或知識庫摘要的企業應用,更多請求有機會受惠於cache。

5. 自我檢查、視覺成果與專業文件更成熟

Anthropic表示,Opus 5更擅長先規劃、使用工具、驗證結果,再自行修正。官方及早期客戶案例集中在大型codebase、除錯、數據分析、盡職審查、財務模型、法律redline、簡報與前端介面。

值得留意的是,以上大部分案例來自Anthropic公布的評估或早期合作夥伴,未必等同你公司的任務分布。最穩陣的方法仍然係:用同一輸入、同一工具、同一完成標準,與現有模型做受控比較。

三、Claude Opus 5價格:平過Fable,但唔代表所有任務都抵用

模型 Input/1M Output/1M 官方定位
Claude Fable 5 US$10 US$50 最高廣泛發布能力、長時間Agent任務
Claude Opus 5 US$5 US$25 複雜coding、AI Agent及企業工作
Claude Sonnet 5 US$3* US$15* 速度與能力平衡、高流量工作

*Sonnet 5在2026年8月31日前的官方推廣價為每百萬input tokens US$2、output tokens US$10;其後標準價為US$3/US$15。

Claude Fable 5、Opus 5及Sonnet 5價格與用途比較
三款Claude模型唔係單純由弱到強,而係對應不同任務價值與成本。

如果只看token價,Sonnet 5明顯較平;如果一個錯誤會令專業人員多花兩小時覆核,或令整個workflow重跑,Opus 5就可能反而更便宜。相反,用Opus 5做大量固定格式分類、簡單摘要或客服草稿,通常屬於過度配置。

企業應計的唔係Token單價,而係「合格交付成本」

合格交付成本=模型費用+工具費用+等待時間+人工覆核+重試/修復成本。模型貴少少,但如果首次通過率更高、覆核時間更短,總成本可能更低。

四、香港企業幾時應該用Opus 5?

適合Opus 5的任務

  • 大型codebase及多文件開發:需要跨檔案理解、除錯、測試及反覆驗證。
  • 財務、法律及研究分析:錯誤成本高,需要數字、表格、條款及來源交叉檢查。
  • 長流程AI Agent:需要連續使用多個工具、保留任務脈絡及自行檢查中間成果。
  • 高價值文件與簡報:需要結構、版面、視覺理解及多輪修改保持一致。
  • 難以事前寫盡所有步驟的任務:需要模型在明確目標及權限內自行規劃方法。

未必需要Opus 5的任務

  • 固定欄位抽取、分類、翻譯及大量格式轉換。
  • 有完整模板、低風險、容易由規則驗收的例行工作。
  • 即時客服、搜尋提示或對延遲非常敏感的高流量流程。
  • 未有清晰成功標準,只係想「先用最強模型試吓」的探索。

對大部分香港中小企,最實際的架構係Sonnet處理大量日常工作,Opus處理複雜例外及高價值任務,Fable只留給少量真正需要最高能力上限的工作。這種model routing通常比全公司只用一個模型更容易控制成本。

五、升級Opus 5前,要留意四個現實限制

1. 官方benchmark唔等於你的工作流程

不同benchmark會使用不同工具、時間限制、評分方法及任務分布。官方結果可以證明模型值得測試,但不能代替你公司的廣東話內容、香港法規用語、Excel格式、CRM資料及審批流程。

2. 預設thinking可能增加tokens及延遲

Opus 5的thinking預設開啟,難題可能使用較多計算。企業應按任務設定effort,並為輸出預留足夠max_tokens;唔應該所有請求都長期開到max。

3. 1M context唔係文件治理的替代品

將成個共享硬碟塞入prompt,並不能解決版本混亂、權限錯置、資料過期或引用欠來源。長context要配合資料分級、文件擁有人、有效日期及可追溯引用。

4. 高風險操作仍然需要人工批准

即使模型更擅長自我檢查,付款、發送電郵、對外發布、刪除資料、法律結論及重要財務決定,仍應設人工批准點。AI可以負責準備與驗證證據,但唔應該自己決定「已經安全,可以直接執行」。

香港企業選擇Claude Sonnet、Opus或Fable的決策流程
先按任務成本、複雜度與錯誤風險選模型,再用真實工作驗證。

六、最實際做法:用7日pilot決定值唔值得轉

  1. 揀一項真實任務:例如月報分析、合約初審、Landing Page修改或跨文件研究。
  2. 先定「合格」:列出必須正確的數字、格式、來源、功能測試及禁止事項。
  3. 同一輸入做對照:比較現有模型、Sonnet 5及Opus 5;只有最高難度個案才加入Fable 5。
  4. 記錄完整成本:包括tokens、工具調用、總時間、人工覆核分鐘及重試次數。
  5. 按結果分流:只有Opus 5能重複改善質素、時間或總成本的任務,先正式遷移。

你亦可以參考AD-Linkage過往的Kimi K3真實任務評測:模型有靚初稿並不等於完整交付,真正選型要把Preview穩定性、修改速度、人工介入及最終完成度一齊計。

Claude Opus 5與香港AI技能:由識用模型,升級到識設計工作流程

模型每幾星期就會更新,死記某個版本的按鈕或benchmark好快過時。更耐用的能力係:識得比較模型、拆解任務、設計context、安排工具與權限、建立驗收標準,再將AI接入真實工作。

AD-Linkage的人工智能應用績效實戰專業證書屬香港資歷架構第4級,課程頁列明已納入持續進修基金可獲發還款項課程名單。內容涵蓋ChatGPT、Gemini、Claude等平台比較、Agentic AI、MCP、RAG、工作流程自動化及Vibe Coding;CEF發還須視乎申請人資格、基金餘額、出席及修業要求等現行條款。

AD-Linkage|AI實戰學習路線

唔只追新模型,學識將AI變成可驗收的工作成果

了解QF Level 4課程內容、入讀要求、最新上課安排及CEF相關條件。

FAQ:Claude Opus 5常見問題

Claude Opus 5幾時推出?

Anthropic於2026年7月24日正式推出Claude Opus 5,發布當日已在Claude產品及開發者平台提供。

Claude Opus 5收費幾多?

Claude API標準價為每百萬input tokens US$5、每百萬output tokens US$25。Fast mode目前屬API research preview,價格為US$10/US$50。

Opus 5是否勁過Fable 5?

不應一概而論。Anthropic指Opus 5在部分coding、知識工作及computer-use評估接近或超越Fable 5,但官方仍將Fable 5列為能力最高的廣泛發布模型。企業應按自己的任務實測。

Opus 5是否應該全面取代Sonnet 5?

通常唔需要。Sonnet 5速度較快、成本較低,適合大量日常工作;Opus 5較適合複雜、長流程及錯誤成本較高的任務。最有效率的做法通常係分流,而非全面替換。

Claude Opus 5的API model ID是甚麼?

Claude API使用claude-opus-5。Anthropic表示這個無日期格式仍是固定snapshot,而不是會自動改變的evergreen alias。

1M token context代表甚麼?

代表一次請求可容納最多100萬tokens的指令、對話及文件內容。它提升處理大型資料的容量,但不保證每一段資料都會被同等準確地運用,因此仍要配合檢索、來源及驗收設計。

結論:Opus 5最重要的進步,是令高階AI更接近日常可用

Claude Opus 5最吸引的地方,唔係單一benchmark冠軍,而係用Opus 4.8的價格,將coding、Agent、專業文件及自我驗證推近Fable級能力。對需要處理高價值、長流程工作,但又承受不起Fable 5成本的企業,Opus 5值得優先測試。

但「值得測試」不等於「應該全面升級」。香港企業最成熟的做法,是先定義合格結果,再按任務價值分流模型,最後用真實數據比較每個合格交付物的總成本。


資料來源:
Anthropic:Introducing Claude Opus 5
Claude Platform:What’s new in Claude Opus 5
Claude models overview
Claude Platform pricing。資料核對日期:2026年7月28日。

相關內容