返回首頁AI API

Claude API 定價方案|2026 Anthropic API 費用與省錢技巧完整攻略

21 min 分鐘閱讀
#Claude#Anthropic#API 定價#Opus#Sonnet#Haiku#Prompt Caching#Batch API#成本優化#企業折扣

Claude API 定價方案|2026 Anthropic API 費用與省錢技巧完整攻略

Prompt Caching 省 90%——Claude API 最被低估的省錢武器

你可能已經知道 Claude 很會寫程式碼。

但你可能不知道:Claude API 的 Prompt Caching 機制,可以把重複的長 System Prompt 費用直接砍掉 90%。如果你的應用每天發送上萬次 API 請求,這一個功能就能幫你每月省下數千美元。

偏偏,超過 70% 的 Claude API 使用者根本沒開啟這個功能。

這篇文章會把 Anthropic 旗下 Claude API 的定價結構、三款模型的費用效益、以及所有省錢技巧一次講清楚。

需要 Claude API 企業方案?聯繫 CloudInsight,享企業專屬折扣與台灣統一發票。

TL;DR

2026 年 7 月 Claude API 主力模型定價(Input/Output,每百萬 Token):Fable 5 $10/$50、Opus 4.8 $5/$25、Sonnet 5 $2/$10(導入優惠,只到 2026-08-31,之後為 $3/$15)、Haiku 4.5 $1/$5。善用 Prompt Caching 省 90%、Batch API 省 50%,可大幅降低成本。

Claude API 各模型完整定價|Fable 5、Opus、Sonnet、Haiku 怎麼選

Answer-First: 截至 2026 年 7 月,公開販售的最高階模型是 Claude Fable 5($10/$50),旗艦是 Opus 4.8($5/$25)。Sonnet 5 是大多數企業的最佳選擇——導入優惠期間只要 $2/$10,但這個價格只到 2026-08-31。任務簡單、量大則用 Haiku 4.5($1/$5)最划算。(來源:Anthropic 官方定價頁

現行模型完整定價表

模型Input(每百萬 Token)Output(每百萬 Token)Context Window定位
Claude Fable 5$10.00$50.00100 萬 Token公開販售最高階(Mythos 級)
Claude Mythos 5$10.00$50.00100 萬 Token限量開放
Claude Opus 4.8$5.00$25.00100 萬 Token旗艦,最強推理
Claude Opus 4.7 / 4.6 / 4.5$5.00$25.004.8/4.7/4.6 為 100 萬 Token前代旗艦
Claude Sonnet 5(導入優惠,至 2026-08-31)$2.00$10.00100 萬 Token企業主力,性價比之王
Claude Sonnet 5(2026-09-01 起標準價)$3.00$15.00100 萬 Token同上,價格回歸
Claude Sonnet 4.6 / 4.5$3.00$15.004.6 為 100 萬 Token前代主力
Claude Haiku 4.5$1.00$5.00以官網為準輕量快速,大量處理

⚠️ Sonnet 5 優惠有死線: 導入優惠價 $2/$10 只到 2026-08-31。2026-09-01 起是標準價 $3/$15,Input 與 Output 都直接漲 50%。有大量 Sonnet 5 用量的團隊,建議現在就把 9 月起的預算按 1.5 倍重算一次。

注意: 以上為標準定價。使用 Prompt Caching 和 Batch API 時,實際費用會更低。100 萬 Token 上下文為內建、以標準價計費,不另外收長脈絡加價。

已淘汰、但還常被誤引用的舊價格

網路上(包含本文舊版)流傳的幾組數字已經過期,看到請直接忽略:

模型舊價格現況
Claude Opus 4.1$15.00 / $75.00已 deprecated。現行 Opus(4.8/4.7/4.6/4.5)是 $5/$25,不是 $15/$75
Claude Haiku 3.5$0.80 / $4.00已退役(僅部分雲平台仍可用)。現行 Haiku 4.5 是 $1/$5
Claude Opus 4、Sonnet 4已退役

換句話說:看到 Opus 標 $15/$75、Haiku 標 $0.80/$4,那份資料就是舊的。

為什麼不能只看單價:新 tokenizer 讓 Token 數多了約 30%

Opus 4.7 以後的模型(含 Fable 5、Mythos 5、Sonnet 5)改用新的 tokenizer。同一段文字,在這些模型上大約會多產生 30% 的 Token。

實務上的意思是:

  • 你把工作從 Opus 4.6 換到 Opus 4.8,單價一樣是 $5/$25,但同一份輸入的帳單會比較高,因為 Token 數變多了
  • 跨世代比較單價沒有意義,要比就要拿同一份實際文本,分別用兩個模型的 Token 計數再乘上單價
  • 上線前建議先用官方的 Token 計數功能,對你自己的 Prompt 重新抓一次基準

Extended Thinking 模式的額外計費

Claude 的高階模型都支援深度推理(Extended Thinking/Adaptive Thinking)模式。開啟後,模型會在回答前先進行更長時間的推理。

計費影響:

  • Thinking Token 按照 Output Token 的費率計算
  • 思考模式的參數與控制方式各世代不同,且會隨版本調整,請以 Anthropic 官方文件當下的說明為準
  • 開啟深度推理會明顯增加 Output Token 消耗,成本估算時要把這段一起算進去

什麼時候值得開?

  • 複雜的邏輯推理
  • 多步驟的數學問題
  • 需要高準確率的關鍵任務

什麼時候不需要?

  • 簡單的文字生成
  • 翻譯
  • 格式轉換

一台 27 吋螢幕上顯示 Anthropic Console 的定價與用量頁面,三個模型的用量長條圖以紫色、藍色、綠色區分,螢幕旁有手寫便利貼,一位亞洲男性產品


Fable 5 vs Opus vs Sonnet vs Haiku 費用效益完整分析|依任務選模型最省錢

Answer-First: 同樣一份工作量(輸入 10,000 Token、輸出 2,000 Token),Haiku 4.5 只要 $0.02、Sonnet 5 優惠期 $0.04、Opus 4.8 $0.10、Fable 5 $0.20。大多數企業用 Sonnet 5 就夠,最難的長流程推理才切到 Opus 4.8 或 Fable 5。

關於品質評分: 本文舊版曾列出 9.5/10 這類模型品質評分。那些數字沒有可查證的來源,已整組移除。模型品質請以你自己的任務實測為準,不要拿別人的評分當採購依據。

同一份工作量的單次費用比較

假設條件:單次呼叫輸入 10,000 Token、輸出 2,000 Token(未使用快取與批次)。

模型Input 費用Output 費用單次合計
Claude Fable 5($10/$50)$0.10$0.10$0.20
Claude Opus 4.8($5/$25)$0.05$0.05$0.10
Claude Sonnet 5 優惠價($2/$10)$0.02$0.02$0.04
Claude Sonnet 5 標準價($3/$15,9/1 起)$0.03$0.03$0.06
Claude Haiku 4.5($1/$5)$0.01$0.01$0.02

驗算方式:10,000 Token = 0.01 百萬 Token,乘上 Input 單價;2,000 Token = 0.002 百萬 Token,乘上 Output 單價。

提醒: 上表是「同樣 Token 數」的比較。Fable 5、Opus 4.7 以後與 Sonnet 5 使用新 tokenizer,同一段文字的 Token 數會比舊世代多約 30%,實際帳單要再把這個差異算進去。

我的模型選擇建議

用 Fable 5 / Opus 4.8 的場景:

  • 複雜的多步驟推理、長流程自動化
  • 超過 50 頁的長文件分析
  • 需要最高品質的重要內容產出
  • 預算充足的高價值任務

用 Sonnet 5 的場景(推薦多數企業):

  • 日常文字生成與編輯
  • 一般程式碼撰寫
  • 客服機器人
  • 中等長度的文件處理

用 Haiku 4.5 的場景:

  • 大量的文字分類
  • 簡單的格式轉換
  • 即時聊天機器人(需要快速回應)
  • 預算極度有限的個人專案

跟 OpenAI 的模型如何比較?請參考 AI API 費用比較完整攻略OpenAI API 費用全解析


Claude API 批次處理與 Prompt Caching 省錢術|實際節省金額計算

Answer-First: Batch API 的 Input/Output 都打 5 折;Prompt Caching 快取命中只收 0.1 倍(省 90%),寫入 5 分鐘快取收 1.25 倍、1 小時快取收 2 倍。以一個每天 10,000 次對話的客服機器人為例(Sonnet 5 優惠價),兩個功能同時使用,月費可從 $3,000 降到約 $690。

Batch API:50% 折扣機制

跟 OpenAI 一樣,Anthropic 也提供 Batch API。規則很簡單:

  • Input 與 Output 都打 5 折
  • 24 小時內完成處理
  • 一次最多提交 100,000 筆請求

Batch API 定價(標準價 × 0.5):

模型Batch Input(每百萬 Token)Batch Output(每百萬 Token)
Fable 5$5.00$25.00
Opus 4.8$2.50$12.50
Sonnet 5(優惠價,至 2026-08-31)$1.00$5.00
Sonnet 5(2026-09-01 起)$1.50$7.50
Haiku 4.5$0.50$2.50

Prompt Caching:最高省 90%

這是 Claude API 最強大的省錢功能,也是 Anthropic 相對於 OpenAI 的一大優勢。

機制說明(倍率乘在該模型的標準 Input 單價上):

  • Cache Write(5 分鐘):1.25 倍
  • Cache Write(1 小時):2 倍
  • Cache Read(快取命中)0.1 倍,也就是省 90%

Prompt Caching 定價:

模型標準 Input寫入 5 分鐘(1.25x)寫入 1 小時(2x)快取命中(0.1x)
Fable 5$10.00$12.50$20.00$1.00
Opus 4.8$5.00$6.25$10.00$0.50
Sonnet 5(優惠價)$2.00$2.50$4.00$0.20
Sonnet 5(9/1 起)$3.00$3.75$6.00$0.30
Haiku 4.5$1.00$1.25$2.00$0.10

實際節省金額計算範例

場景: 一個客服機器人,使用 Claude Sonnet 5(以導入優惠價 $2/$10 計算)。

  • System Prompt:3,000 Token
  • 每次用戶對話的 Input:500 Token
  • 每次 Output:300 Token
  • 每天 10,000 次對話,一個月 30 天=300,000 次對話

不用省錢功能的月費:

  • System Prompt:3,000 × 300,000 = 900 百萬 Token × $2/M = $1,800
  • User Input:500 × 300,000 = 150 百萬 Token × $2/M = $300
  • Output:300 × 300,000 = 90 百萬 Token × $10/M = $900
  • 月費合計:$3,000

用 Prompt Caching 的月費(假設 5 分鐘快取、每天重寫一次,一個月 30 次寫入):

  • Cache Write:3,000 × 30 = 0.09 百萬 Token × $2.50/M ≈ $0.23
  • Cache Read:3,000 × 299,970 ≈ 899.91 百萬 Token × $0.20/M ≈ $180
  • User Input:$300(不變)
  • Output:$900(不變)
  • 月費合計:約 $1,380

再加上 Batch API(如果可以接受非即時):

  • 所有費用再打 5 折
  • 月費合計:約 $690

從 $3,000 降到約 $690——省了 77%

⚠️ 2026-09-01 起要重算: Sonnet 5 標準價 $3/$15 是優惠價的 1.5 倍,上面每一項也同步乘 1.5——未優化月費變成 $4,500、只開 Prompt Caching 約 $2,070、再加 Batch API 約 $1,035。省下來的比例一樣是 77%,但絕對金額多了一半。

筆電螢幕上顯示兩張並排的月費帳單圖表,左邊是啟用 Prompt Caching 前的高金額長條圖,右邊是啟用後的低金額長條圖,綠色箭頭標示省下的百分比,一位亞洲


Claude API 企業採購,就找 CloudInsight

CloudInsight 提供 Claude API 企業採購服務:

  • 享企業專屬折扣,比 Anthropic 官方定價更優惠
  • 協助設定 Prompt Caching 與 Batch API,最大化省錢效果
  • 台灣統一發票 + 中文技術支援

立即諮詢企業方案 →


Claude API 免費試用與入門方案|從零開始最省的方法

Answer-First: Anthropic Console 提供 API 試用額度,新帳號註冊後即可使用。試用額度足夠進行功能測試和原型驗證,但速率限制嚴格,不適合生產環境。額度金額與速率限制的具體數字,Anthropic 會依帳號等級調整,請以 Anthropic 官方定價/速率限制頁與你自己 Console 後台顯示的數字為準,不要沿用網路上流傳的固定數字。

免費額度申請步驟

  1. 前往 Anthropic Console 註冊帳號
  2. 驗證 Email
  3. 系統自動發放試用 Credit(金額以官網公告為準)
  4. 在 API Keys 頁面建立 API Key
  5. 開始呼叫 API

免費版速率限制

免費/試用層級有 RPM(每分鐘請求數)、TPM(每分鐘 Token 數)與每日請求上限,且不是每個模型都開放。這些門檻 Anthropic 會不定期調整,登入 Console 後台查看自己帳號的實際限制最準。

從免費升級到付費

綁定信用卡並儲值後,速率限制會依據儲值金額與累計消費逐步放寬(Anthropic 的 Tier 制度)。各 Tier 的門檻金額與對應 RPM 請以官方頁面為準——這組數字改動頻繁,本文不列固定數值以免誤導採購預估。

台灣用戶注意: Anthropic 對台灣信用卡的支援度比 OpenAI 更不穩定。許多台灣開發者反映付款被拒。這時候透過 CloudInsight 代購 是最快的解決方案。

想了解更多免費 AI API 的選擇?請參考 免費 AI API 推薦與限制說明

MacBook Pro 螢幕上顯示 Anthropic Console 的 API Keys 管理頁面,筆電放在原木桌上,旁邊有一杯手沖咖啡和一支手機,咖啡廳背


FAQ:Claude API 費用常見問題

Claude API 跟 ChatGPT API 哪個比較便宜?

取決於你選的模型等級。以中階模型比較:Claude Sonnet 5 導入優惠期是 $2/$10,OpenAI 的 gpt-5.6-terra 是 $2.50/$15,優惠期間 Claude 兩邊都比較便宜。2026-09-01 之後 Sonnet 5 回到 $3/$15,Input 就會略貴一點、Output 打平。再加上 Claude 的 Prompt Caching 省 90%,大量使用的場景通常仍是 Claude 較省。建議依實際用量計算。

Claude API 的 Prompt Caching 怎麼開啟?

在 API 請求中使用 cache_control 參數,將 System Prompt 標記為可快取。首次請求會寫入快取(5 分鐘快取收 1.25 倍、1 小時快取收 2 倍),之後的請求命中快取只收標準 Input 價的 0.1 倍(省 90%)。預設快取有效期為 5 分鐘,如果超過時間沒有新請求,快取會失效;長間隔的流量可以改用 1 小時快取。

Claude API 可以用台幣付款嗎?

Anthropic 目前只接受美元付款。台灣用戶可以使用支援國際交易的 Visa 或 Mastercard 信用卡,但可能會被收取海外交易手續費(通常 1.5%)。若要換算台幣,以 1 美元約 32 元估算,實際依匯率與手續費而異。透過 CloudInsight 採購可以用台幣付款並取得統一發票。

Claude Opus 值得用嗎?還是 Sonnet 就夠了?

多數場景用 Sonnet 5 就夠了。Opus 4.8 在複雜推理、長流程自動化、超長文件分析方面有明顯優勢,費用是 Sonnet 5 標準價的約 1.7 倍($5/$25 對 $3/$15);在 Sonnet 5 導入優惠期間(至 2026-08-31)則約 2.5 倍。建議先用 Sonnet 5 測試,如果品質不滿意再升級到 Opus 4.8,最難的任務才考慮 Fable 5($10/$50)。很多團隊的做法是:日常用 Sonnet,關鍵任務才切 Opus。

Claude API 有企業方案嗎?

有。Anthropic 提供企業方案(Enterprise),包含更高的速率限制、專屬客服和 SLA 保障。此外,透過 CloudInsight 等代理商採購,可以取得額外的批量折扣和在地技術支援。


善用 Claude API 的每一分錢|省錢策略總整理

Claude API 的定價在三大 AI API 中屬於中等偏上。但它有兩個殺手級優勢:Prompt Caching 命中只收 0.1 倍(省 90%),以及 Fable 5、Opus 4.8/4.7/4.6、Sonnet 5、Sonnet 4.6 內建 100 萬 Token 上下文且以標準價計費

四個立即可行的行動:

  1. 開啟 Prompt Caching——如果你的 System Prompt 超過 1,000 Token,這是必做的事
  2. 非即時任務用 Batch API——直接省 50%,沒有理由不用
  3. 依任務選模型——不要全部用 Fable 5 或 Opus,把預算花在刀口上
  4. 把 9 月的預算重算一次——Sonnet 5 導入優惠 2026-08-31 到期,9/1 起單價漲 50%

想更全面地了解 AI API 的成本優化方法?請參考 LLM API 成本優化實戰指南

企業大量採購 Claude API 有更多折扣選擇,請參考 AI API 企業採購指南


立即取得 Claude API 企業最優方案

CloudInsight 是台灣在地的 AI API 企業採購代理:

  • Claude API 企業折扣,比官價更優惠
  • Prompt Caching + Batch API 設定指導
  • 台灣統一發票,解決報帳難題
  • 中文即時技術支援

立即諮詢企業方案 →加入 LINE 即時諮詢 →


參考資料

  1. Anthropic - Claude API 官方定價頁:https://platform.claude.com/docs/en/about-claude/pricing (2026-07-22 查證)
  2. Anthropic - Prompt Caching Documentation
  3. Anthropic - Batch API Documentation
  4. Anthropic - Rate Limits and Usage Tiers
  5. Anthropic - Extended Thinking Documentation

延伸閱讀

需要專業的雲端建議?

無論您正在評估雲平台、優化現有架構,或尋找節費方案,我們都能提供協助

預約免費諮詢

相關文章