Claude API 定價方案|2026 Anthropic API 費用與省錢技巧完整攻略
Claude API 定價方案|2026 Anthropic API 費用與省錢技巧完整攻略
Prompt Caching 省 90%——Claude API 最被低估的省錢武器
你可能已經知道 Claude 很會寫程式碼。
但你可能不知道:Claude API 的 Prompt Caching 機制,可以把重複的長 System Prompt 費用直接砍掉 90%。如果你的應用每天發送上萬次 API 請求,這一個功能就能幫你每月省下數千美元。
偏偏,超過 70% 的 Claude API 使用者根本沒開啟這個功能。
這篇文章會把 Anthropic 旗下 Claude API 的定價結構、三款模型的費用效益、以及所有省錢技巧一次講清楚。
需要 Claude API 企業方案?聯繫 CloudInsight,享企業專屬折扣與台灣統一發票。
TL;DR
2026 年 7 月 Claude API 主力模型定價(Input/Output,每百萬 Token):Fable 5 $10/$50、Opus 4.8 $5/$25、Sonnet 5 $2/$10(導入優惠,只到 2026-08-31,之後為 $3/$15)、Haiku 4.5 $1/$5。善用 Prompt Caching 省 90%、Batch API 省 50%,可大幅降低成本。
Claude API 各模型完整定價|Fable 5、Opus、Sonnet、Haiku 怎麼選
Answer-First: 截至 2026 年 7 月,公開販售的最高階模型是 Claude Fable 5($10/$50),旗艦是 Opus 4.8($5/$25)。Sonnet 5 是大多數企業的最佳選擇——導入優惠期間只要 $2/$10,但這個價格只到 2026-08-31。任務簡單、量大則用 Haiku 4.5($1/$5)最划算。(來源:Anthropic 官方定價頁)
現行模型完整定價表
| 模型 | Input(每百萬 Token) | Output(每百萬 Token) | Context Window | 定位 |
|---|---|---|---|---|
| Claude Fable 5 | $10.00 | $50.00 | 100 萬 Token | 公開販售最高階(Mythos 級) |
| Claude Mythos 5 | $10.00 | $50.00 | 100 萬 Token | 限量開放 |
| Claude Opus 4.8 | $5.00 | $25.00 | 100 萬 Token | 旗艦,最強推理 |
| Claude Opus 4.7 / 4.6 / 4.5 | $5.00 | $25.00 | 4.8/4.7/4.6 為 100 萬 Token | 前代旗艦 |
| Claude Sonnet 5(導入優惠,至 2026-08-31) | $2.00 | $10.00 | 100 萬 Token | 企業主力,性價比之王 |
| Claude Sonnet 5(2026-09-01 起標準價) | $3.00 | $15.00 | 100 萬 Token | 同上,價格回歸 |
| Claude Sonnet 4.6 / 4.5 | $3.00 | $15.00 | 4.6 為 100 萬 Token | 前代主力 |
| Claude Haiku 4.5 | $1.00 | $5.00 | 以官網為準 | 輕量快速,大量處理 |
⚠️ Sonnet 5 優惠有死線: 導入優惠價 $2/$10 只到 2026-08-31。2026-09-01 起是標準價 $3/$15,Input 與 Output 都直接漲 50%。有大量 Sonnet 5 用量的團隊,建議現在就把 9 月起的預算按 1.5 倍重算一次。
注意: 以上為標準定價。使用 Prompt Caching 和 Batch API 時,實際費用會更低。100 萬 Token 上下文為內建、以標準價計費,不另外收長脈絡加價。
已淘汰、但還常被誤引用的舊價格
網路上(包含本文舊版)流傳的幾組數字已經過期,看到請直接忽略:
| 模型 | 舊價格 | 現況 |
|---|---|---|
| Claude Opus 4.1 | $15.00 / $75.00 | 已 deprecated。現行 Opus(4.8/4.7/4.6/4.5)是 $5/$25,不是 $15/$75 |
| Claude Haiku 3.5 | $0.80 / $4.00 | 已退役(僅部分雲平台仍可用)。現行 Haiku 4.5 是 $1/$5 |
| Claude Opus 4、Sonnet 4 | — | 已退役 |
換句話說:看到 Opus 標 $15/$75、Haiku 標 $0.80/$4,那份資料就是舊的。
為什麼不能只看單價:新 tokenizer 讓 Token 數多了約 30%
Opus 4.7 以後的模型(含 Fable 5、Mythos 5、Sonnet 5)改用新的 tokenizer。同一段文字,在這些模型上大約會多產生 30% 的 Token。
實務上的意思是:
- 你把工作從 Opus 4.6 換到 Opus 4.8,單價一樣是 $5/$25,但同一份輸入的帳單會比較高,因為 Token 數變多了
- 跨世代比較單價沒有意義,要比就要拿同一份實際文本,分別用兩個模型的 Token 計數再乘上單價
- 上線前建議先用官方的 Token 計數功能,對你自己的 Prompt 重新抓一次基準
Extended Thinking 模式的額外計費
Claude 的高階模型都支援深度推理(Extended Thinking/Adaptive Thinking)模式。開啟後,模型會在回答前先進行更長時間的推理。
計費影響:
- Thinking Token 按照 Output Token 的費率計算
- 思考模式的參數與控制方式各世代不同,且會隨版本調整,請以 Anthropic 官方文件當下的說明為準
- 開啟深度推理會明顯增加 Output Token 消耗,成本估算時要把這段一起算進去
什麼時候值得開?
- 複雜的邏輯推理
- 多步驟的數學問題
- 需要高準確率的關鍵任務
什麼時候不需要?
- 簡單的文字生成
- 翻譯
- 格式轉換

Fable 5 vs Opus vs Sonnet vs Haiku 費用效益完整分析|依任務選模型最省錢
Answer-First: 同樣一份工作量(輸入 10,000 Token、輸出 2,000 Token),Haiku 4.5 只要 $0.02、Sonnet 5 優惠期 $0.04、Opus 4.8 $0.10、Fable 5 $0.20。大多數企業用 Sonnet 5 就夠,最難的長流程推理才切到 Opus 4.8 或 Fable 5。
關於品質評分: 本文舊版曾列出 9.5/10 這類模型品質評分。那些數字沒有可查證的來源,已整組移除。模型品質請以你自己的任務實測為準,不要拿別人的評分當採購依據。
同一份工作量的單次費用比較
假設條件:單次呼叫輸入 10,000 Token、輸出 2,000 Token(未使用快取與批次)。
| 模型 | Input 費用 | Output 費用 | 單次合計 |
|---|---|---|---|
| Claude Fable 5($10/$50) | $0.10 | $0.10 | $0.20 |
| Claude Opus 4.8($5/$25) | $0.05 | $0.05 | $0.10 |
| Claude Sonnet 5 優惠價($2/$10) | $0.02 | $0.02 | $0.04 |
| Claude Sonnet 5 標準價($3/$15,9/1 起) | $0.03 | $0.03 | $0.06 |
| Claude Haiku 4.5($1/$5) | $0.01 | $0.01 | $0.02 |
驗算方式:10,000 Token = 0.01 百萬 Token,乘上 Input 單價;2,000 Token = 0.002 百萬 Token,乘上 Output 單價。
提醒: 上表是「同樣 Token 數」的比較。Fable 5、Opus 4.7 以後與 Sonnet 5 使用新 tokenizer,同一段文字的 Token 數會比舊世代多約 30%,實際帳單要再把這個差異算進去。
我的模型選擇建議
用 Fable 5 / Opus 4.8 的場景:
- 複雜的多步驟推理、長流程自動化
- 超過 50 頁的長文件分析
- 需要最高品質的重要內容產出
- 預算充足的高價值任務
用 Sonnet 5 的場景(推薦多數企業):
- 日常文字生成與編輯
- 一般程式碼撰寫
- 客服機器人
- 中等長度的文件處理
用 Haiku 4.5 的場景:
- 大量的文字分類
- 簡單的格式轉換
- 即時聊天機器人(需要快速回應)
- 預算極度有限的個人專案
跟 OpenAI 的模型如何比較?請參考 AI API 費用比較完整攻略 和 OpenAI API 費用全解析。
Claude API 批次處理與 Prompt Caching 省錢術|實際節省金額計算
Answer-First: Batch API 的 Input/Output 都打 5 折;Prompt Caching 快取命中只收 0.1 倍(省 90%),寫入 5 分鐘快取收 1.25 倍、1 小時快取收 2 倍。以一個每天 10,000 次對話的客服機器人為例(Sonnet 5 優惠價),兩個功能同時使用,月費可從 $3,000 降到約 $690。
Batch API:50% 折扣機制
跟 OpenAI 一樣,Anthropic 也提供 Batch API。規則很簡單:
- Input 與 Output 都打 5 折
- 24 小時內完成處理
- 一次最多提交 100,000 筆請求
Batch API 定價(標準價 × 0.5):
| 模型 | Batch Input(每百萬 Token) | Batch Output(每百萬 Token) |
|---|---|---|
| Fable 5 | $5.00 | $25.00 |
| Opus 4.8 | $2.50 | $12.50 |
| Sonnet 5(優惠價,至 2026-08-31) | $1.00 | $5.00 |
| Sonnet 5(2026-09-01 起) | $1.50 | $7.50 |
| Haiku 4.5 | $0.50 | $2.50 |
Prompt Caching:最高省 90%
這是 Claude API 最強大的省錢功能,也是 Anthropic 相對於 OpenAI 的一大優勢。
機制說明(倍率乘在該模型的標準 Input 單價上):
- Cache Write(5 分鐘):1.25 倍
- Cache Write(1 小時):2 倍
- Cache Read(快取命中):0.1 倍,也就是省 90%
Prompt Caching 定價:
| 模型 | 標準 Input | 寫入 5 分鐘(1.25x) | 寫入 1 小時(2x) | 快取命中(0.1x) |
|---|---|---|---|---|
| Fable 5 | $10.00 | $12.50 | $20.00 | $1.00 |
| Opus 4.8 | $5.00 | $6.25 | $10.00 | $0.50 |
| Sonnet 5(優惠價) | $2.00 | $2.50 | $4.00 | $0.20 |
| Sonnet 5(9/1 起) | $3.00 | $3.75 | $6.00 | $0.30 |
| Haiku 4.5 | $1.00 | $1.25 | $2.00 | $0.10 |
實際節省金額計算範例
場景: 一個客服機器人,使用 Claude Sonnet 5(以導入優惠價 $2/$10 計算)。
- System Prompt:3,000 Token
- 每次用戶對話的 Input:500 Token
- 每次 Output:300 Token
- 每天 10,000 次對話,一個月 30 天=300,000 次對話
不用省錢功能的月費:
- System Prompt:3,000 × 300,000 = 900 百萬 Token × $2/M = $1,800
- User Input:500 × 300,000 = 150 百萬 Token × $2/M = $300
- Output:300 × 300,000 = 90 百萬 Token × $10/M = $900
- 月費合計:$3,000
用 Prompt Caching 的月費(假設 5 分鐘快取、每天重寫一次,一個月 30 次寫入):
- Cache Write:3,000 × 30 = 0.09 百萬 Token × $2.50/M ≈ $0.23
- Cache Read:3,000 × 299,970 ≈ 899.91 百萬 Token × $0.20/M ≈ $180
- User Input:$300(不變)
- Output:$900(不變)
- 月費合計:約 $1,380
再加上 Batch API(如果可以接受非即時):
- 所有費用再打 5 折
- 月費合計:約 $690
從 $3,000 降到約 $690——省了 77%。
⚠️ 2026-09-01 起要重算: Sonnet 5 標準價 $3/$15 是優惠價的 1.5 倍,上面每一項也同步乘 1.5——未優化月費變成 $4,500、只開 Prompt Caching 約 $2,070、再加 Batch API 約 $1,035。省下來的比例一樣是 77%,但絕對金額多了一半。

Claude API 企業採購,就找 CloudInsight
CloudInsight 提供 Claude API 企業採購服務:
- 享企業專屬折扣,比 Anthropic 官方定價更優惠
- 協助設定 Prompt Caching 與 Batch API,最大化省錢效果
- 台灣統一發票 + 中文技術支援
Claude API 免費試用與入門方案|從零開始最省的方法
Answer-First: Anthropic Console 提供 API 試用額度,新帳號註冊後即可使用。試用額度足夠進行功能測試和原型驗證,但速率限制嚴格,不適合生產環境。額度金額與速率限制的具體數字,Anthropic 會依帳號等級調整,請以 Anthropic 官方定價/速率限制頁與你自己 Console 後台顯示的數字為準,不要沿用網路上流傳的固定數字。
免費額度申請步驟
- 前往 Anthropic Console 註冊帳號
- 驗證 Email
- 系統自動發放試用 Credit(金額以官網公告為準)
- 在 API Keys 頁面建立 API Key
- 開始呼叫 API
免費版速率限制
免費/試用層級有 RPM(每分鐘請求數)、TPM(每分鐘 Token 數)與每日請求上限,且不是每個模型都開放。這些門檻 Anthropic 會不定期調整,登入 Console 後台查看自己帳號的實際限制最準。
從免費升級到付費
綁定信用卡並儲值後,速率限制會依據儲值金額與累計消費逐步放寬(Anthropic 的 Tier 制度)。各 Tier 的門檻金額與對應 RPM 請以官方頁面為準——這組數字改動頻繁,本文不列固定數值以免誤導採購預估。
台灣用戶注意: Anthropic 對台灣信用卡的支援度比 OpenAI 更不穩定。許多台灣開發者反映付款被拒。這時候透過 CloudInsight 代購 是最快的解決方案。
想了解更多免費 AI API 的選擇?請參考 免費 AI API 推薦與限制說明。

FAQ:Claude API 費用常見問題
Claude API 跟 ChatGPT API 哪個比較便宜?
取決於你選的模型等級。以中階模型比較:Claude Sonnet 5 導入優惠期是 $2/$10,OpenAI 的 gpt-5.6-terra 是 $2.50/$15,優惠期間 Claude 兩邊都比較便宜。2026-09-01 之後 Sonnet 5 回到 $3/$15,Input 就會略貴一點、Output 打平。再加上 Claude 的 Prompt Caching 省 90%,大量使用的場景通常仍是 Claude 較省。建議依實際用量計算。
Claude API 的 Prompt Caching 怎麼開啟?
在 API 請求中使用 cache_control 參數,將 System Prompt 標記為可快取。首次請求會寫入快取(5 分鐘快取收 1.25 倍、1 小時快取收 2 倍),之後的請求命中快取只收標準 Input 價的 0.1 倍(省 90%)。預設快取有效期為 5 分鐘,如果超過時間沒有新請求,快取會失效;長間隔的流量可以改用 1 小時快取。
Claude API 可以用台幣付款嗎?
Anthropic 目前只接受美元付款。台灣用戶可以使用支援國際交易的 Visa 或 Mastercard 信用卡,但可能會被收取海外交易手續費(通常 1.5%)。若要換算台幣,以 1 美元約 32 元估算,實際依匯率與手續費而異。透過 CloudInsight 採購可以用台幣付款並取得統一發票。
Claude Opus 值得用嗎?還是 Sonnet 就夠了?
多數場景用 Sonnet 5 就夠了。Opus 4.8 在複雜推理、長流程自動化、超長文件分析方面有明顯優勢,費用是 Sonnet 5 標準價的約 1.7 倍($5/$25 對 $3/$15);在 Sonnet 5 導入優惠期間(至 2026-08-31)則約 2.5 倍。建議先用 Sonnet 5 測試,如果品質不滿意再升級到 Opus 4.8,最難的任務才考慮 Fable 5($10/$50)。很多團隊的做法是:日常用 Sonnet,關鍵任務才切 Opus。
Claude API 有企業方案嗎?
有。Anthropic 提供企業方案(Enterprise),包含更高的速率限制、專屬客服和 SLA 保障。此外,透過 CloudInsight 等代理商採購,可以取得額外的批量折扣和在地技術支援。
善用 Claude API 的每一分錢|省錢策略總整理
Claude API 的定價在三大 AI API 中屬於中等偏上。但它有兩個殺手級優勢:Prompt Caching 命中只收 0.1 倍(省 90%),以及 Fable 5、Opus 4.8/4.7/4.6、Sonnet 5、Sonnet 4.6 內建 100 萬 Token 上下文且以標準價計費。
四個立即可行的行動:
- 開啟 Prompt Caching——如果你的 System Prompt 超過 1,000 Token,這是必做的事
- 非即時任務用 Batch API——直接省 50%,沒有理由不用
- 依任務選模型——不要全部用 Fable 5 或 Opus,把預算花在刀口上
- 把 9 月的預算重算一次——Sonnet 5 導入優惠 2026-08-31 到期,9/1 起單價漲 50%
想更全面地了解 AI API 的成本優化方法?請參考 LLM API 成本優化實戰指南。
企業大量採購 Claude API 有更多折扣選擇,請參考 AI API 企業採購指南。
立即取得 Claude API 企業最優方案
CloudInsight 是台灣在地的 AI API 企業採購代理:
- Claude API 企業折扣,比官價更優惠
- Prompt Caching + Batch API 設定指導
- 台灣統一發票,解決報帳難題
- 中文即時技術支援
參考資料
- Anthropic - Claude API 官方定價頁:https://platform.claude.com/docs/en/about-claude/pricing (2026-07-22 查證)
- Anthropic - Prompt Caching Documentation
- Anthropic - Batch API Documentation
- Anthropic - Rate Limits and Usage Tiers
- Anthropic - Extended Thinking Documentation
延伸閱讀
- 最新定價情報:Claude Fable 5 完整指南(輸入 $10/輸出 $50 per MTok,Opus 4.8 的 2 倍)
- Fable 5 API 價格完整解析:定價與用量成本試算
相關文章
Claude AI 是什麼?2026 年 Anthropic Claude 完整指南(API、功能、使用教學)
2026 年 Claude AI 完整指南!深入了解 Anthropic Claude 是什麼、Claude API 功能特色、使用教學與定價方案,一篇掌握 Claude 的所有資訊。
AI APIAI API 費用比較|2026 最新 OpenAI、Claude、Gemini 定價完整攻略
2026 最新 AI API 費用比較!完整分析 OpenAI、Claude、Gemini 定價方案與 Token 計費方式,一次掌握各家 LLM API 成本差異,幫你找到最划算的 AI API 選擇。
AI APILLM API 成本優化|2026 年降低 AI API 費用的 7 個實戰策略
2026 LLM API 成本優化實戰指南!7 個降低 AI API 費用的策略,從模型選擇、Prompt 優化到批次處理與代理商折扣,幫企業有效控制 AI 開支,最高省 70%。