AI API 費用比較|2026 最新 OpenAI、Claude、Gemini 定價完整攻略
AI API 費用比較|2026 最新 OpenAI、Claude、Gemini 定價完整攻略
為什麼你需要搞懂 AI API 費用?省錢從理解計費開始
你知道嗎?同樣生成 1000 字的文章摘要,用 Claude Fable 5 和 Gemini 2.5 Flash-Lite 的費用可以差到 100 倍以上。
選錯模型,一個月下來可能白白多花數千美元。更可怕的是,很多團隊根本不知道自己的 AI API 帳單為什麼越來越高——因為他們從來沒認真比較過各家的定價結構。
這篇文章會把 2026 年三大 AI API 平台(OpenAI、Claude、Gemini)的費用攤開來一項一項比,幫你找到「夠用又最省」的最佳組合。
想直接取得企業折扣方案?聯繫 CloudInsight 專業團隊,為您規劃最省的 AI API 採購方案。

TL;DR
2026 年 AI API 費用差異巨大:Gemini 2.5 Flash-Lite 最便宜(Input $0.10/百萬 Token),Claude Fable 5 最貴但能力最強。企業透過代理商批量採購可再省 10-20%。
三大 AI API 費用總覽表|Token 定價一次看完
Answer-First: 截至 2026 年 7 月,AI API 的費用從每百萬 Input Token $0.10(Gemini 2.5 Flash-Lite)到 $10(Claude Fable 5)不等,Output 端價差更大($0.40 至 $50)。選擇正確的模型等級,是控制成本的第一步。
以下是三大平台現行主要模型的 Token 定價對比:
| 平台 | 模型 | Input(每百萬 Token) | Output(每百萬 Token) | 定位 |
|---|---|---|---|---|
| OpenAI | GPT-5.6 Sol | $5.00 | $30.00 | 旗艦 |
| OpenAI | GPT-5.6 Terra | $2.50 | $15.00 | 平衡 |
| OpenAI | GPT-5.6 Luna | $1.00 | $6.00 | 高性價比 |
| OpenAI | GPT-5.4-mini | $0.75 | $4.50 | 輕量 |
| OpenAI | GPT-5.4-nano | $0.20 | $1.25 | 最省 |
| Anthropic | Claude Fable 5 | $10.00 | $50.00 | 最高階(Mythos 級) |
| Anthropic | Claude Opus 4.8 | $5.00 | $25.00 | 旗艦 |
| Anthropic | Claude Sonnet 5 | $2.00 | $10.00 | 平衡(優惠價,見下方) |
| Anthropic | Claude Haiku 4.5 | $1.00 | $5.00 | 輕量快速 |
| Gemini 3.6 Flash | $1.50 | $7.50 | 主力 | |
| Gemini 3.1 Pro Preview | $2.00 | $12.00 | 高階推理 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 高吞吐 | |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | 全表最省 |
價格來源:OpenAI 官方定價、Claude 官方定價、Gemini API 官方定價(2026 年 7 月查核)
⏰ 兩個有時效的重點
1. Claude Sonnet 5 現在是優惠價,8 月底到期 $2/$10 是導入優惠,2026 年 9 月 1 日起調回 $3/$15(漲 50%)。如果你的預算是照 Sonnet 5 現價估的,記得把 9 月後的調漲算進去。
2. 已停用/退役的模型別再寫進程式
- Gemini 2.0 Flash、2.0 Flash-Lite:2026 年 6 月 1 日已關閉
- Claude Opus 4.1:已 deprecated;Opus 4、Sonnet 4、Haiku 3.5:已退役(僅部分雲平台仍可用)
⚠️ 比價前必知:Token 數本身不可比
這是多數比較文章不會講的一點。Anthropic 官方文件載明,Claude Opus 4.7 以後的機種、Fable 5、Mythos 5 與 Sonnet 5 改用了新的 tokenizer,同一段文字會產生約多 30% 的 token。
意思是:拿「每百萬 token 單價」直接比,會低估這些新機種的實際成本約三成。真正要比的是「跑完同一個任務要花多少錢」,不是貼牌單價。下方的實測比較段落就是照這個原則算的。
Token 計費方式說明
什麼是 Token?簡單說,1 個 Token 大約等於:
- 英文:0.75 個單字(即 1000 Token ≈ 750 個英文字)
- 中文:0.5 個字(即 1000 Token ≈ 500 個中文字)
AI API 計費分為 Input Token(你傳給 AI 的內容)和 Output Token(AI 回傳給你的內容)。Output Token 通常比 Input Token 貴 2-5 倍。
這代表什麼?如果你要 AI 生成一篇 2000 字的中文文章(約 4000 Token output),使用不同模型的成本差異如下:
| 模型 | Output 單價 | 單次生成成本 | 每月 100 篇成本 |
|---|---|---|---|
| Claude Fable 5 | $50/1M | $0.20 | $20.00 |
| Claude Opus 4.8 | $25/1M | $0.10 | $10.00 |
| GPT-5.6 Sol | $30/1M | $0.12 | $12.00 |
| Claude Sonnet 5 | $10/1M | $0.04 | $4.00 |
| Gemini 3.6 Flash | $7.50/1M | $0.03 | $3.00 |
| GPT-5.6 Luna | $6/1M | $0.024 | $2.40 |
| Gemini 2.5 Flash-Lite | $0.40/1M | $0.0016 | $0.16 |
以 4000 output token 計。使用新 tokenizer 的機種(Fable 5、Opus 4.8、Sonnet 5)實際 token 數會再多約 30%,成本要往上修。
差距一目了然:最貴與最便宜之間相差超過 100 倍。
OpenAI API 費用詳解|GPT-5.6 三個級距怎麼選
Answer-First: GPT-5.6 於 2026 年 7 月 9 日正式上線,一次推出 Sol、Terra、Luna 三個級距。對多數任務來說 Luna 是性價比之王,只有需要最強推理時才值得用 Sol。
OpenAI 的產品線最完整,但定價也最複雜。讓我幫你拆解:
GPT-5.6 Sol:旗艦級,適合高難度任務
Sol 是 GPT-5.6 家族最強的一階。Input $5/百萬 Token,Output $30/百萬 Token。
適合場景:
- 複雜的邏輯推理與分析
- 高品質的長文生成
- 需要最強 Benchmark 表現的場景
不適合:日常文字處理、大量批次任務、預算有限的專案
GPT-5.6 Terra:主力選手,性能與價格平衡
Terra 是平衡取向的一階。Input $2.50/百萬 Token,Output $15/百萬 Token,價格是 Sol 的一半。
GPT-5.6 Luna:性價比之王
如果你的任務不需要最頂級的推理能力,Luna 絕對值得考慮。Input 只要 $1/百萬 Token、Output $6/百萬 Token,是 Sol 的五分之一價,但多數基礎任務上表現足夠。
更省的選擇:GPT-5.4-mini/nano
預算極度敏感時,前一代的 5.4 系列仍在售且更便宜:
- GPT-5.4-mini:$0.75/$4.50
- GPT-5.4-nano:$0.20/$1.25(OpenAI 全線最省)
OpenAI 省錢機制
- Batch API:非即時任務可用批次模式,享 50% 折扣
- Cached Input:重複的 System Prompt 自動快取,省 50%
- Fine-tuning:訓練後的小模型可替代大模型,長期更省
想了解 OpenAI API 的完整費用細節?請參考 OpenAI API 費用全解析。

Claude API 費用詳解|Prompt Caching 最高省 90% 成本
Answer-First: Claude API 的最大優勢是 Prompt Caching 機制,能把重複的長 Prompt 費用降低 90%。對需要大量使用 System Prompt 的應用來說,Claude 可能比 OpenAI 更省錢。
Anthropic 的 Claude 模型家族現在分四個等級:
Fable 5:Mythos 級,最高階
Fable 5 是 Anthropic 目前公開販售的最高階模型。Input $10/百萬 Token,Output $50/百萬 Token。同級還有限量開放的 Mythos 5(同價)。想看 Fable 5 的完整用量成本試算與台灣採購管道,見 Claude Fable 5 API 價格完整解析。
Opus 4.8:旗艦
Opus 4.8 是主力旗艦。Input $5/百萬 Token,Output $25/百萬 Token——跟 GPT-5.6 Sol 完全同價。
補充:Opus 4.1($15/$75)已 deprecated。如果你看到「Claude 旗艦要 $15/$75」的說法,那是舊價,現行 Opus 已降到 $5/$25。
Sonnet 5:最佳平衡(優惠中)
Sonnet 5 是多數團隊的首選。目前 Input $2/百萬 Token、Output $10/百萬 Token,但這是導入優惠——2026 年 9 月 1 日起調為 $3/$15。
搭配 100 萬 token 的 Context Window(標準價內含,不另外加價),特別適合需要處理長文件的場景。
Haiku 4.5:快速低成本
Haiku 是輕量級選手。Input $1/百萬 Token,Output $5/百萬 Token。速度最快,適合即時回應的 Chatbot 和大量批次處理。
Claude 省錢三大招
- Prompt Caching:快取 System Prompt,讀取只需原價的 10%。如果你的應用有固定的長 System Prompt(例如客服機器人的設定),這功能超級實用。
- Batch API:非即時任務享 50% 折扣,最多等 24 小時出結果。
- Extended Thinking:開啟思考模式雖然會多花 Token,但能提高複雜任務的準確率,減少重試成本。
更多 Claude API 定價細節,請參考 Claude API 定價方案完整攻略。
Gemini API 費用詳解|免費額度最大方的 AI API
Answer-First: Gemini API 仍是三大平台中唯一在多數文字模型上提供免費層級的,適合原型驗證。但 Google 已不再公佈固定的免費額度數字。
Google AI Studio 免費層級
Gemini 多數文字模型仍有免費 token,包含 3.6 Flash、3.5 Flash、3.5 Flash-Lite、3.1 Flash-Lite 與 2.5 系列。
但要注意:Google 官方已不再公佈固定額度數字。官方速率限制頁寫明額度依帳號使用層級而定,需登入 AI Studio 查自己的即時配額。所以坊間(包含本文舊版)寫的「每分鐘 15 次、每分鐘 100 萬 Token」已不適用。
另外,影像/影片生成類模型(3.1 Flash Image、3 Pro Image)與 Pro Preview 系列沒有免費層級,測試就開始計費。
Vertex AI 企業版
企業用戶建議使用 Vertex AI,享有更高的 Rate Limit 和 SLA 保障。
Context Window:已經不是 Gemini 獨有優勢了
Gemini 長期的賣點是 100 萬 Token 的 Context Window。但 2026 年這個差距已被追平——Claude Fable 5、Opus 4.8/4.7/4.6、Sonnet 5 與 Sonnet 4.6 都已內含 100 萬 token 上下文,且以標準價計費(90 萬 token 的請求與 9 千 token 的請求同一個單價)。
所以選型時,長上下文本身不再是選 Gemini 的決定性理由,要回頭比單價與實際任務成本。
想了解完整的 Gemini API 功能?請參考 Gemini API 完整指南。
想知道還有哪些免費 AI API 可以用?看看 免費 AI API 推薦。

三大 AI API 費用對比分析|同一任務的實際花費測試
Answer-First: 依官方單價換算,同一任務在最省與最貴機種之間的成本可差 100 倍以上。但成本只是選型的一半——品質請以你自己的任務實測為準,本節不提供無來源的品質評分。
關於品質評分:本文舊版曾列出各模型的「品質評分 9.5/10」這類數字。那些分數沒有可查證的來源,已全部移除。下方只保留依官方公告單價實算的成本,品質請以你自己的任務實測為準——不同任務的模型排名差很多,任何單一評分表都可能誤導。
以下用三個常見場景,換算各模型的實際花費(僅成本,非品質評比):
場景一:生成 1000 字中文文章摘要
假設輸入 3,000 token、輸出 1,500 token:
| 模型 | 單次成本 |
|---|---|
| Claude Fable 5 | $0.105 |
| GPT-5.6 Sol | $0.060 |
| Claude Opus 4.8 | $0.053 |
| Claude Sonnet 5 | $0.021 |
| Gemini 3.6 Flash | $0.016 |
| GPT-5.6 Luna | $0.012 |
| GPT-5.4-nano | $0.0025 |
| Gemini 2.5 Flash-Lite | $0.0009 |
場景二:分析 50 頁 PDF 文件
假設輸入 100,000 token、輸出 2,000 token:
| 模型 | 單次成本 | 備註 |
|---|---|---|
| Claude Fable 5 | $1.10 | 內含 100 萬 token 上下文 |
| GPT-5.6 Sol | $0.56 | |
| Claude Opus 4.8 | $0.55 | 內含 100 萬 token 上下文 |
| Gemini 3.1 Pro Preview | $0.22 | |
| Claude Sonnet 5 | $0.22 | 優惠價,9 月起漲為 $0.33 |
| Gemini 3.6 Flash | $0.165 | |
| Gemini 2.5 Flash-Lite | $0.011 |
場景三:生成 Python 程式碼
假設輸入 1,500 token、輸出 3,000 token(程式碼輸出長):
| 模型 | 單次成本 |
|---|---|
| Claude Fable 5 | $0.165 |
| GPT-5.6 Sol | $0.098 |
| Claude Opus 4.8 | $0.083 |
| Claude Sonnet 5 | $0.033 |
| Gemini 3.6 Flash | $0.025 |
| GPT-5.6 Luna | $0.0195 |
上述為依官方單價的算術結果。使用新 tokenizer 的 Claude 機種(Fable 5、Opus 4.8、Sonnet 5)實際 token 數約多 30%,成本要再往上修約三成。
關鍵發現: 沒有「一個模型打天下」的最佳選擇。輸出愈長,Output 單價的影響愈大——場景三輸出 token 是輸入的兩倍,Output 貴的機種立刻拉開差距。聰明的做法是依任務類型搭配不同模型。
想了解更詳細的 AI API 比較?請參考 AI API 怎麼選?完整比較指南。
AI API 省錢五大策略|企業必學的成本優化方法
Answer-First: 根據實務經驗,善用以下五個策略,企業可以將 AI API 費用降低 40-70%。
策略一:依任務分流模型
不是所有任務都需要最貴的模型。建議建立「模型路由」機制:
- 簡單任務(分類、摘要)→ GPT-5.4-nano 或 Gemini 2.5 Flash-Lite
- 一般任務(文案、翻譯)→ Claude Sonnet 5、Gemini 3.6 Flash 或 GPT-5.6 Luna
- 困難任務(推理、分析)→ GPT-5.6 Sol、Claude Opus 4.8 或 Claude Fable 5
策略二:善用 Prompt Caching
如果你的應用有固定的 System Prompt,一定要開啟 Caching:
- OpenAI Cached Input:省 50%
- Claude Prompt Caching:省 90%
策略三:批次處理降低成本
非即時的任務(如每日報表、批次翻譯),使用 Batch API 可以省 50%。
策略四:監控用量、設定預算上限
每個平台都有 Usage Dashboard,建議:
- 設定月度預算上限
- 設定用量告警(到達 80% 時通知)
- 每週檢視 Token 消耗分布
策略五:透過代理商取得企業折扣
企業批量採購 AI API Token,可以透過代理商取得額外折扣。CloudInsight 提供 OpenAI、Claude、Gemini 的企業採購服務,享折扣優惠與台灣統一發票。
更多成本優化技巧,請參考 LLM API 成本優化策略。
需要更精確的 AI API 費用估算?
CloudInsight 提供 AI API 企業採購服務,享專屬折扣、統一發票與在地技術支援。
FAQ:AI API 費用常見問題
AI API 要錢嗎?有沒有完全免費的選擇?
各大 AI API 都提供免費額度。Gemini API 的免費版最慷慨,每分鐘 15 次請求。OpenAI 新帳號有 $5 免費額度(3 個月有效)。Claude 也有免費試用額度。不過,免費額度通常有速率限制,不適合生產環境使用。
AI API 一個月大概要花多少錢?
完全取決於用量和選用的模型。個人小專案每月可以控制在 $5-20 以內。中型企業的常見月費在 $100-1,000 之間。大型企業可能每月花費 $10,000 以上。選擇合適的模型等級是控制成本的關鍵。
開發者該選哪個 AI API 最便宜?
純粹比價的話,Gemini 2.5 Flash-Lite 最便宜(Input $0.10/Output $0.40 每百萬 Token)。但「便宜」不等於「最佳選擇」——你還需要考慮模型能力、API 穩定度和社群支援。建議先用免費層級測試,再決定付費方案。
Token 到底是什麼?怎麼計算費用?
Token 是 AI 處理文字的最小單位。1000 個 Token 大約等於 750 個英文字或 500 個中文字。AI API 按照 Input Token(你傳入的文字量)和 Output Token(AI 回傳的文字量)分別計費,Output 通常比 Input 貴 2-5 倍。
企業大量使用 AI API 有折扣嗎?
有。OpenAI 和 Anthropic 都提供企業方案(Enterprise),根據用量給予階梯折扣。另外,透過 CloudInsight 等代理商採購,可以取得額外折扣、統一發票和在地技術支援。
選擇最適合你的 AI API|費用不是唯一考量

選擇 AI API 時,費用當然重要,但不是唯一考量。以下是我的建議:
- 預算有限、個人開發者 → Gemini Flash(免費額度大、價格最低)
- 一般企業應用 → Claude Sonnet 5、Gemini 3.6 Flash 或 GPT-5.6 Terra(性能與價格平衡)
- 需要最強能力 → GPT-5.6 Sol、Claude Opus 4.8 或 Claude Fable 5(依任務選擇)
- 需要統一發票、在地支援 → 透過 CloudInsight 企業採購
AI API 的世界變化很快,定價和模型能力每幾個月就會更新。建議定期回來查看這篇文章的最新資訊。
立即諮詢,取得最適合您的 AI API 方案
CloudInsight 提供 OpenAI、Claude、Gemini 企業採購服務:
- 企業專屬折扣,比官價更優惠
- 台灣統一發票,解決報帳難題
- 中文技術支援,問題即時解決
參考資料
- OpenAI Platform - Pricing(2026)
- Anthropic - Claude API Pricing(2026)
- Google AI for Developers - Gemini API Pricing(2026)
- OpenAI - Tokenizer Documentation
- Anthropic - Prompt Caching Documentation
延伸閱讀
- 計費模式趨勢:TaaS 是什麼?AI 時代 Token 計費解析(2026-06)
- GPT-5.6 Sol/Terra/Luna 三階怎麼選?三大雲平台上架解析
相關文章
TaaS 是什麼?2026 AI 時代 Token 計費解析:你付的不是月費
2026 年軟體計費正從 SaaS 月費轉向 TaaS 按 token 計量。本文依 TechNews 與 Anthropic 官方資料,解析 AI token 是什麼、思考 token 為何讓帳單暴增、Claude 與 Gemini 的額度方案差異,並提供台灣企業估算與控管 token 成本的四個步驟與採購建議。
AI APIAI API 怎麼選?2026 年 OpenAI vs Claude vs Gemini 完整比較指南
2026 年 AI API 怎麼選?完整比較 OpenAI、Claude、Gemini API 的功能、價格、性能差異,從模型能力到企業決策框架,幫企業和開發者做出最佳選擇。
AI APIAI API 企業採購指南|2026 年代理商選擇、折扣方案與合規流程全攻略
2026 年 AI API 企業採購完整指南!從代理商選擇、企業折扣方案、開發票流程到統一管理平台,幫助企業高效導入 AI API 服務,解決付款與合規難題。