Gemini API 是什麼?2026 最新 Google Gemini API 串接、定價與開發完整指南
Gemini API 是什麼?2026 最新 Google Gemini API 串接、定價與開發完整指南
Google Gemini API 正在改變 AI 開發的遊戲規則
Google 在 2024 年底推出 Gemini 2.0,不過 Gemini 2.0 Flash 與 2.0 Flash-Lite 已於 2026 年 6 月 1 日停用;到了 2026 年,主力已換成 Gemini 3.x 家族,Gemini API 也成為全球開發者最常使用的 AI API 之一。
為什麼?
因為它把超長 Context Window 放在主線產品上。這代表你可以把一整本書、一段 2 小時的影片,或是上千頁的 PDF 一次丟給 AI 分析。(要提醒的是,長上下文在 2026 年已經不是 Gemini 獨有——Claude 現行機種也內含 100 萬 Token 上下文,且以標準價計費。)
而且,輕量機種的價格相當低——Gemini 2.5 Flash-Lite 每百萬 Input Token 只要 $0.10,約為 OpenAI 旗艦 gpt-5.6-sol($5.00)的五十分之一。
需要 Gemini API 企業方案?透過 CloudInsight 取得更優價格,享統一發票與在地技術支援。
這篇指南會帶你從零開始,搞懂 Gemini API 的所有細節:模型架構、申請流程、串接方法、定價計費,以及它跟 OpenAI、Claude 的真實差異。

TL;DR
Gemini API 是 Google 推出的 AI 模型 API 服務,主線分 Pro、Flash、Flash-Lite 三條產品線(另有 Embedding 模型)。Flash-Lite 是性價比首選(Gemini 2.5 Flash-Lite $0.10/$0.40 每百萬 Token),Pro 適合複雜任務,超長 Context Window 是最大亮點。透過 Google AI Studio 可免費開始使用,企業可透過 Vertex AI 或代理商取得更好方案。
Google Gemini API 的核心定位與模型架構
Answer-First: Gemini API 是 Google 提供的大型語言模型 API 服務,主線分為 Pro(高效能)、Flash(主力)、Flash-Lite(輕量高速)三條產品線,另有 Embedding 向量模型,開發者可根據需求選擇最適合的模型。
Gemini 模型家族總覽(Pro、Flash、Flash-Lite)
截至 2026 年 7 月,官方定價頁上的 Gemini 模型陣容如下:
| 模型 | 定位 | 最適用場景 |
|---|---|---|
| Gemini 3.1 Pro Preview | 高效能旗艦(Preview) | 複雜推理、程式碼生成、長文檔分析 |
| Gemini 3.6 Flash | 現行主力(2026-07-21 發布) | 大量呼叫、即時回應 |
| Gemini 3.5 Flash | 平衡型 | 一般文字生成、摘要、分類 |
| Gemini 3.5 Flash-Lite | 輕量高速(2026-07-21 發布) | 高併發、成本敏感場景 |
| Gemini 3.1 Flash-Lite | 輕量,音訊另計 | 語音處理、批次任務 |
| Gemini 3 Flash Preview | Flash 世代 Preview | 嘗鮮測試 |
| Gemini 2.5 Pro/2.5 Flash/2.5 Flash-Lite | 上一代,仍在售 | 既有系統延用、極低成本需求 |
| Gemini Embedding | 向量嵌入 | 檢索、RAG |
2026 年 7 月的最新動態(Google 官方公告):
- Google 於 2026-07-21 發布 Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber
- 3.6 Flash 完成同樣任務的輸出 Token 比 3.5 Flash 少約 17%
- 3.5 Flash-Lite 官方引用 Artificial Analysis 數據為每秒 350 個 output token
- 3.5 Flash Cyber 是資安專用機種,目前僅限政府與信任夥伴透過 CodeMender 試點,無公開定價
- Gemini 3.5 Pro 尚未發布(內部延遲),Google 已開始 pre-train Gemini 4
已停用機種(不要再寫進新專案):
- Gemini 2.0 Flash、2.0 Flash-Lite:2026-06-01 關閉
- Veo 2、Veo 3:2026-06-30 關閉
- Imagen 4:2026-08-17 關閉
Flash 系列是目前最多開發者使用的版本。原因很簡單——便宜、快、夠用。
對於大部分文字生成、摘要、分類的任務,Flash-Lite 的品質已經足夠好,而 Gemini 2.5 Flash-Lite 的 Input 單價($0.10)只有 Gemini 3.1 Pro Preview($2.00)的二十分之一。
Gemini API 與 Vertex AI 的差異
很多人搞混這兩個東西。簡單說:
- Google AI Studio(Gemini API):適合個人開發者、原型開發、小規模專案。申請簡單,有免費額度。
- Vertex AI(Gemini on Vertex):適合企業級部署。有 SLA、VPC 安全、細粒度權限控管。
如果你只是想測試 Gemini API 的能力,用 Google AI Studio 就夠了。
如果你的企業需要正式上線,建議走 Vertex AI,或是透過 CloudInsight 的 AI API 代購方案統一管理。
為什麼開發者選擇 Gemini API
三個核心理由:
- 超長 Context Window:可以塞進一整本書或 2 小時影片
- 原生多模態:文字、圖片、音訊、影片一個 API 通吃
- 價格競爭力:Flash-Lite 系列是目前主流 AI API 中最便宜的選項之一
但老實說,Gemini API 也有缺點。它在中文創意寫作方面的表現,目前還是不如 Claude。程式碼生成的準確度,也稍微落後 OpenAI 的 GPT-5.6 系列。選 API 不能只看價格,要看你的實際使用場景。
Gemini API 申請與環境建置流程
Answer-First: 申請 Gemini API 只需要一個 Google 帳號,5 分鐘內就能取得 API Key 並開始呼叫。進入 Google AI Studio → 建立 API Key → 安裝 SDK → 完成第一次呼叫。
取得 API Key 的步驟
- 前往 Google AI Studio
- 用你的 Google 帳號登入
- 點擊左側選單的「Get API Key」
- 選擇或建立一個 Google Cloud 專案
- 點擊「Create API Key」
- 複製並安全儲存你的 API Key
整個過程不到 5 分鐘。而且不需要綁定信用卡——Google AI Studio 有免費層級可以直接開始測試。要注意的是,Google 目前已不再公佈固定的免費額度數字,實際可用量依帳號的使用層級而定,請以官方速率限制說明與登入後的 AI Studio 額度頁為準。
想了解完整的申請步驟和 Console 操作,請參考 Gemini API 申請與 Console 設定教學。
Google AI Studio 與 Gemini AI Console 操作
Google AI Studio 是一個網頁版的 Playground,你可以:
- 直接在瀏覽器中測試不同 Prompt
- 上傳圖片、音訊、影片做多模態測試
- 調整 Temperature、Top-P 等參數
- 將測試結果直接匯出為程式碼
Gemini AI Console 則是更偏向管理面的工具,用來查看用量、管理 API Key、設定配額。
開發環境需求與 SDK 安裝
Python 是最多人用的語言。安裝只需要一行指令:
pip install google-genai
注意:舊的
google-generativeai套件已停止維護,請改用 Google 官方統一的google-genaiSDK。
最低需求:
- Python 3.9 以上
google-genai套件(建議用最新版)- 網路連線(API 呼叫需要)
完整的 Python 串接教學,包含程式碼範例和進階技巧,請看 Gemini API Python 串接完整教學。

Gemini API 功能與呼叫方式解析
Answer-First: Gemini API 支援文字生成、多模態理解(圖片/音訊/影片)、Function Calling、JSON Mode 等四大核心功能,開發者可透過 REST API 或官方 SDK 呼叫。
文字生成(Text Generation)
最基本的用法。傳入 Prompt,取回 AI 生成的文字。
from google import genai
client = genai.Client(api_key="YOUR_API_KEY")
response = client.models.generate_content(
model="gemini-2.5-pro",
contents="用 100 字介紹台灣的特色小吃"
)
print(response.text)
這段程式碼短短幾行就能跑起來。Gemini API 的 SDK 設計得非常簡潔。
多模態輸入(圖片、音訊、影片理解)
這是 Gemini API 最大的競爭優勢之一。你可以同時傳入文字和圖片:
import PIL.Image
img = PIL.Image.open("receipt.jpg")
response = client.models.generate_content(
model="gemini-2.5-pro",
contents=["請幫我辨識這張收據的金額", img]
)
也支援音訊和影片。你可以上傳一段 YouTube 影片的連結,讓 Gemini 幫你生成摘要。
函式呼叫(Function Calling)
Function Calling 讓 AI 可以「呼叫你定義的函式」。例如查天氣、查資料庫、呼叫外部 API。
這個功能在建置 AI Agent 時特別有用。你定義好函式清單,Gemini 會判斷什麼時候該呼叫哪個函式,並自動帶入正確的參數。
結構化輸出(JSON Mode)
需要 AI 回傳特定格式?JSON Mode 可以強制 Gemini 輸出符合你定義的 JSON Schema。
from google.genai import types
response = client.models.generate_content(
model="gemini-2.5-pro",
contents="列出 3 個台灣城市的人口數",
config=types.GenerateContentConfig(
response_mime_type="application/json"
)
)
這對需要將 AI 輸出接進後端流程的開發者來說,非常實用。不再需要自己寫正則表達式去解析 AI 的自由文字回覆。
Gemini API 定價與 Token 計費機制
Answer-First: Gemini API 採用按 Token 計費。現行主力 Gemini 3.6 Flash 為每百萬 Token $1.50(Input)/$7.50(Output);最便宜的一檔是仍在售的 Gemini 2.5 Flash-Lite($0.10/$0.40)。免費層級仍在,但 Google 已不再公佈固定額度數字。
各模型 Token 單價比較表
| 模型 | Input(每百萬 Token) | Output(每百萬 Token) | 備註 |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | 2026-07-21 發布,現行主力 |
| Gemini 3.5 Flash | $1.50 | $9.00 | |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | 2026-07-21 發布 |
| Gemini 3.1 Flash-Lite | $0.25(音訊 $0.50) | $1.50 | 音訊 Input 另計 |
| Gemini 3.1 Pro Preview | $2.00(≤200K)/$4.00(>200K) | $12.00(≤200K)/$18.00(>200K) | 無免費層級 |
| Gemini 3 Flash Preview | $0.50 | $3.00 | |
| Gemini 2.5 Pro | $1.25(≤200K)/$2.50(>200K) | $10.00(≤200K)/$15.00(>200K) | 200K 以上 Context 加價 |
| Gemini 2.5 Flash | $0.30 | $2.50 | |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | 定價頁上最低價 |
| Gemini Embedding | $0.15 | — | 向量嵌入 |
資料來源:Google AI for Developers 官方定價頁,2026 年 7 月查證。舊版本文列出的「Gemini Ultra $5/$20」在官方定價頁查無此機種,已移除;影像/影片生成類機種請直接查官方定價頁。
免費額度與速率限制
Google 已不再公佈固定的免費額度數字(例如舊版本文寫的「每分鐘 15 次、每天 1,500 次」已不再適用)。官方速率限制頁寫明額度依帳號的使用層級(Tier)而定,實際數字要登入後在 AI Studio 額度頁查詢。
另外要注意:
- 影像/影片生成類機種與 Gemini 3.1 Pro Preview 沒有免費層級,一開始就要付費
- 免費額度的資料可能被 Google 用來改善模型。如果你的資料有隱私考量,建議使用付費方案
- 正式上線的產品,免費層級的速率限制通常會是瓶頸
企業用量成本估算範例
假設你的企業每天處理 1,000 個客服問題,每個問題平均需要 2,000 Token Input + 500 Token Output。換算下來,一天是 200 萬 Input Token + 50 萬 Output Token:
| 模型 | 每日成本 | 每月成本(30 天) |
|---|---|---|
| Gemini 2.5 Flash-Lite | $0.40 | $12.00 |
| Gemini 3.5 Flash-Lite | $1.85 | $55.50 |
| Gemini 3.6 Flash | $6.75 | $202.50 |
| Gemini 3.1 Pro Preview(≤200K) | $10.00 | $300.00 |
算法拆給你看(以 Gemini 3.6 Flash 為例):Input 2M × $1.50/1M = $3.00,Output 0.5M × $7.50/1M = $3.75,合計每日 $6.75。
同一條流量,走 Gemini 2.5 Flash-Lite 一個月 12 美元,走 Gemini 3.1 Pro Preview 要 300 美元,差距 25 倍。模型選型直接等於成本結構,別預設一律用旗艦。
想了解企業折扣方案?聯繫 CloudInsight,我們提供 Gemini API 批量採購折扣與統一發票。
想知道各家 AI API 的費用差異?請參考 AI API 費用比較完整指南。
Gemini API vs OpenAI API vs Claude API 技術比較
Answer-First: 三大 AI API 各有強項——Gemini 贏在價格和 Context Window,OpenAI 贏在生態系和通用能力,Claude 贏在長文分析和安全性。沒有「最好」的 API,只有「最適合你的」API。
模型能力比較怎麼看
舊版本文在這裡放了一張各家模型的「能力評分表」,但那份評分沒有可查證的來源,已整組移除。模型能力排名在 2026 年幾個月就翻一次,任何沒附出處的分數都不該當採購依據——品質請以你自己的任務實測為準(拿你真實的 Prompt 與資料跑一輪 A/B 比對)。
可以直接查證的是價格,往下看。
定價比較表
| 模型等級 | Gemini | OpenAI | Claude |
|---|---|---|---|
| 旗艦級 | 3.1 Pro Preview $2.00/$12.00(≤200K) | gpt-5.6-sol $5.00/$30.00 | Opus 4.8 $5/$25 |
| 中階 | 3.6 Flash $1.50/$7.50 | gpt-5.6-terra $2.50/$15.00 | Sonnet 5 $2/$10(導入優惠至 2026-08-31,之後 $3/$15) |
| 輕量級 | 2.5 Flash-Lite $0.10/$0.40 | gpt-5.4-nano $0.20/$1.25 | Haiku 4.5 $1/$5 |
價格單位:每百萬 Token(Input/Output),2026 年 7 月查證。來源:Google、OpenAI、Anthropic。
三個必須知道的計價陷阱:
- 單價不能直接跨代比較。Claude 的 Opus 4.7 以後、Fable 5、Mythos 5、Sonnet 5 換了新 tokenizer,同一段文字大約會多產生 30% 的 Token,單價低不等於帳單低。
- 長上下文不一定加價。Gemini 的 Pro 系列超過 200K Context 會跳到較高的單價級距;Claude 的 Opus 4.8/4.7/4.6、Sonnet 5、Sonnet 4.6、Fable 5、Mythos 5 則是 100 萬 Token 上下文內含、以標準價計費。
- 批次與快取能大幅砍價。OpenAI Batch 約 5 折(Priority 則是標準價的 2-4 倍);Anthropic Batch API 的 Input/Output 都是 5 折,Prompt caching 命中只要 0.1 倍(5 分鐘寫入 1.25 倍、1 小時寫入 2 倍)。
還有幾個已退場的機種要避開:Claude Opus 4.1 已 deprecated($15/$75 是它的舊價,別再拿來當「Claude 旗艦價」引用)、Haiku 3.5 已退役(僅部分雲平台可用)、Opus 4 與 Sonnet 4 同樣已退役。
Gemini 的 Flash-Lite 在價格上有明顯優勢。但便宜不代表一定要選它——如果你的應用需要頂級推理能力,OpenAI 與 Anthropic 的旗艦機種仍值得評估。
想深入了解 OpenAI 的方案?請參考 OpenAI API 完整指南。
多語言支援與中文表現
實測結果(非官方基準,CloudInsight 技術團隊內部測試,測試時間為較早的模型世代、尚未在現行版本重測):
- 繁體中文理解:Claude > OpenAI GPT 系列 > Gemini Pro
- 繁體中文生成:Claude > OpenAI GPT 系列 > Gemini Pro
- 簡體中文:OpenAI GPT 系列 ≈ Gemini Pro > Claude
- 程式碼中的中文註解:三者表現相近
各家在 2026 年都改版過好幾輪,上面的排序只能當方向參考,要決定採購前請用你自己的 Prompt 實測一輪。如果你的應用主要面向台灣市場,Claude 的繁體中文表現在我們的測試中確實最好;但如果預算有限,Gemini Pro 搭配好的 Prompt 也能達到不錯的效果。
適用場景分析
- 選 Gemini:大量文件分析、影片理解、成本敏感、需要超長 Context
- 選 OpenAI:通用型 AI 應用、需要最強推理能力、已有 OpenAI 生態整合
- 選 Claude:繁體中文內容生成、長文分析、安全性要求高
想了解更多 AI API 費用差異?請參考 AI API 費用比較完整攻略。

透過 CloudInsight 取得 Gemini API 的優勢
統一管理多家 AI API
大部分企業不會只用一家 AI API。你可能同時用 Gemini 做文件分析、用 OpenAI 做程式碼生成、用 Claude 做客服回覆。
透過 CloudInsight,你可以:
- 一個帳戶管理 Gemini、OpenAI、Claude 的所有 API Key
- 統一查看各家的用量和費用
- 一張發票搞定所有 AI API 支出
企業折扣與 Token 代購方案
直接向 Google 購買 Gemini API,你拿到的是官方定價。
透過 CloudInsight 批量採購,你可以拿到額外的企業折扣。用量越大,折扣越多。
而且不需要自己處理海外付款——很多台灣企業的信用卡在 Google Cloud 付款時會遇到問題,CloudInsight 幫你省去這些麻煩。
台灣在地發票與技術支援
- 統一發票:台灣合規的統一發票,報帳不是問題
- 中文技術支援:台灣時區即時支援,問題不用等到明天
- 合約彈性:月繳或年繳,依你的需求調整
了解更多 AI API Token 採購方案,請參考 AI API Token 代購方案。

常見問題 FAQ
Gemini API 免費嗎?免費額度有多少?
Google AI Studio 有免費層級,但 Google 目前已不再公佈固定的免費額度數字。額度依帳號的使用層級而定,實際可用量請看官方速率限制頁,或登入 AI Studio 額度頁查詢。另外,影像/影片生成類機種與 Gemini 3.1 Pro Preview 沒有免費層級。免費額度適合開發測試,正式上線的應用建議使用付費方案,因為免費版有速率限制,且資料可能被用於模型改善。
Gemini API 支援哪些程式語言?
官方 SDK 支援 Python、Node.js、Go、Dart(Flutter)、Swift、Kotlin。此外,Gemini API 也提供 REST API,任何能發 HTTP 請求的語言都可以呼叫。Python 是目前社群資源最豐富的選擇。
Gemini API 和 Google AI Pro(原 Gemini Advanced)有什麼不同?
先更正一個過時的名稱:「Gemini Advanced」與「Google One AI Premium」這兩個名稱已經不存在,現在對應的是 Google AI Pro(台灣月費 NT$650,含 4 倍用量與 5TB 儲存)。它是面向一般使用者的訂閱方案,透過網頁或 App 操作;Gemini API 則是面向開發者的程式介面,用來把 AI 能力整合進你的應用程式。簡單說:用嘴巴聊天買訂閱方案,寫程式串接用 API。訂閱方案另有免費版(NT$0)、Google AI Plus(NT$165)、Google AI Ultra 5x(NT$3,300)與 20x(NT$6,500)。
如何從 OpenAI API 遷移到 Gemini API?
Gemini API 的呼叫方式與 OpenAI 不同,無法直接替換。但 Google 提供了相容 OpenAI 格式的端點(v1beta/openai),可以減少遷移工作量。主要需要修改的部分:SDK 初始化、模型名稱、回應格式解析。
Gemini API 在台灣可以直接使用嗎?
可以。台灣是 Gemini API 的支援區域。你可以直接用 Google AI Studio 取得 API Key 並開始使用。但如果需要統一發票或企業合約,建議透過 CloudInsight 企業方案處理。
Gemini API 的 Rate Limit 是多少?
沒有可以照抄的固定數字。Google 官方速率限制頁寫明限制依帳號的使用層級(Tier)而定,會隨消費額度調整,實際數字要登入 AI Studio 額度頁查。企業方案可以申請更高的配額。
想從零開始學習 AI API 的基礎概念?請參考 AI API 入門教學。
結論:2026 年 Gemini API 是不可忽視的選項
適合你的才是最好的
Gemini API 不是萬能的。它在某些任務上不如 OpenAI 的 GPT-5.6 系列或 Claude。
但它的超長 Context Window、原生多模態支援,以及極具競爭力的價格,讓它成為 2026 年每個 AI 開發者都應該認真評估的選項。
下一步行動
- 快速體驗:到 Google AI Studio 免費試用
- 學習串接:閱讀 Gemini API Python 串接完整教學
- 了解文件:查看 Gemini API 官方文件與功能導覽
- 企業採購:聯繫 CloudInsight 取得企業方案與折扣
需要多家 AI API 的統一管理方案?CloudInsight 提供 Gemini、OpenAI、Claude API 一站式企業代購,附統一發票與在地技術支援。立即諮詢企業方案,或加入 LINE 官方帳號即時獲得技術支援。
參考資料
- Google AI for Developers — Gemini API 官方文件(https://ai.google.dev/docs)
- Google AI for Developers — Gemini API 官方定價頁(https://ai.google.dev/gemini-api/docs/pricing)
- Google AI for Developers — Gemini API 速率限制(https://ai.google.dev/gemini-api/docs/rate-limits)
- Google AI Studio 額度查詢頁(https://aistudio.google.com/rate-limit)
- Google 官方公告 — Gemini 3.6 Flash/3.5 Flash-Lite/3.5 Flash Cyber(https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/)
- Google Gemini 訂閱方案(台灣)(https://gemini.google/tw/subscriptions/?hl=zh-TW)
- OpenAI — API 官方定價頁(https://developers.openai.com/api/docs/pricing)
- Anthropic — Claude 官方定價頁(https://platform.claude.com/docs/en/about-claude/pricing)
- Google Cloud — Vertex AI Gemini API 定價(https://cloud.google.com/vertex-ai/generative-ai/pricing)
- Google AI Studio(https://aistudio.google.com)
- Gemini API Cookbook — GitHub(https://github.com/google-gemini/cookbook)
相關文章
Gemini 教學|2026 年 Google Gemini API 串接與使用完整教學
2026 年 Gemini 教學!Google Gemini API 串接步驟、註冊教學、Python 程式碼範例,從 Google AI Studio 快速上手 Gemini。
AI APIGemini API Python 串接教學:2026 從零開始呼叫 Google AI 模型
2026 年 Gemini API Python 串接完整教學。從安裝 SDK、取得 API Key 到實作文字生成與圖片理解,附完整程式碼範例,新手也能快速上手 Google Gemini 開發。
AI APIGPT-5.6 來了!2026 OpenAI API 全方位指南:模型能力、串接方式與企業應用
2026 年 GPT-5.6 與 OpenAI API 完整技術指南。從 GPT-5.6 新功能、API 申請註冊、Token 計費到企業級整合,一篇掌握 OpenAI 最新開發資訊與實戰教學。