Gemini 3.5 Flash:完整規格、定價、API 存取與應用場景(2026)
什麼是 Gemini 3.5 Flash?
Gemini 3.5 Flash 是 Google 於2026年5月19日發佈的多模態、具備代理能力的大型語言模型,支援1048576個輸入權杖視窗,並可接受文字、圖片、影片、音訊及PDF輸入,輸出為文字。標準 Gemini API 的定價為每100萬輸入權杖1.50美元、每100萬輸出權杖9.00美元(截至2026年7月)。Google 官方宣布 Gemini 3.5 Flash 是 Gemini 3.5系列的首發版本,專為複雜的代理工作流程、程式設計及長期任務設計。
Google 將 Gemini 3.5 Flash 定位為適用於生產環境的 Flash級模型,適合需要能力、延遲與成本平衡的團隊。該模型可透過 Google AI Studio、Gemini API、Android Studio、Google Antigravity、Gemini Enterprise Agent Platform、Gemini Enterprise、Gemini 應用及搜尋中的 AI 模式存取。
開發者通常會評估 Gemini 3.5 Flash 在程式代理、重構助手、多模態文件處理、支援自動化及長上下文推理工作流程中的表現。從早期 Flash 模型遷移的團隊,可能會在採用新版本前,參考歷史的 Gemini 1.5 Flash 規格 和 Gemini 2.0 Flash 多模態工作流程。
Gemini 3.5 Flash 的主要規格與定價為何?
| 欄位 | 已驗證數值 |
|---|---|
| 提供商 | Google / Google DeepMind(截至2026年7月) |
| 模型系列 | Gemini 3.5(截至2026年7月) |
| 模型類型 | 多模態大型語言模型,適用於代理工作流程、程式設計、長上下文分析及即時聊天(截至2026年7月) |
| 發佈日期 | 2026年5月19日(截至2026年7月) |
| 上下文視窗 | 1048576個輸入權杖(截至2026年7月) |
| 最大輸出權杖 | Google AI for Developers 文件中為65536個輸出權杖;Google Cloud Agent Platform 預設最大輸出權杖為65535(截至2026年7月) |
| 輸入定價 | 標準 Gemini API:每100萬輸入權杖1.50美元;批次/Flex:0.75美元;優先:2.70美元(截至2026年7月) |
| 輸出定價 | 標準 Gemini API:每100萬輸出權杖9.00美元(包含思考權杖);批次/Flex:4.50美元;優先:16.20美元(截至2026年7月) |
| 上下文快取定價 | Google 標準上下文快取:每100萬權杖0.15美元,另加每小時每100萬權杖1.00美元儲存費;批次/Flex快取:每100萬權杖0.08美元(截至2026年7月) |
| Gate.AI 定價 | 輸入1.50美元/100萬,輸出9.00美元/100萬,快取讀取0.15美元/100萬,快取寫入0.08美元/100萬;Gate.AI 定價頁面說明模型價格與提供商單位價格同步(截至2026年7月) |
| 定價單位 | 除非另有說明,均為每100萬權杖美元(截至2026年7月) |
| 模態支援 | 支援文字、圖片、影片、音訊及PDF輸入;輸出為文字(截至2026年7月) |
| API 存取 | Google AI Studio / Gemini API;Google Cloud Gemini Enterprise Agent Platform;Gate.AI 使用模型ID google/gemini-3.5-flash 時採用 OpenAI 相容API格式(截至2026年7月) |
| 提供商模型ID | gemini-3.5-flash(截至2026年7月) |
| Gate.AI模型ID | google/gemini-3.5-flash,由使用者提供;Gate.AI文件驗證了 provider/model-name 的模型ID模式(截至2026年7月) |
| 可用性 | Google 官方公告列明可透過 Gemini API、Google AI Studio、Android Studio、Antigravity、Gemini Enterprise Agent Platform、Gemini Enterprise、Gemini 應用及搜尋中的 AI 模式存取(截至2026年7月) |
| 知識截止日期 | Google AI for Developers 文件中為2025年1月(截至2026年7月) |
| 速率限制 | 截至2026年7月,官方資料未確認單一固定的模型專屬公開速率限制表 |
| 微調支援 | Google Cloud 發佈說明列明 Gemini 3.5 Flash 在公測階段支援有監督微調及強化學習微調,存在地區限制(截至2026年7月) |
| 串流支援 | Gemini API 支援串流生成;Gate.AI 定價FAQ說明串流與非串流均採用權杖計費(截至2026年7月) |
| 批次API支援 | 支援(截至2026年7月) |
| Flex / 優先推理 | 支援(截至2026年7月) |
| 工具/函式呼叫 | 支援函式呼叫、程式碼執行、檔案搜尋、Google Maps 定位、搜尋定位、URL上下文、結構化輸出、思考及快取;僅在預覽階段支援 Computer Use(截至2026年7月) |
| 原生音訊生成 | 不支援(截至2026年7月) |
| 原生圖片生成 | 不支援(截至2026年7月) |
| 即時API | 不支援(截至2026年7月) |
| 授權/使用限制 | Google 專有模型,受相關 Google API、Google Cloud 及平台條款約束;官方資料未說明獨立開放權重授權(截至2026年7月) |
Gemini 3.5 Flash 在生產環境有哪些實用功能?
代理工作流程執行。 Gemini 3.5 Flash 專為子代理部署、多步驟工作流程及長期任務設計,適用於任務自動化、內部助手、開發者代理及營運工作流程,模型可在多步驟中規劃、呼叫工具並修訂輸出。生產系統仍需採用沙箱、權限控管、可觀測性及回退處理。
程式設計與重構支援。 Google 將 Gemini 3.5 Flash 描述為適用於複雜程式設計循環與迭代的模型,官方頁面列明支援程式碼執行與函式呼叫。適用於程式碼審查、測試生成、重構、除錯及開發助手工作流程。生成程式碼仍需測試、安全審查及人工工程監管。
長上下文多模態分析。 1048576權杖輸入上限及對文字、圖片、影片、音訊、PDF的支援,使 Gemini 3.5 Flash 能處理大型文件、逐字稿、截圖、產品手冊、研究包及混合格式知識庫。長上下文提升請求可包含的資訊量,但不保證完美回溯或完美擷取。
結構化擷取與工具型助手。 Gemini 3.5 Flash 支援結構化輸出、檔案搜尋、函式呼叫、URL上下文、搜尋定位、Google Maps 定位及快取。這些能力適用於工作流程自動化、客戶支援分流、文件擷取、內部搜尋助手及資料增強管道。對比輕量模型時,團隊也可參考 GPT-4o mini 定價與用例 或 OpenAI o4-mini 用於推理型生產任務。
預覽階段的 Computer Use 工作流程。 Google 當前模型頁面顯示 Computer Use 為「支援(預覽)」,官方公告稱 Computer Use 已整合至 Gemini 3.5 Flash 內建工具。由於仍處於預覽階段,團隊應將其視為評估功能,除非部署路徑及條款支援該用法,否則不應作為穩定生產依賴。
Gemini 3.5 Flash 支援哪些模態?
| 模態 | 是否支援 | 說明 |
|---|---|---|
| 文字輸入 | 是 | 標準提示、聊天、程式碼文字輸入 |
| 圖片輸入 | 是 | 支援圖片理解輸入 |
| 影片輸入 | 是 | 支援影片輸入 |
| 音訊輸入 | 是 | 支援音訊輸入 |
| PDF輸入 | 是 | 官方列明支援PDF輸入 |
| 文字輸出 | 是 | 主要輸出類型 |
| 原生圖片輸出 | 否 | 此模型不支援圖片生成 |
| 原生音訊輸出 | 否 | 此模型不支援音訊生成 |
| 原生影片輸出 | 未確認 | 官方未說明為原生影片生成模型 |
| 即時API | 否 | Google 模型文件列明不支援即時API |
Gemini 3.5 Flash 有哪些不足?
Gemini 3.5 Flash 並非原生圖片、音訊或影片生成模型。可處理多模態輸入,但輸出類型為文字,需要生成媒體內容的團隊應選用專門的圖片、語音或影片模型。
模型知識截止於2025年1月,意味著若請求未包含更新上下文或未使用定位與檢索功能,模型可能無法掌握後續事件。這對於法律、醫療、金融、安全、合規及政策相關任務尤為重要,輸出需由專業人士審核。
Computer Use 不應被視為完全穩定的預設功能。Google 文件將其列為「支援(預覽)」,生產使用需結合預覽條款、可靠性需求、監控需求及安全瀏覽器或桌面自動化控制進行評估。
這是通用AI的侷限,除非 Google 明確說明,否則並非模型特有:Gemini 3.5 Flash 可能出現幻覺、在長提示中遺漏細節、生成看似合理但錯誤的程式碼、工具結果處理失誤或對不明確指令過度擬合。大上下文視窗減少輸入限制,但仍需評估輸出品質。
長週期工作流程成本也可能上升。輸出定價包含思考權杖,多模態提示、重複工具呼叫及代理循環會增加總用量。團隊應測試請求大小,合理使用快取,並監控每個工作流程的成本,而非單次提示成本。
Gemini 3.5 Flash 最適合哪些場景?
| 用例 | 適用理由 | 重要限制 |
|---|---|---|
| 程式碼重構代理 | 支援程式設計工作流程、程式碼執行、函式呼叫及大上下文輸入 | 生成程式碼需測試、安全審查及人工批准 |
| 日常開發者助手 | 適用於除錯、解釋、倉庫分析及測試生成 | 不能取代工程師判斷 |
| 多模態文件分析 | 接受文字、圖片、影片、音訊及PDF,輸入視窗達100萬權杖 | 輸出僅為文字,擷取準確性需驗證 |
| 代理任務自動化 | 專為多步驟工作流程及子代理部署設計 | 需工具權限、沙箱、稽核日誌及回退處理 |
| 生產聊天與支援工作流程 | 支援結構化輸出、定位、URL上下文及檔案搜尋 | 知識品質依賴檢索來源及提示設計 |
| 成本敏感的長上下文工作負載 | Flash級定價適合高頻工作流程,優於Pro級模型 | 長提示及代理循環仍可能成本高 |
Gemini 3.5 Flash 與 Gemini 3.1 Pro Preview、Gemini 3.1 Flash-Lite 有何比較?
| 比較項 | Gemini 3.5 Flash | Gemini 3.1 Pro Preview | Gemini 3.1 Flash-Lite | 場景適配 |
|---|---|---|---|---|
| 提供商 | 同一生態系 | |||
| 定位 | Flash級多模態模型,適用於代理、程式設計及長上下文工作流程 | Pro級預覽模型,適合複雜問題解決及高能力任務 | 低延遲、成本高效,適合高頻輕量任務 | 根據任務複雜度選擇模型等級 |
| 輸入上下文 | 1048576權杖 | 官方定價/模型參考均為1048576權杖 | 官方模型參考均為1048576權杖 | 輸入容量相近,成本與能力配置不同 |
| 輸出類型 | 文字 | 文字 | 文字 | 核心輸出類型一致 |
| 標準輸入定價 | 每100萬輸入權杖1.50美元 | 200K權杖內每100萬2.00美元;超200K每100萬4.00美元 | 文字/圖片/影片每100萬輸入權杖0.25美元;音訊每100萬0.50美元 | Flash成本介於Pro Preview與Flash-Lite之間 |
| 標準輸出定價 | 每100萬輸出權杖9.00美元 | 200K內每100萬12.00美元;超200K每100萬18.00美元 | 每100萬輸出權杖1.50美元 | Flash-Lite適合高頻簡單任務,Pro Preview適合複雜工作流程 |
| 工具與能力 | 支援函式呼叫、程式碼執行、檔案搜尋、搜尋定位、地圖定位、URL上下文、結構化輸出、思考、快取及預覽階段 Computer Use | Google 生態工具類似,具體依模型及端點而定 | 輕量模型工具類似,具體依端點而定 | 根據工具需求、可靠性及成本選擇 |
此比較並非選出優劣。Gemini 3.5 Flash 更適合需要代理能力、程式設計支援、多模態輸入、長上下文及 Flash級定價的團隊。跨廠商比較時,團隊也可參考 Claude Sonnet 5 規格(Anthropic 工作流程)或 OpenAI o3(推理型任務)。
如何透過 Gate.AI 存取 Gemini 3.5 Flash?
Gate.AI 對 Gemini 3.5 Flash 的存取基於模型ID google/gemini-3.5-flash。Gate.AI 靜態模型頁在驗證時未直接爬取到 Gemini 3.5 Flash 條目,因此本文將模型專屬 Gate.AI ID 和專屬定價視為目錄資料。另,Gate.AI 文件驗證了 OpenAI 相容基礎URL https://api.gate.ai/openai/v1、API金鑰認證及 provider/model-name 的模型ID模式。
Gate.AI 定價頁面說明支援按需計費、API金鑰管理、智慧路由、提示快取、用量洞察、組織權限及與模型提供商單位價格同步的權杖定價。串流與非串流均採用權杖計費。
Python 範例
from openai import OpenAIimport osclient = OpenAI(api_key=os.environ["GATEAI_API_KEY"],base_url="https://api.gate.ai/openai/v1",)response = client.chat.completions.create(model="google/gemini-3.5-flash",messages=[{"role": "user","content": "Summarize Gemini 3.5 Flash's production trade-offs in one paragraph."}],)print(response.choices[0].message.content)
curl 範例
curl https://api.gate.ai/openai/v1/chat/completions \-H "Authorization: Bearer $GATEAI_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "google/gemini-3.5-flash","messages": [{"role": "user","content": "Summarize Gemini 3.5 Flash'\''s production trade-offs in one paragraph."}]}'
開發者也可透過 Google AI Studio 和 Gemini API,使用 Google 提供商模型ID gemini-3.5-flash 存取該模型。Google 模型頁面還指出 Interactions API 已全面開放,推薦用於存取最新 Gemini 功能及模型。
常見問題
Gemini 3.5 Flash 的上下文視窗是多少?
Gemini 3.5 Flash 支援1048576權杖輸入上限,輸出上限為65536權杖(Google AI for Developers 文件,截至2026年7月)。
Gemini 3.5 Flash 的費用是多少?
標準 Gemini API 定價為每100萬輸入權杖1.50美元、每100萬輸出權杖9.00美元。批次/Flex定價更低,優先定價更高(截至2026年7月)。
可以透過 Gate.AI 存取 Gemini 3.5 Flash 嗎?
可以,使用 Gate.AI 模型ID google/gemini-3.5-flash。Gate.AI 的API格式和基礎URL已驗證,但模型專屬目錄條目在驗證時未直接爬取到。
Gemini 3.5 Flash 支援 Computer Use 嗎?
支援,但僅為 Google 當前模型文件中的預覽功能。除非部署路徑支援預覽特性用於生產,否則建議將 Computer Use 視為評估功能。


