Gate.AI博客Gemini 3.5 Flash:完整規格、定價、API 存取與應用場景(2026)

    Gemini 3.5 Flash:完整規格、定價、API 存取與應用場景(2026)

    模型

    什麼是 Gemini 3.5 Flash?

    Gemini 3.5 Flash 是 Google 於2026年5月19日發佈的多模態、具備代理能力的大型語言模型,支援1048576個輸入權杖視窗,並可接受文字、圖片、影片、音訊及PDF輸入,輸出為文字。標準 Gemini API 的定價為每100萬輸入權杖1.50美元、每100萬輸出權杖9.00美元(截至2026年7月)。Google 官方宣布 Gemini 3.5 Flash 是 Gemini 3.5系列的首發版本,專為複雜的代理工作流程、程式設計及長期任務設計。

    Google 將 Gemini 3.5 Flash 定位為適用於生產環境的 Flash級模型,適合需要能力、延遲與成本平衡的團隊。該模型可透過 Google AI Studio、Gemini API、Android Studio、Google Antigravity、Gemini Enterprise Agent Platform、Gemini Enterprise、Gemini 應用及搜尋中的 AI 模式存取。

    開發者通常會評估 Gemini 3.5 Flash 在程式代理、重構助手、多模態文件處理、支援自動化及長上下文推理工作流程中的表現。從早期 Flash 模型遷移的團隊,可能會在採用新版本前,參考歷史的 Gemini 1.5 Flash 規格Gemini 2.0 Flash 多模態工作流程

    Gemini 3.5 Flash 的主要規格與定價為何?

    欄位 已驗證數值
    提供商 Google / Google DeepMind(截至2026年7月)
    模型系列 Gemini 3.5(截至2026年7月)
    模型類型 多模態大型語言模型,適用於代理工作流程、程式設計、長上下文分析及即時聊天(截至2026年7月)
    發佈日期 2026年5月19日(截至2026年7月)
    上下文視窗 1048576個輸入權杖(截至2026年7月)
    最大輸出權杖 Google AI for Developers 文件中為65536個輸出權杖;Google Cloud Agent Platform 預設最大輸出權杖為65535(截至2026年7月)
    輸入定價 標準 Gemini API:每100萬輸入權杖1.50美元;批次/Flex:0.75美元;優先:2.70美元(截至2026年7月)
    輸出定價 標準 Gemini API:每100萬輸出權杖9.00美元(包含思考權杖);批次/Flex:4.50美元;優先:16.20美元(截至2026年7月)
    上下文快取定價 Google 標準上下文快取:每100萬權杖0.15美元,另加每小時每100萬權杖1.00美元儲存費;批次/Flex快取:每100萬權杖0.08美元(截至2026年7月)
    Gate.AI 定價 輸入1.50美元/100萬,輸出9.00美元/100萬,快取讀取0.15美元/100萬,快取寫入0.08美元/100萬;Gate.AI 定價頁面說明模型價格與提供商單位價格同步(截至2026年7月)
    定價單位 除非另有說明,均為每100萬權杖美元(截至2026年7月)
    模態支援 支援文字、圖片、影片、音訊及PDF輸入;輸出為文字(截至2026年7月)
    API 存取 Google AI Studio / Gemini API;Google Cloud Gemini Enterprise Agent Platform;Gate.AI 使用模型ID google/gemini-3.5-flash 時採用 OpenAI 相容API格式(截至2026年7月)
    提供商模型ID gemini-3.5-flash(截至2026年7月)
    Gate.AI模型ID google/gemini-3.5-flash,由使用者提供;Gate.AI文件驗證了 provider/model-name 的模型ID模式(截至2026年7月)
    可用性 Google 官方公告列明可透過 Gemini API、Google AI Studio、Android Studio、Antigravity、Gemini Enterprise Agent Platform、Gemini Enterprise、Gemini 應用及搜尋中的 AI 模式存取(截至2026年7月)
    知識截止日期 Google AI for Developers 文件中為2025年1月(截至2026年7月)
    速率限制 截至2026年7月,官方資料未確認單一固定的模型專屬公開速率限制表
    微調支援 Google Cloud 發佈說明列明 Gemini 3.5 Flash 在公測階段支援有監督微調及強化學習微調,存在地區限制(截至2026年7月)
    串流支援 Gemini API 支援串流生成;Gate.AI 定價FAQ說明串流與非串流均採用權杖計費(截至2026年7月)
    批次API支援 支援(截至2026年7月)
    Flex / 優先推理 支援(截至2026年7月)
    工具/函式呼叫 支援函式呼叫、程式碼執行、檔案搜尋、Google Maps 定位、搜尋定位、URL上下文、結構化輸出、思考及快取;僅在預覽階段支援 Computer Use(截至2026年7月)
    原生音訊生成 不支援(截至2026年7月)
    原生圖片生成 不支援(截至2026年7月)
    即時API 不支援(截至2026年7月)
    授權/使用限制 Google 專有模型,受相關 Google API、Google Cloud 及平台條款約束;官方資料未說明獨立開放權重授權(截至2026年7月)

    Gemini 3.5 Flash 在生產環境有哪些實用功能?

    代理工作流程執行。 Gemini 3.5 Flash 專為子代理部署、多步驟工作流程及長期任務設計,適用於任務自動化、內部助手、開發者代理及營運工作流程,模型可在多步驟中規劃、呼叫工具並修訂輸出。生產系統仍需採用沙箱、權限控管、可觀測性及回退處理。

    程式設計與重構支援。 Google 將 Gemini 3.5 Flash 描述為適用於複雜程式設計循環與迭代的模型,官方頁面列明支援程式碼執行與函式呼叫。適用於程式碼審查、測試生成、重構、除錯及開發助手工作流程。生成程式碼仍需測試、安全審查及人工工程監管。

    長上下文多模態分析。 1048576權杖輸入上限及對文字、圖片、影片、音訊、PDF的支援,使 Gemini 3.5 Flash 能處理大型文件、逐字稿、截圖、產品手冊、研究包及混合格式知識庫。長上下文提升請求可包含的資訊量,但不保證完美回溯或完美擷取。

    結構化擷取與工具型助手。 Gemini 3.5 Flash 支援結構化輸出、檔案搜尋、函式呼叫、URL上下文、搜尋定位、Google Maps 定位及快取。這些能力適用於工作流程自動化、客戶支援分流、文件擷取、內部搜尋助手及資料增強管道。對比輕量模型時,團隊也可參考 GPT-4o mini 定價與用例OpenAI o4-mini 用於推理型生產任務。

    預覽階段的 Computer Use 工作流程。 Google 當前模型頁面顯示 Computer Use 為「支援(預覽)」,官方公告稱 Computer Use 已整合至 Gemini 3.5 Flash 內建工具。由於仍處於預覽階段,團隊應將其視為評估功能,除非部署路徑及條款支援該用法,否則不應作為穩定生產依賴。

    Gemini 3.5 Flash 支援哪些模態?

    模態 是否支援 說明
    文字輸入 標準提示、聊天、程式碼文字輸入
    圖片輸入 支援圖片理解輸入
    影片輸入 支援影片輸入
    音訊輸入 支援音訊輸入
    PDF輸入 官方列明支援PDF輸入
    文字輸出 主要輸出類型
    原生圖片輸出 此模型不支援圖片生成
    原生音訊輸出 此模型不支援音訊生成
    原生影片輸出 未確認 官方未說明為原生影片生成模型
    即時API Google 模型文件列明不支援即時API

    Gemini 3.5 Flash 有哪些不足?

    Gemini 3.5 Flash 並非原生圖片、音訊或影片生成模型。可處理多模態輸入,但輸出類型為文字,需要生成媒體內容的團隊應選用專門的圖片、語音或影片模型。

    模型知識截止於2025年1月,意味著若請求未包含更新上下文或未使用定位與檢索功能,模型可能無法掌握後續事件。這對於法律、醫療、金融、安全、合規及政策相關任務尤為重要,輸出需由專業人士審核。

    Computer Use 不應被視為完全穩定的預設功能。Google 文件將其列為「支援(預覽)」,生產使用需結合預覽條款、可靠性需求、監控需求及安全瀏覽器或桌面自動化控制進行評估。

    這是通用AI的侷限,除非 Google 明確說明,否則並非模型特有:Gemini 3.5 Flash 可能出現幻覺、在長提示中遺漏細節、生成看似合理但錯誤的程式碼、工具結果處理失誤或對不明確指令過度擬合。大上下文視窗減少輸入限制,但仍需評估輸出品質。

    長週期工作流程成本也可能上升。輸出定價包含思考權杖,多模態提示、重複工具呼叫及代理循環會增加總用量。團隊應測試請求大小,合理使用快取,並監控每個工作流程的成本,而非單次提示成本。

    Gemini 3.5 Flash 最適合哪些場景?

    用例 適用理由 重要限制
    程式碼重構代理 支援程式設計工作流程、程式碼執行、函式呼叫及大上下文輸入 生成程式碼需測試、安全審查及人工批准
    日常開發者助手 適用於除錯、解釋、倉庫分析及測試生成 不能取代工程師判斷
    多模態文件分析 接受文字、圖片、影片、音訊及PDF,輸入視窗達100萬權杖 輸出僅為文字,擷取準確性需驗證
    代理任務自動化 專為多步驟工作流程及子代理部署設計 需工具權限、沙箱、稽核日誌及回退處理
    生產聊天與支援工作流程 支援結構化輸出、定位、URL上下文及檔案搜尋 知識品質依賴檢索來源及提示設計
    成本敏感的長上下文工作負載 Flash級定價適合高頻工作流程,優於Pro級模型 長提示及代理循環仍可能成本高

    Gemini 3.5 Flash 與 Gemini 3.1 Pro Preview、Gemini 3.1 Flash-Lite 有何比較?

    比較項 Gemini 3.5 Flash Gemini 3.1 Pro Preview Gemini 3.1 Flash-Lite 場景適配
    提供商 Google Google Google 同一生態系
    定位 Flash級多模態模型,適用於代理、程式設計及長上下文工作流程 Pro級預覽模型,適合複雜問題解決及高能力任務 低延遲、成本高效,適合高頻輕量任務 根據任務複雜度選擇模型等級
    輸入上下文 1048576權杖 官方定價/模型參考均為1048576權杖 官方模型參考均為1048576權杖 輸入容量相近,成本與能力配置不同
    輸出類型 文字 文字 文字 核心輸出類型一致
    標準輸入定價 每100萬輸入權杖1.50美元 200K權杖內每100萬2.00美元;超200K每100萬4.00美元 文字/圖片/影片每100萬輸入權杖0.25美元;音訊每100萬0.50美元 Flash成本介於Pro Preview與Flash-Lite之間
    標準輸出定價 每100萬輸出權杖9.00美元 200K內每100萬12.00美元;超200K每100萬18.00美元 每100萬輸出權杖1.50美元 Flash-Lite適合高頻簡單任務,Pro Preview適合複雜工作流程
    工具與能力 支援函式呼叫、程式碼執行、檔案搜尋、搜尋定位、地圖定位、URL上下文、結構化輸出、思考、快取及預覽階段 Computer Use Google 生態工具類似,具體依模型及端點而定 輕量模型工具類似,具體依端點而定 根據工具需求、可靠性及成本選擇

    此比較並非選出優劣。Gemini 3.5 Flash 更適合需要代理能力、程式設計支援、多模態輸入、長上下文及 Flash級定價的團隊。跨廠商比較時,團隊也可參考 Claude Sonnet 5 規格(Anthropic 工作流程)或 OpenAI o3(推理型任務)。

    如何透過 Gate.AI 存取 Gemini 3.5 Flash?

    Gate.AI 對 Gemini 3.5 Flash 的存取基於模型ID google/gemini-3.5-flash。Gate.AI 靜態模型頁在驗證時未直接爬取到 Gemini 3.5 Flash 條目,因此本文將模型專屬 Gate.AI ID 和專屬定價視為目錄資料。另,Gate.AI 文件驗證了 OpenAI 相容基礎URL https://api.gate.ai/openai/v1、API金鑰認證及 provider/model-name 的模型ID模式。

    Gate.AI 定價頁面說明支援按需計費、API金鑰管理、智慧路由、提示快取、用量洞察、組織權限及與模型提供商單位價格同步的權杖定價。串流與非串流均採用權杖計費。

    Python 範例

    1. from openai import OpenAI
    2. import os
    3. client = OpenAI(
    4. api_key=os.environ["GATEAI_API_KEY"],
    5. base_url="https://api.gate.ai/openai/v1",
    6. )
    7. response = client.chat.completions.create(
    8. model="google/gemini-3.5-flash",
    9. messages=[
    10. {
    11. "role": "user",
    12. "content": "Summarize Gemini 3.5 Flash's production trade-offs in one paragraph."
    13. }
    14. ],
    15. )
    16. print(response.choices[0].message.content)

    curl 範例

    1. curl https://api.gate.ai/openai/v1/chat/completions \
    2. -H "Authorization: Bearer $GATEAI_API_KEY" \
    3. -H "Content-Type: application/json" \
    4. -d '{
    5. "model": "google/gemini-3.5-flash",
    6. "messages": [
    7. {
    8. "role": "user",
    9. "content": "Summarize Gemini 3.5 Flash'\''s production trade-offs in one paragraph."
    10. }
    11. ]
    12. }'

    開發者也可透過 Google AI Studio 和 Gemini API,使用 Google 提供商模型ID gemini-3.5-flash 存取該模型。Google 模型頁面還指出 Interactions API 已全面開放,推薦用於存取最新 Gemini 功能及模型。

    常見問題

    Gemini 3.5 Flash 的上下文視窗是多少?
    Gemini 3.5 Flash 支援1048576權杖輸入上限,輸出上限為65536權杖(Google AI for Developers 文件,截至2026年7月)。

    Gemini 3.5 Flash 的費用是多少?
    標準 Gemini API 定價為每100萬輸入權杖1.50美元、每100萬輸出權杖9.00美元。批次/Flex定價更低,優先定價更高(截至2026年7月)。

    可以透過 Gate.AI 存取 Gemini 3.5 Flash 嗎?
    可以,使用 Gate.AI 模型ID google/gemini-3.5-flash。Gate.AI 的API格式和基礎URL已驗證,但模型專屬目錄條目在驗證時未直接爬取到。

    Gemini 3.5 Flash 支援 Computer Use 嗎?
    支援,但僅為 Google 當前模型文件中的預覽功能。除非部署路徑支援預覽特性用於生產,否則建議將 Computer Use 視為評估功能。

    相關文章