Grok 4.5:完整規格、定價、API 接入與應用場景(2026)
什麼是 Grok 4.5?
Grok 4.5 是 xAI 推出的前沿推理模型,於 2026年7月8日 發布,具備 500,000 個 token 的上下文視窗,支援文字與圖像輸入,並可調整推理能力。至 2026年7月,標準 API 價格為每百萬輸入 token 2 美元、每百萬輸出 token 6 美元。
目前官方資料同時採用 xAI 與 SpaceXAI 品牌。本頁面以 xAI 為主要稱呼,因為這是目前最廣泛與 Grok 模型家族相關聯的提供商名稱,同時也承認最新公告與文件中出現的 SpaceXAI 品牌。
此模型專為程式設計、智能體任務、技術問題解決及一般知識型工作設計。它可在產生答案前進行額外的內部推理,API 提供低、中、高三種推理設定。高推理為 Grok 4.5 文件預設值。
Grok 4.5 亦支援參與工具調用型工作流程。官方文件列出其支援函數調用、網頁搜尋、X 搜尋、程式碼執行與結構化輸出等能力。這些特性使其適用於需要資訊檢索、外部系統調用、受控程式碼執行或回傳機器可讀結果的應用場景。
Grok 4.5 的核心參數與定價為何?
下表彙整截至 2026年7月 經官方驗證或文件揭露的 Grok 4.5 主要參數與定價資訊。
| 規格 | 驗證數值 |
|---|---|
| 提供商 | xAI,現行官方資料帶有 SpaceXAI 品牌(截至 2026年7月) |
| 模型家族 | Grok 4 系列(截至 2026年7月) |
| 模型類型 | 前沿推理與智能體語言模型(截至 2026年7月) |
| 發布日期 | 2026年7月8日(截至 2026年7月) |
| 上下文視窗 | 500,000 token(截至 2026年7月) |
| 標準輸入定價 | 每 100 萬輸入 token 2 美元(截至 2026年7月) |
| 快取輸入定價 | 每 100 萬快取輸入 token 0.5 美元(截至 2026年7月) |
| 標準輸出定價 | 每 100 萬輸出 token 6 美元(截至 2026年7月) |
| 計價單位 | 每 100 萬 token 計價,單位為美元(截至 2026年7月) |
| 高上下文定價 | 單次請求上下文超過 200,000 token 時適用不同定價,部署前請查閱最新定價頁面(截至 2026年7月) |
| 支援輸入模態 | 文字與圖像(截至 2026年7月) |
| 支援輸出模態 | 文字,包括結構化文字輸出(截至 2026年7月) |
| 推理控制 | 低、中、高三檔;高為文件預設值(截至 2026年7月) |
| 提供商 API 接入 | xAI Responses API 與 Chat Completions API(截至 2026年7月) |
| 提供商模型 ID | grok-4.5(截至 2026年7月) |
| 提供商別名 | grok-4.5-latest 和 grok-build-latest(截至 2026年7月) |
| Gate.AI模型 ID | x-ai/grok-4.5,詳見Gate.AI模型卡(截至 2026年7月) |
| 區域叢集 | xAI 文件中的 us-east-1 與 us-west-2(截至 2026年7月) |
| 公布速率限制 | 每秒 150 次請求,每分鐘 5,000 萬 token;實際帳戶限額可能不同(截至 2026年7月) |
| 函數調用 | 支援(截至 2026年7月) |
| 結構化輸出 | 支援(截至 2026年7月) |
| 網頁搜尋 | 作為 API 工具支援(截至 2026年7月) |
| X 搜尋 | 作為 API 工具支援(截至 2026年7月) |
| 程式碼執行 | 作為 API 工具支援(截至 2026年7月) |
| 串流輸出 | 透過 xAI 文字 API 平台支援(截至 2026年7月) |
| 批次處理 | 透過 xAI Batch API 平台可用(截至 2026年7月) |
| 微調 | 截至 2026年7月官方文件未確認 |
| 知識截止時間 | 截至 2026年7月官方文件未揭露 |
| 可用性 | xAI API、Grok Build、Cursor、部分辦公外掛及支援的模型閘道;歐洲區上線初期可用性有限(截至 2026年7月) |
| 授權與使用限制 | 受 xAI 平台條款約束;Grok 4.5 非開源權重模型(截至 2026年7月) |
xAI 模型文件確認了上下文視窗、輸入輸出模態、快取輸入費率、標準 token 價格、別名、區域叢集及已公布的速率限制。文件亦指出,單次請求上下文超過 200,000 token 時將採用不同計價結構,因此不應假設所有最大上下文請求皆按標準 2/6 美元費率計費。
Gate.AI 模型卡將 Grok 4.5 的閘道模型 ID 列為 x-ai/grok-4.5。Gate.AI 表示,其展示的模型價格與官方保持一致,無平台加價;支援快取時,快取輸入按官方折扣費率計價。
Grok 4.5 在生產環境中的核心優勢為何?
程式設計與軟體工程工作流程
Grok 4.5 針對程式碼生成、除錯、重構、倉庫分析、終端任務及多步驟軟體工程任務進行優化。xAI 表示,該模型訓練資料涵蓋程式設計、科學、工程與數學領域,並針對技術與智能體任務進行額外強化學習。
當工作流程需要模型檢查多個檔案、辨識依賴、提出變更建議並解釋結果時,這項能力特別有用。產生的程式碼仍需經過測試、依賴審查、安全掃描及人工審核後方可投入生產。
工具調用型智能體
函數調用能力讓 Grok 4.5 可請求外部工具或服務執行操作。網頁搜尋與 X 搜尋可提供最新資訊,程式碼執行則支援運算、資料分析與技術驗證。
這些能力適用於研究型智能體、開發助手、資料處理流程及內部自動化。工具存取應嚴格權限控管,因模型可能選擇錯誤函數、提供無效參數或誤解工具結果。
長文檔與倉庫分析
500,000 token 的上下文視窗可容納大量程式碼、技術文件、報告、合約、研究資料或相關檔案集。
大上下文視窗提升了單次請求可處理的資料量,但不保證完全回憶或準確理解。大規模分析仍需搭配檢索、文件分段、引用與評估等流程。
可調式推理
開發者可選擇低、中、高三檔推理強度。低檔適用於常規抽取或分類,高檔則適合複雜除錯、規劃、數學推理或多步驟技術分析。
高推理強度會增加回應延遲與輸出 token 消耗。生產系統應依任務準確率、回應時間及總成本測試推理設定,而非一味使用最高檔。
結構化應用輸出
結構化輸出可讓應用程式以預定格式請求回應,避免完全依賴非結構化文字。這對抽取、路由、表單填寫、工作流程狀態生成及 API 間通訊特別有用。
應用程式仍需驗證生成結果是否符合 schema,並為缺漏、格式錯誤或不支援的欄位定義重試或降級機制。
Grok 4.5 支援哪些模態?
| 模態 | 是否支援 | 說明 |
|---|---|---|
| 文字輸入 | 支援 | 透過 xAI 文字 API 及Gate.AI相容聊天介面 |
| 圖像輸入 | 支援 | 官方 Grok 4.5 模型文件明確支援圖像輸入 |
| 基於檔案的工作流程 | 支援,需搭配檔案及集合功能 | 具體支援取決於所選 API 工作流程及檔案型態 |
| 音訊輸入 | 官方未確認為 Grok 4.5 原生輸入 | xAI 提供獨立語音服務 |
| 影片輸入 | 官方未確認為 Grok 4.5 原生輸入 | xAI 提供獨立影片生成服務 |
| 文字輸出 | 支援 | 包括一般文字及結構化輸出 |
| 圖像輸出 | Grok 4.5 無原生圖像輸出 | 圖像生成需使用獨立 Grok Imagine API |
| 音訊輸出 | Grok 4.5 無原生音訊輸出 | 語音生成需使用獨立語音服務 |
| 影片輸出 | Grok 4.5 無原生影片輸出 | 影片生成需使用獨立 Imagine 服務 |
因此,Grok 4.5 應被描述為支援文字與圖像輸入、輸出為文字的推理模型,而非原生支援所有媒體型態的單一模型。xAI 模型目錄已將 Grok 4.5 與其圖像、影片與語音 API 區分。
Grok 4.5 的侷限性有哪些?
Grok 4.5 可能產生不準確的事實、推理錯誤、不安全程式碼或不被支援的結論。這是生成式 AI 的普遍限制,並非 Grok 4.5 獨有。重要輸出應透過權威來源、自動化測試或專業人工審核驗證。
該模型的知識截止時間在官方文件中未揭露。因此,最新資訊需仰賴外部搜尋工具或用戶提供的資料。即便啟用網頁或 X 搜尋,檢索結果也可能不完整、過時、誤導或脫離上下文。
長上下文處理帶來成本與延遲權衡。儘管 Grok 4.5 支援高達 500,000 token,但當請求上下文超過 200,000 token 時,xAI 會採用不同定價。超大提示詞還可能引入無關內容,影響回答聚焦度。
Grok 4.5 不支援透過文字模型端點原生生成圖像、音訊或影片。如需這些輸出,應調用獨立模型或 API。
工具調用型工作流程存在操作風險。模型可能調用錯誤工具、傳遞錯誤參數、重複操作或基於錯誤假設行動。外部工具應採最小權限、審批流程、請求驗證、預算限制及可稽核日誌。
針對法律、醫療、金融、用工、安全等高影響決策,Grok 4.5 應作為輔助而非取代專業人士。敏感結論絕不可僅因高推理檔位而被直接採納。
Grok 4.5 最適合哪些應用場景?
| 應用場景 | 適用原因 | 重要限制 |
|---|---|---|
| 程式碼生成與重構 | 專為軟體工程與程式設計任務設計 | 程式碼需經測試與審核 |
| 倉庫分析 | 長上下文可容納大量程式碼與文件 | 上下文容量不等於完全理解 |
| 技術故障排查 | 可調推理支援多步驟診斷 | 根因結論仍可能出錯 |
| 智能體工作流程 | 支援工具、函數調用、搜尋與程式碼執行 | 需嚴格權限與監控 |
| 長文檔審閱 | 50 萬上下文支援大型報告與文件集 | 高上下文請求成本更高 |
| 結構化抽取 | 結構化輸出簡化後續處理 | 產生欄位需 schema 驗證 |
| 研究輔助 | 搜尋工具可檢索最新資料 | 檢索內容與引用需驗證 |
| 表格與辦公場景 | xAI 文件涵蓋 Excel、PPT、Word 等辦公工作流程 | 關鍵業務輸出需人工複核 |
| 技術知識工作 | 訓練與定位強調科學、工程與數學 | 關鍵領域仍需專業知識把關 |
「最適用場景」需結合實際需求而定。模型選擇應根據組織真實提示詞、工具、延遲目標、安全控管與預算的代表性測試。
Grok 4.5 與 GPT-5.5、Claude Sonnet 5 對比如何?
Grok 4.5、GPT-5.5 與 Claude Sonnet 5 均可滿足程式設計、推理、工具調用與智能體工作流程等重疊需求。下表不直接評斷孰優孰劣,因各家參數、價格與接入條件可能隨時變動。
| 對比維度 | Grok 4.5 | GPT-5.5 | Claude Sonnet 5 | 場景適配 |
|---|---|---|---|---|
| 提供商 | xAI | OpenAI | Anthropic | 既有供應商關係可能影響選擇 |
| 模型定位 | 程式設計、智能體任務與知識型工作 | 通用前沿推理與生產工作流程 | 程式設計、分析與智能體工作流程 | 應根據主要工作負載選擇模型 |
| 驗證上下文視窗 | 500,000 token | 需查閱 OpenAI 最新文件 | 需查閱 Anthropic 最新文件 | Grok 4.5 適合超大倉庫與文件集 |
| 輸入模態 | 文字與圖像 | 需查閱現行模型文件 | 需查閱現行模型文件 | 適合文字與視覺分析場景 |
| 輸出模態 | 文字 | 需查閱現行模型文件 | 需查閱現行模型文件 | 媒體輸出需求需單獨確認 |
| 推理控制 | 低、中、高三檔 | 需查各家控制方式 | 需查各家控制方式 | 應用需可調算力時特別有用 |
| 標準輸入價格 | 每百萬 token 2 美元 | 需查現行供應商價格 | 需查現行供應商價格 | 應結合實際提示詞長度對比 |
| 標準輸出價格 | 每百萬 token 6 美元 | 需查現行供應商價格 | 需查現行供應商價格 | 智能體長文本輸出尤需關注 |
| 原生工具 | 函數調用、網頁搜尋、X 搜尋、程式碼執行 | 需查現行工具集 | 需查現行工具集 | 應按所需資料源與整合選型 |
| 閘道接入 | Gate.AI模型 ID x-ai/grok-4.5 | 依 Gate.AI 現行列表 | 依 Gate.AI 現行列表 | 統一閘道便於多模型評估 |
有效對比應基於同一工作負載下的任務完成率、事實準確性、程式碼品質、延遲、token 消耗、工具調用可靠性與故障回復能力。公開基準可參考,但不應取代實際應用測試。
如需於 Grok 系列內遷移,亦可參考 Grok 4.3 模型檔案 比較上下文長度、價格與生成行為。
如何透過 Gate.AI 接入 Grok 4.5?
根據 Gate.AI 模型卡,Grok 4.5 可透過以下模型 ID 調用:
x-ai/grok-4.5
Gate.AI 提供相容 OpenAI 的 API 介面,基礎 URL 為:
https://api.gate.ai/openai/v1
開發者需建立 Gate.AI API 金鑰,替換 OpenAI 基礎 URL,並於請求中指定所選模型 ID。Gate.AI 亦提供可選自動路由、API 金鑰管理、請求日誌、預算控管、提示詞快取視覺化、用量洞察及組織權限管理。
Python 範例
Python import os
import OpenAI from openai
api_key = os.environ.get(“GATEAI_API_KEY”)
if not api_key:
raise RuntimeError(“Set the GATEAI_API_KEY environment variable.”)
client = OpenAI(
api_key=api_key,
base_url=”https://api.gate.ai/openai/v1“,
)
response = client.chat.completions.create(
model=”x-ai/grok-4.5”,
messages=[
{
“role”: “user”,
“content”: (
“Review this JavaScript function, identify the bug, “
“and provide a corrected implementation: “
“function median(a){a.sort();return a[a.length/2]}”
),
}
],
)
print(response.choices[0].message.content) ```
curl 範例
``` Bash curl https://api.gate.ai/openai/v1/chat/completions \
-H “Authorization: Bearer $GATEAI_API_KEY” \
-H “Content-Type: application/json” \
-d ‘{
“model”: “x-ai/grok-4.5”,
“messages”: [
{
“role”: “user”,
“content”: “Review this JavaScript function, identify the bug, and provide a corrected implementation: function median(a){a.sort();return a[a.length/2]}”
}
]
} ```
Gate.AI 表示,其展示的模型價格與官方同步,無平台加價。其定價文件亦說明,快取 token 按官方快取折扣費率計價,失敗、逾時或無效的故障轉移請求不計費。
開發者亦可直接透過 xAI Responses API,使用官方模型 ID grok-4.5 存取。官方範例透過 /v1/responses 端點,採用 Bearer Token 認證。
常見問題解答
Grok 4.5 的上下文視窗是多少?
Grok 4.5 截至 2026年7月 支援最大 500,000 token 上下文視窗。xAI 指出,單次請求上下文超過 200,000 token 時將採用不同定價,因此最大上下文負載可能不按標準輸入費率計價。
Grok 4.5 API 費用是多少?
標準價格為每百萬輸入 token 2 美元、每百萬快取輸入 token 0.5 美元、每百萬輸出 token 6 美元(截至 2026年7月)。超過 200,000 token 的請求適用不同費率,工具相關費用可能另行計價。
開發者如何接入 Grok 4.5?
開發者可透過 xAI API,模型 ID 為 grok-4.5。Gate.AI 模型卡顯示,其閘道模型 ID 為 x-ai/grok-4.5,可透過 Gate.AI 相容 OpenAI 的 API 端點存取。
Grok 4.5 適合哪些任務?
Grok 4.5 適用於程式設計、倉庫分析、技術排查、長文檔審閱、結構化抽取、研究輔助及工具調用型智能體等場景。其輸出仍需測試或人工複核,特別是生產程式碼及高影響決策。


