Grok 4.5:完整规格、定价、API 接入与应用场景(2026)
什么是 Grok 4.5?
Grok 4.5 是 xAI 推出的前沿推理模型,于 2026年7月8日 发布,具备 500,000 个 token 的上下文窗口,支持文本和图像输入,可配置推理能力。截至 2026年7月,标准 API 价格为每百万输入 token 2 美元、每百万输出 token 6 美元。
目前官方资料同时使用 xAI 和 SpaceXAI 品牌。本页面采用 xAI 作为主称,因为这是目前最广泛关联于 Grok 模型家族的提供商名称,同时也承认最新公告及文档中出现的 SpaceXAI 品牌。
该模型专为编程、智能体任务、技术问题解决及通用知识工作设计。它可在生成答案前进行额外的内部推理,API 提供低、中、高三档推理设置。高推理为 Grok 4.5 的文档默认值。
Grok 4.5 也支持参与工具调用型工作流。官方文档列出其支持函数调用、网页搜索、X 搜索、代码执行和结构化输出等能力。这些特性使其适用于需要信息检索、外部系统调用、受控代码执行或返回机器可读结果的应用场景。
Grok 4.5 的核心参数和定价如何?
下表汇总了截至 2026年7月 经验证或官方文档披露的 Grok 4.5 主要参数与定价信息。
| 规格 | 经验证的数值 |
|---|---|
| 提供商 | xAI,当前官方资料中带有 SpaceXAI 品牌(截至 2026年7月) |
| 模型家族 | Grok 4 系列(截至 2026年7月) |
| 模型类型 | 前沿推理与智能体语言模型(截至 2026年7月) |
| 发布日期 | 2026年7月8日(截至 2026年7月) |
| 上下文窗口 | 500,000 token(截至 2026年7月) |
| 标准输入定价 | 每 100 万输入 token 2 美元(截至 2026年7月) |
| 缓存输入定价 | 每 100 万缓存输入 token 0.5 美元(截至 2026年7月) |
| 标准输出定价 | 每 100 万输出 token 6 美元(截至 2026年7月) |
| 计价单位 | 每 100 万 token 计价,单位为美元(截至 2026年7月) |
| 高上下文定价 | 单次请求上下文超过 200,000 token 时适用不同定价,部署前请查阅当前定价页面(截至 2026年7月) |
| 支持的输入模态 | 文本与图像(截至 2026年7月) |
| 支持的输出模态 | 文本,包括结构化文本输出(截至 2026年7月) |
| 推理控制 | 低、中、高三档;高为文档默认值(截至 2026年7月) |
| 提供商 API 接入 | xAI Responses API 与 Chat Completions API(截至 2026年7月) |
| 提供商模型 ID | grok-4.5(截至 2026年7月) |
| 提供商别名 | grok-4.5-latest 和 grok-build-latest(截至 2026年7月) |
| Gate.AI模型 ID | x-ai/grok-4.5,详见Gate.AI模型卡(截至 2026年7月) |
| 区域集群 | xAI 文档中的 us-east-1 和 us-west-2(截至 2026年7月) |
| 公布的速率限制 | 每秒 150 次请求,每分钟 5,000 万 token;具体账户限额可能不同(截至 2026年7月) |
| 函数调用 | 支持(截至 2026年7月) |
| 结构化输出 | 支持(截至 2026年7月) |
| 网页搜索 | 作为 API 工具支持(截至 2026年7月) |
| X 搜索 | 作为 API 工具支持(截至 2026年7月) |
| 代码执行 | 作为 API 工具支持(截至 2026年7月) |
| 流式输出 | 通过 xAI 文本 API 平台支持(截至 2026年7月) |
| 批量处理 | 通过 xAI Batch API 平台可用(截至 2026年7月) |
| 微调 | 截至 2026年7月官方文档未确认 |
| 知识截止时间 | 截至 2026年7月官方文档未披露 |
| 可用性 | xAI API、Grok Build、Cursor、部分办公插件及支持的模型网关;欧洲区上线初期可用性有限(截至 2026年7月) |
| 许可与使用限制 | 受 xAI 平台条款约束;Grok 4.5 非开源权重模型(截至 2026年7月) |
xAI 模型文档确认了上下文窗口、输入输出模态、缓存输入费率、标准 token 价格、别名、区域集群及已公布的速率限制。文档还指出,单次请求上下文超过 200,000 token 时将采用不同的计价结构,因此不应假定所有最大上下文请求都按标准 2/6 美元费率计费。
Gate.AI 模型卡将 Grok 4.5 的网关模型 ID 列为 x-ai/grok-4.5。Gate.AI 表示,其展示的模型价格与官方保持一致,无平台加价;支持缓存时,缓存输入按官方折扣费率计费。
Grok 4.5 在生产环境中的核心优势是什么?
编程与软件工程工作流
Grok 4.5 针对代码生成、调试、重构、仓库分析、终端任务及多步骤软件工程任务进行了优化。xAI 表示,该模型训练数据涵盖编程、科学、工程与数学领域,并针对技术与智能体任务进行了额外强化学习。
当工作流需要模型检查多个文件、识别依赖、提出变更建议并解释结果时,这一能力尤为有用。生成的代码仍需经过测试、依赖审查、安全扫描及人工批准后方可投入生产。
工具调用型智能体
函数调用能力让 Grok 4.5 可请求外部工具或服务执行操作。网页搜索与 X 搜索可提供最新信息,代码执行则支持计算、数据分析与技术验证。
这些能力适用于研究型智能体、开发助手、数据处理流程及内部自动化。工具访问应严格权限控制,因为模型可能选择错误函数、提供无效参数或误解工具结果。
长文档与仓库分析
500,000 token 的上下文窗口可容纳大量代码、技术文档、报告、合同、研究资料或相关文件集。
大上下文窗口提升了单次请求可处理的材料量,但并不保证完全回忆或准确理解。大规模分析仍需检索、文档分段、引用与评估等流程配合。
可配置推理
开发者可选择低、中、高三档推理强度。低档适用于常规抽取或分类,高档适合复杂调试、规划、数学推理或多步骤技术分析。
高推理强度会增加响应延迟和输出 token 消耗。生产系统应根据任务准确率、响应时间及总成本测试推理设置,而非盲目使用最高档。
结构化应用输出
结构化输出可让应用以预定义格式请求响应,避免完全依赖非结构化文本。这对于抽取、路由、表单填写、工作流状态生成及 API 间通信尤为有用。
应用仍需校验生成结果是否符合 schema,并为缺失、格式错误或不支持的字段定义重试或降级机制。
Grok 4.5 支持哪些模态?
| 模态 | 是否支持 | 说明 |
|---|---|---|
| 文本输入 | 支持 | 通过 xAI 文本 API 及Gate.AI兼容聊天界面 |
| 图像输入 | 支持 | 官方 Grok 4.5 模型文档列明支持图像输入 |
| 基于文件的工作流 | 支持,需配合文件及集合功能 | 具体支持取决于所选 API 工作流及文件类型 |
| 音频输入 | 官方未确认为 Grok 4.5 原生输入 | xAI 提供独立语音服务 |
| 视频输入 | 官方未确认为 Grok 4.5 原生输入 | xAI 提供独立视频生成服务 |
| 文本输出 | 支持 | 包括普通文本及结构化输出 |
| 图像输出 | Grok 4.5 无原生图像输出 | 图像生成需使用独立 Grok Imagine API |
| 音频输出 | Grok 4.5 无原生音频输出 | 语音生成需使用独立语音服务 |
| 视频输出 | Grok 4.5 无原生视频输出 | 视频生成需使用独立 Imagine 服务 |
因此,Grok 4.5 应被描述为支持文本和图像输入、输出为文本的推理模型,而非原生支持所有媒体类型的单一模型。xAI 模型目录已将 Grok 4.5 与其图像、视频和语音 API 区分开来。
Grok 4.5 的局限性有哪些?
Grok 4.5 可能生成不准确的事实、推理错误、不安全代码或不被支持的结论。这是生成式 AI 的普遍限制,并非 Grok 4.5 独有。重要输出应通过权威来源、自动化测试或专业人工审核验证。
该模型的知识截止时间在官方文档中未披露。因此,最新信息需依赖外部搜索工具或用户提供的材料。即便启用网页或 X 搜索,检索结果也可能不完整、过时、误导或脱离上下文。
长上下文处理带来成本与延迟权衡。尽管 Grok 4.5 支持高达 500,000 token,但当请求上下文超过 200,000 token 时,xAI 会采用不同定价。超大提示词还可能引入无关内容,影响回答聚焦度。
Grok 4.5 不支持通过文本模型端点原生生成图像、音频或视频。需要这些输出的应用需调用独立模型或 API。
工具调用型工作流存在操作风险。模型可能调用错误工具、传递错误参数、重复操作或基于错误假设行动。外部工具应采用最小权限、审批流程、请求校验、预算限制及可审计日志。
对于法律、医疗、金融、用工、安全等高影响决策,Grok 4.5 应作为辅助而非替代专业人士。敏感结论绝不可仅因高推理档位而被直接采纳。
Grok 4.5 最适合哪些应用场景?
| 应用场景 | 适用原因 | 重要限制 |
|---|---|---|
| 代码生成与重构 | 专为软件工程与编程任务设计 | 代码需经过测试与审核 |
| 仓库分析 | 长上下文可容纳大量代码与文档 | 上下文容量不等于完全理解 |
| 技术故障排查 | 可配置推理支持多步骤诊断 | 根因结论仍可能出错 |
| 智能体工作流 | 支持工具、函数调用、搜索和代码执行 | 需严格权限与监控 |
| 长文档审阅 | 50 万上下文支持大型报告与文档集 | 高上下文请求成本更高 |
| 结构化抽取 | 结构化输出简化后续处理 | 生成字段需 schema 校验 |
| 研究辅助 | 搜索工具可检索最新材料 | 检索内容与引用需验证 |
| 表格与办公场景 | xAI 文档覆盖 Excel、PPT、Word 等办公工作流 | 关键业务输出需人工复核 |
| 技术知识工作 | 训练及定位强调科学、工程与数学 | 关键领域仍需专业知识把关 |
“最适用场景”需结合实际需求而定。模型选择应基于组织真实提示词、工具、延迟目标、安全控制与预算的代表性测试。
Grok 4.5 与 GPT-5.5、Claude Sonnet 5 对比如何?
Grok 4.5、GPT-5.5 和 Claude Sonnet 5 都能满足编程、推理、工具调用和智能体工作流等重叠需求。下表不直接评判孰优孰劣,因为各家参数、价格与接入条件可能随时变化。
| 对比维度 | Grok 4.5 | GPT-5.5 | Claude Sonnet 5 | 场景适配 |
|---|---|---|---|---|
| 提供商 | xAI | OpenAI | Anthropic | 既有供应商关系可能影响选择 |
| 模型定位 | 编程、智能体任务与知识型工作 | 通用前沿推理与生产工作流 | 编程、分析与智能体工作流 | 应根据主要工作负载选择模型 |
| 经验证上下文窗口 | 500,000 token | 需查阅 OpenAI 最新文档 | 需查阅 Anthropic 最新文档 | Grok 4.5 适合超大仓库与文档集 |
| 输入模态 | 文本与图像 | 需查阅当前模型文档 | 需查阅当前模型文档 | 适合文本与视觉分析场景 |
| 输出模态 | 文本 | 需查阅当前模型文档 | 需查阅当前模型文档 | 媒体输出需求需单独确认 |
| 推理控制 | 低、中、高三档 | 需查阅各家控制方式 | 需查阅各家控制方式 | 应用需可调算力时尤为有用 |
| 标准输入价格 | 每百万 token 2 美元 | 需查当前供应商价格 | 需查当前供应商价格 | 应结合实际提示词长度对比 |
| 标准输出价格 | 每百万 token 6 美元 | 需查当前供应商价格 | 需查当前供应商价格 | 智能体长文本输出尤需关注 |
| 原生工具 | 函数调用、网页搜索、X 搜索、代码执行 | 需查当前工具集 | 需查当前工具集 | 应按所需数据源与集成选型 |
| 网关接入 | Gate.AI模型 ID x-ai/grok-4.5 | 依 Gate.AI 当前列表 | 依 Gate.AI 当前列表 | 统一网关便于多模型评估 |
有效对比应基于同一工作负载下的任务完成率、事实准确性、代码质量、延迟、token 消耗、工具调用可靠性与故障恢复能力。公开基准可参考,但不应替代实际应用测试。
如需在 Grok 系列内迁移,也可参考 Grok 4.3 模型档案 对比上下文长度、价格与生成行为。
如何通过 Gate.AI 接入 Grok 4.5?
根据 Gate.AI 模型卡,Grok 4.5 可通过以下模型 ID 调用:
x-ai/grok-4.5
Gate.AI 提供兼容 OpenAI 的 API 接口,基础 URL 为:
https://api.gate.ai/openai/v1
开发者需创建 Gate.AI API 密钥,替换 OpenAI 基础 URL,并在请求中指定所选模型 ID。Gate.AI 还提供可选自动路由、API 密钥管理、请求日志、预算控制、提示词缓存可视化、用量洞察及组织权限管理。
Python 示例
Python import os
import OpenAI from openai
api_key = os.environ.get(“GATEAI_API_KEY”)
if not api_key:
raise RuntimeError(“Set the GATEAI_API_KEY environment variable.”)
client = OpenAI(
api_key=api_key,
base_url=”https://api.gate.ai/openai/v1“,
)
response = client.chat.completions.create(
model=”x-ai/grok-4.5”,
messages=[
{
“role”: “user”,
“content”: (
“Review this JavaScript function, identify the bug, “
“and provide a corrected implementation: “
“function median(a){a.sort();return a[a.length/2]}”
),
}
],
)
print(response.choices[0].message.content) ```
curl 示例
``` Bash curl https://api.gate.ai/openai/v1/chat/completions \
-H “Authorization: Bearer $GATEAI_API_KEY” \
-H “Content-Type: application/json” \
-d ‘{
“model”: “x-ai/grok-4.5”,
“messages”: [
{
“role”: “user”,
“content”: “Review this JavaScript function, identify the bug, and provide a corrected implementation: function median(a){a.sort();return a[a.length/2]}”
}
]
} ```
Gate.AI 表示,其展示的模型价格与官方同步,无平台加价。其定价文档还说明,缓存 token 按官方缓存折扣费率计价,失败、超时或无效的故障转移请求不计费。
开发者也可直接通过 xAI Responses API,使用官方模型 ID grok-4.5 访问。官方示例通过 /v1/responses 端点,采用 Bearer Token 认证。
常见问题解答
Grok 4.5 的上下文窗口是多少?
Grok 4.5 截至 2026年7月 支持最大 500,000 token 上下文窗口。xAI 指出,单次请求上下文超过 200,000 token 时将采用不同定价,因此最大上下文负载可能不按标准输入费率计费。
Grok 4.5 API 费用是多少?
标准价格为每百万输入 token 2 美元、每百万缓存输入 token 0.5 美元、每百万输出 token 6 美元(截至 2026年7月)。超过 200,000 token 的请求适用不同费率,工具相关费用可能单独计费。
开发者如何接入 Grok 4.5?
开发者可通过 xAI API,模型 ID 为 grok-4.5。Gate.AI 模型卡显示,其网关模型 ID 为 x-ai/grok-4.5,可通过 Gate.AI 兼容 OpenAI 的 API 端点访问。
Grok 4.5 适合哪些任务?
Grok 4.5 适用于编程、仓库分析、技术排查、长文档审阅、结构化抽取、研究辅助及工具调用型智能体等场景。其输出仍需测试或人工复核,尤其是生产代码及高影响决策。


