MiniMax M3:完整规格、定价、API 接入与应用场景(2026)
MiniMax M3 是什么?
MiniMax M3 是 MiniMax 推出的多模态基础模型,于 2026年6月1日 发布,具备 1,000,000 个 token 的上下文窗口,并支持文本、图片和视频输入。根据 Gate.AI 的报价,截至 2026年7月,输入端价格为每 100 万个输入 token 1.20 美元,输出端价格为每 100 万个输出 token 4.80 美元。MiniMax 官方发布公告将 M3 定义为面向编程、智能体工作流、长上下文推理、原生多模态以及桌面计算机使用场景的模型。
MiniMax 官方 API 文档将 MiniMax-M3 定位为最新的 M 系列语言模型,适用于智能体推理、工具调用、编程、结构化任务执行及长上下文任务。文档同样确认了 1,000,000 token 的上下文窗口,并支持基于 OpenAI 协议的多模态聊天输入,包括文本、图片 URL 和视频 URL 内容部分。
对于搜索和评估团队而言,MiniMax M3 最适合用于对比长上下文 AI 模型、编程智能体模型、多模态聊天模型及 API 可访问的基础模型。
MiniMax M3 的主要参数与定价如何?
| 字段 | 数值 |
|---|---|
| 服务商 | MiniMax(截至 2026年7月) |
| 模型系列 | MiniMax M 系列(截至 2026年7月) |
| 模型类型 | 多模态基础模型 / 面向编程、智能体和长上下文任务的语言模型(截至 2026年7月) |
| 发布时间 | 2026年6月1日(截至 2026年7月) |
| 上下文窗口 | 1,000,000 token(截至 2026年7月) |
| 输入定价 | 依据Gate.AI报价:每 100 万输入 token 1.20 美元。MiniMax 官方标准定价显示,≤512K 输入 token 时为每 100 万 token 0.30 美元,>512K 时为每 100 万 token 0.60 美元(截至 2026年7月)。 |
| 缓存读取定价 | 依据Gate.AI报价:每 100 万缓存读取 token 0.12 美元。MiniMax 官方标准定价显示,≤512K 输入 token 时为每 100 万 token 0.06 美元,>512K 时为每 100 万 token 0.12 美元(截至 2026年7月)。 |
| 缓存写入定价 | Gate.AI报价未标明;MiniMax-M3 在 MiniMax 价格表中未确认(截至 2026年7月) |
| 输出定价 | 依据Gate.AI报价:每 100 万输出 token 4.80 美元。MiniMax 官方标准定价显示,≤512K 输入 token 时为每 100 万 token 1.20 美元,>512K 时为每 100 万 token 2.40 美元(截至 2026年7月)。 |
| 计费单位 | 每 100 万 token(截至 2026年7月) |
| 支持模态 | 文本、图片、视频输入;通过聊天补全使用文本输出(截至 2026年7月) |
| 支持输入类型 | 通过 OpenAI 协议兼容的 Chat Completions 支持 text、image_url、video_url 内容部分(截至 2026年7月) |
| 支持输出类型 | API 示例中确认支持文本输出;截至 2026年7月,MiniMax-M3 尚未确认支持图片、视频、音频输出 |
| API 访问 | 通过 MiniMax API 提供 Anthropic 协议兼容和 OpenAI 协议兼容的接口;Gate.AI 提供 OpenAI 协议兼容网关访问,详见 Gate.AI 报价及 Gate.AI 文档(截至 2026年7月) |
| 模型 ID | MiniMax 服务商 ID:MiniMax-M3;Gate.AI 报价 ID:minimax/minimax-m3(截至 2026年7月) |
| 可用性 | MiniMax API 文档显示 MiniMax-M3 可用;Gate.AI 访问包含在 Gate.AI 报价中(截至 2026年7月) |
| 知识截止时间 | 截至 2026年7月,官方渠道未确认 |
| 速率限制 | 截至 2026年7月,官方渠道未确认 |
| 微调支持 | 截至 2026年7月,官方渠道未确认 |
| 流式输出支持 | MiniMax 文档显示,非流式示例可通过设置 stream=true 切换为流式输出(截至 2026年7月) |
| 批量 API 支持 | 截至 2026年7月,官方渠道未确认 |
| 工具/函数调用 | MiniMax 文档描述了工具调用和智能体推理,但具体实现细节需在生产集成前查阅当前 API 参考(截至 2026年7月) |
| 结构化输出/JSON 模式 | 描述了结构化任务执行,但截至 2026年7月,官方渠道未确认专用 JSON 模式 |
| 许可/使用限制 | MiniMax 在发布材料中称 M3 为开源权重,但商用部署和再分发前应直接查阅当前许可协议(截至 2026年7月) |
MiniMax M3 在生产环境中的应用价值有哪些?
长上下文文档与代码库处理。 MiniMax-M3 支持高达 1,000,000 token 的上下文窗口,有助于团队处理长文档、大型代码库、日志、多文件提示及长时智能体会话,减少调用次数。适用于仓库分析、政策审查、合约摘要、研究整合及内部知识流转。需要注意,长上下文并不保证对每个细节都能完美检索、排序或推理。
编程智能体工作流。 MiniMax 将 M3 定位为面向编程和智能体工作的模型,涵盖缺陷修复、前后端开发、性能优化等场景,适用于软件维护、编程助手、自动化调试和开发者 Copilot。但生产部署前仍需通过测试、代码审查、静态分析和安全检查。
智能体推理与工具调用。 MiniMax API 文档将 MiniMax-M3 定义为智能体推理、工具调用和结构化任务执行的模型,支持多步工作流智能体、研究助手、自动化助手和任务规划,能在指令与中间结果间保持上下文。工具访问需有权限管理、日志记录及上线前充分测试。
多模态理解。 MiniMax-M3 支持文本、图片、视频输入,适用于视觉问答、界面分析、内容审核、媒体理解及计算机使用场景。模型当前确认的输出为文本,团队不应假定 MiniMax-M3 能生成图片、视频或音频,除非官方文档明确说明。
计算机使用场景。 MiniMax 发布声明指出 M3 能操作桌面计算机,适合浏览器工作流、办公工具自动化及受控任务自动化。由于计算机使用系统可触发实际操作,生产部署需采用沙箱环境、人工审核节点、权限范围控制及回滚机制。
MiniMax M3 支持哪些模态?
| 模态 | 是否支持 | 说明 | 来源状态 |
|---|---|---|---|
| 文本输入 | 支持 | 通过 MiniMax 聊天及消息示例支持。 | 2026年7月 MiniMax API 文档确认 |
| 图片输入 | 支持 | OpenAI 协议兼容的 Chat Completions 支持 image_url 内容部分。 | 2026年7月 MiniMax API 文档确认 |
| 视频输入 | 支持 | OpenAI 协议兼容的 Chat Completions 支持 video_url 内容部分。 | 2026年7月 MiniMax API 文档确认 |
| 音频输入 | 未确认 | MiniMax 有独立音频产品,但 MiniMax-M3 聊天的音频输入在已查阅文档中未确认。 | 截至 2026年7月官方渠道未确认 |
| 文本输出 | 支持 | 聊天及消息响应的 API 示例已确认。 | 2026年7月 MiniMax API 文档确认 |
| 图片输出 | 未确认 | MiniMax 提供独立图片能力,但 MiniMax-M3 未确认支持图片输出。 | 截至 2026年7月官方渠道未确认 |
| 视频输出 | 未确认 | MiniMax 提供独立视频产品,但 MiniMax-M3 未确认支持视频输出。 | 截至 2026年7月官方渠道未确认 |
| 音频输出 | 未确认 | MiniMax 提供独立语音产品,但 MiniMax-M3 未确认支持音频输出。 | 截至 2026年7月官方渠道未确认 |
MiniMax M3 的主要局限有哪些?
截至 2026年7月,MiniMax M3 的主要文档空白包括知识截止时间、速率限制、微调支持、批量 API 支持及专用结构化输出或 JSON 模式。这些空白并不意味着功能缺失,而是未在已查阅的官方资料中确认。
价格信息也需注意来源区分。Gate.AI 上,MiniMax M3 定价为每 100 万输入 token 1.20 美元、每 100 万输出 token 4.80 美元、每 100 万缓存读取 token 0.12 美元。MiniMax 官方页面则有分级折扣价,部分输入长度区间价格更低。团队应以实际访问渠道为准参照价格。
此外,这也是通用 AI 的局限,除非服务商特别说明,否则同样适用:MiniMax M3 可能出现幻觉、误读视觉输入、遗漏关键信息、生成不安全代码或输出看似合理但实际错误的解释。生产系统应配备验证、监控、评测集、访问控制及高影响输出的人审。
1,000,000 token 的上下文窗口是显著能力,但也会增加提示成本、延迟和评估复杂性。长上下文工作流仍需良好的提示结构、检索设计、来源引用、输出校验及不完整或不一致答案的兜底方案。
MiniMax M3 最适合哪些应用场景?
| 应用场景 | MiniMax M3 的适用理由 | 重要限制说明 |
|---|---|---|
| 长文档分析 | 1,000,000 token 上下文窗口有助于大文档、政策、转录或技术资料的批量处理。 | 长上下文不保证完美引用召回或事实准确性。 |
| 代码库审查与编程智能体 | MiniMax 将 M3 定位于编程、智能体工作、缺陷修复及开发流程。 | 生成代码需经过测试、审查及安全性检验。 |
| 多模态问答 | 文本、图片、视频输入支持适合界面分析、视觉 QA、媒体相关推理。 | MiniMax-M3 输出端除文本外的模态未确认。 |
| 计算机使用自动化 | MiniMax 声称 M3 可操作桌面计算机。 | 计算机自动化需沙箱、权限控制及人工审批。 |
| 多步工作流助手 | 智能体推理、工具调用和结构化任务执行让 M3 适合工作流 Copilot。 | 工具行为、异常处理和速率限制需在目标环境中验证。 |
理解长上下文模型行为有助于团队判断 MiniMax M3 的 1M token 上下文窗口何时适用,何时检索增强生成更安全。对比视觉推理方案时,多模态 AI 模型接入也是相关的评估主题。
MiniMax M3 与 GPT-4o、Gemini 1.5 Pro 对比如何?
| 对比维度 | MiniMax M3 | GPT-4o | Gemini 1.5 Pro | 适用场景说明 |
|---|---|---|---|---|
| 服务商 | MiniMax | OpenAI | Google / Google DeepMind | 依据 API 体系、合规、数据政策和区域可用性选择。 |
| 模型类型 | 面向长上下文、编程与智能体的多模态基础模型 | 通用多模态模型 | 长上下文多模态模型 | 当长上下文、编程和智能体工作流为核心时,MiniMax M3 尤为适用。 |
| 上下文窗口 | 2026年7月 MiniMax API 文档确认 1,000,000 token | 发布前查阅 OpenAI 最新文档 | 发布前查阅 Google 最新文档 | 采购前以服务商最新文档为准。 |
| 输入模态 | 文本、图片、视频输入已确认 | 发布前查阅 OpenAI 最新文档 | 发布前查阅 Google 最新文档 | MiniMax M3 适合需文本+图片/视频输入的工作流。 |
| API 访问 | MiniMax API 及Gate.AI OpenAI 协议兼容网关,详见Gate.AI报价 | 服务商及网关访问以实际可用性为准 | 服务商及网关访问以实际可用性为准 | 选用已验证价格、合规和运维支持的访问通道。 |
| 定价依据 | Gate.AI报价与 MiniMax 官方服务商定价需区分 | 发布前查阅 OpenAI 最新定价 | 发布前查阅 Google 最新定价 | 按实际服务商或网关比较价格。 |
| 主生产适配 | 长上下文编程、智能体工作流、多模态理解、计算机使用场景 | 通用多模态应用 | 长上下文多模态分析 | 无绝对优劣,需结合任务类型、延迟、可靠性、成本和合规要求选型。 |
MiniMax M3 应仅基于团队计划部署路径的官方最新参数与 GPT-4o、Gemini 1.5 Pro 对比。例如,GPT-4o 多模态工作流和Gemini 长上下文场景与 MiniMax M3 有交集,但团队应在自身环境中验证价格、上下文表现、延迟和工具支持。
如何通过 Gate.AI 访问 MiniMax M3?
Gate.AI 已将 MiniMax M3 纳入其报价,模型 ID 为 minimax/minimax-m3。Gate.AI 文档确认支持 OpenAI 协议兼容 API 格式,基础 URL 为 https://api.gate.ai/openai/v1,采用 Bearer Token 认证,按量计费,聊天补全接口为 /openai/v1/chat/completions。
Python 示例
from openai import OpenAIimport osclient = OpenAI(api_key=os.environ["GATEAI_API_KEY"],base_url="https://api.gate.ai/openai/v1",)response = client.chat.completions.create(model="minimax/minimax-m3",messages=[{"role": "user","content": "Summarize the main risks of using long-context AI agents."}],)print(response.choices[0].message.content)
curl 示例
curl https://api.gate.ai/openai/v1/chat/completions \-H "Authorization: Bearer $GATEAI_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "minimax/minimax-m3","messages": [{"role": "user","content": "Summarize the main risks of using long-context AI agents."}]}'
开发者也可直接通过 MiniMax 官方 API 访问 MiniMax M3。MiniMax 文档列出了 Anthropic 协议兼容端点 https://api.minimax.io/anthropic,OpenAI 协议兼容端点 https://api.minimax.io/v1,模型名称为 MiniMax-M3。
常见问题
MiniMax M3 的上下文窗口是多少?
MiniMax API 文档显示,截至 2026年7月,MiniMax-M3 支持 1,000,000 token 上下文窗口。适合长文档、代码库和多步智能体会话,但开发者仍需在大输入量场景下测试检索质量与成本。
MiniMax M3 的费用是多少?
根据 Gate.AI 报价,MiniMax M3 输入端为每 100 万 token 1.20 美元,输出端为每 100 万 token 4.80 美元。MiniMax 官方页面有独立分级服务商定价,团队应以实际访问渠道为准。
开发者如何访问 MiniMax M3?
开发者可通过 MiniMax 的 Anthropic 协议兼容或 OpenAI 协议兼容 API 访问。根据 Gate.AI 报价,也可通过 Gate.AI,模型 ID 为 minimax/minimax-m3,API 基础 URL 为 Gate.AI 的 OpenAI 协议兼容地址。
MiniMax M3 适用于哪些场景?
MiniMax M3 适合长上下文分析、编程智能体、多模态理解、计算机使用场景及多步工作流自动化。但在高影响决策中不能替代人工审核,生成代码或视觉理解结果需经过验证。


