Mixtral 8x22B:完整规格、定价、API 接入与应用场景(2026)
什么是 Mixtral 8x22B?
Mixtral 8x22B 是 Mistral AI 于 2024年4月17日发布的开源稀疏专家混合(Mixture-of-Experts, MoE)大型语言模型,具备 64K 令牌上下文窗口和文本生成能力。由于 Mistral 官方文档已将该模型标记为 2026年6月退役,目前托管 API 的定价未予公布。
Mistral 将 Mixtral 8x22B 描述为一款稀疏 MoE 架构模型,总参数量为 1410 亿,每个 token 激活参数为 390 亿,旨在为用户提供比密集型通用 LLM 更大规模的开源权重选择。该模型适用于研究开源权重的多语言生成、编程、数学推理、长文档提示、函数调用及自托管 LLM 部署等场景。
关于该模型的当前生产状态需谨慎解读。最初可通过 Mistral 托管平台获得,但 Mistral 最新的模型卡已注明其将在 2025年3月30日退役,并推荐 Mistral Small 3.2 作为替代方案。团队在对比 Mistral 旧版开源模型与新一代托管产品时,通常会优先考虑 Mistral Large API 访问 或新版 Mistral Small 4 规格。
Mixtral 8x22B 的核心参数及定价如何?
| 字段 | 经核实的数值 |
|---|---|
| 提供方 | Mistral AI(截至2026年6月) |
| 模型系列 | Mixtral / Mistral 开源模型(截至2026年6月) |
| 模型类型 | 开源稀疏专家混合大型语言模型(截至2026年6月) |
| 发布时间 | 2024年4月17日(截至2026年6月) |
| 上下文窗口 | 64K 令牌(截至2026年6月) |
| 输入定价 | 当前托管 API 未列出,因 Mistral 托管模型已退役(截至2026年6月) |
| 缓存输入定价 | 截至2026年6月,官方未确认当前 Mixtral 8x22B 托管使用的缓存输入定价 |
| 输出定价 | 当前托管 API 未列出,因 Mistral 托管模型已退役(截至2026年6月) |
| 计价单位 | Mistral 当前 API 按百万 token 计价,但 Mixtral 8x22B 未作为现行计价模型列出(截至2026年6月) |
| 多模态支持 | 以文本为主;截至2026年6月,官方文档未确认 Mixtral 8x22B 支持图像、音频或视频输入 |
| 支持输入类型 | 文本提示/消息(截至2026年6月) |
| 支持输出类型 | 文本输出(截至2026年6月) |
| API 访问 | 曾经支持 Mistral 托管访问;当前模型卡显示 2025年3月30日退役(截至2026年6月) |
| 模型 ID | open-mixtral-8x22b;Hugging Face instruct ID: mistralai/Mixtral-8x22B-Instruct-v0.1(截至2026年6月) |
| 可用性 | 开源权重仍有文档记录;Mistral 托管 API 模型已退役(截至2026年6月) |
| 知识截止点 | 截至2026年6月,官方未确认 |
| 速率限制 | 截至2026年6月,未确认当前 Mixtral 8x22B 托管使用的速率限制 |
| 微调支持 | 权重可按 Apache 2.0 协议使用;截至2026年6月,当前托管服务未确认支持 Mixtral 8x22B 微调 |
| 流式输出支持 | 不适用于当前托管 Mixtral 8x22B API 状态;Mistral 通用 chat 端点支持现有模型流式输出(截至2026年6月) |
| 批量 API 支持 | 截至2026年6月,未确认当前 Mixtral 8x22B 托管使用的批量 API 支持 |
| 工具/函数调用 | 官方发布材料声明原生支持函数调用;Hugging Face 文档有相关 token 与示例(截至2026年6月) |
| 结构化输出/JSON 模式 | 发布材料提及 la Plateforme 上有限制的输出模式;当前 Mixtral 8x22B 托管访问已退役(截至2026年6月) |
| 许可/使用限制 | Apache 2.0 权重(截至2026年6月) |
Mixtral 8x22B 在生产环境中有哪些实用价值?
- 长文本处理能力。 Mixtral 8x22B 拥有 64K 令牌上下文窗口,适用于大文档摘要、检索增强写作、多文件分析等场景,前提是团队可自托管模型或采用受支持的部署方式。但需注意,随着提示长度增加,内存消耗、延迟和评估复杂度也会提升。
- 多语言生成。 Mistral 在发布时强调该模型对英语、法语、意大利语、德语和西班牙语具备良好支持,适用于多语言文档、支持内容起草及内部知识流转。但在实际部署前,仍建议对领域专用术语进行测试。
- 编程与数学辅助。 Mistral 将 Mixtral 8x22B 定位为在数学和编程任务上表现优异,可用于代码解释、测试生成、数据转换和技术问答。但不建议将其作为生产代码、敏感安全修复或合规决策的唯一依据,需结合人工校验。
- 函数调用流程。 该模型原生支持函数调用,适合用于模型自主选择结构化工具调用的 agent 流程。自托管实现时需格外注意提示格式、模式校验和日志记录。
Mixtral 8x22B 支持哪些模态?
| 模态 | 是否支持 | 备注 |
|---|---|---|
| 文本输入 | 是 | 支持通过提示/消息方式调用 LLM。 |
| 文本输出 | 是 | instruct 模型为文本生成型 LLM。 |
| 图像输入 | 未确认 | 官方文档未将 Mixtral 8x22B 归为视觉模型。 |
| 音频输入 | 未确认 | 未发现官方支持音频输入的说明。 |
| 视频输入 | 未确认 | 未发现官方支持视频输入的说明。 |
| 工具/函数调用 | 是,但实现有注意事项 | 官方发布材料及 Hugging Face 均提及函数调用支持。 |
Mixtral 8x22B 有哪些不足?
- 最大的限制是可用性:Mistral 当前模型卡已将 Mixtral 8x22B 标记为托管 API 退役,因此团队不应基于 open-mixtral-8x22b 构建新的托管生产系统,除非有单独的经验证部署路径。
- 由于托管 API 已退役,官方当前定价信息不可用。任何历史或第三方价格应与 Mistral 现行官方定价区分对待。
- 该模型聚焦文本处理,无法替代支持图像、音频或更丰富工具生态的现代多模态模型,如新版 Mistral、Gemini、GPT-4o 或 Claude。若需多模态对比,可参考 Gemini 1.5 Pro 规格 或 GPT-4o mini 访问模式。
- 此外,Mixtral 8x22B 也存在通用 AI 局限性(除非 Mistral 有特别声明):可能产生幻觉、输出不安全或有偏见的内容、误解长提示,对法律、医疗、金融、安全等高风险场景,始终建议专家复核。
Mixtral 8x22B 适合哪些应用场景?
| 应用场景 | 适用原因 | 重要限制 |
|---|---|---|
| 自托管开源权重 LLM 实验 | Apache 2.0 权重及 MoE 架构适合基础设施测试 | 需大量 GPU 内存及部署经验 |
| 长文档文本分析 | 64K 上下文支持比早期 Mixtral 8x7B 更长提示 | 长上下文的可靠性需具体任务评估 |
| 多语言内部内容起草 | 发布材料强调五种欧洲语言支持 | 领域专用术语仍需验证 |
| 编程与数学辅助 | Mistral 强调其编程与数学能力 | 生成的代码和计算结果需校验 |
| 工具调用研究 | 模型材料提及函数调用支持 | 生产环境下需严格的模式校验和安全控制 |
Mixtral 8x22B 与 Mistral Small 4、Llama 3.1 70B 有何对比?
| 对比维度 | Mixtral 8x22B | Mistral Small 4 | Llama 3.1 70B Instruct | 适用场景 |
|---|---|---|---|---|
| 提供方 | Mistral AI | Mistral AI | Meta | 适合对比 Mistral 开源 MoE 与 Meta 开源文本模型 |
| 发布状态 | 2024年4月发布,Mistral 托管 API 于2025年3月退役 | 2026年3月发布,现行定价 | 2024年7月发布 | 新部署需关注当前可用性 |
| 上下文窗口 | 64K | 256K | 128K | Small 4 或 Llama 3.1 更适合超长上下文任务 |
| 模型设计 | 稀疏 MoE,1410亿总参数/390亿激活参数 | 混合模型,1190亿参数/6.5亿激活参数 | 密集型 700亿级 Transformer | Mixtral 适合 MoE 自托管研究,Llama 3.1 广泛用于开源文本部署 |
| 支持模态 | 以文本为主 | Mistral 官方材料标注为多模态 | 文本输入/文本与代码输出 | 多模态任务建议选用新模型 |
| 当前定价 | 托管模型已退役,未列出 | \$0.15/百万输入 token,\$0.60/百万输出 token | 定价取决于托管方,Meta 模型卡未列价 | 成本对比依赖具体部署方式 |
| 访问方式 | 开源权重,托管模型已退役 | 当前 Mistral API/模型卡 | Meta/Hugging Face 提供开源权重,受许可约束 | 仅在需特定开源 MoE 行为时选用 Mixtral 8x22B |
如何访问 Mixtral 8x22B?
Mistral 最新文档将历史托管模型 ID 标注为 open-mixtral-8x22b,但同时注明托管访问将于 2025年3月30日退役。
开发者如仍需使用 Mixtral 8x22B,应单独评估开源权重、Apache 2.0 许可条款、所需 GPU 内存、分词器兼容性及第三方推理框架。Hugging Face 上 instruct 模型为 mistralai/Mixtral-8x22B-Instruct-v0.1,同样采用 Apache 2.0 许可,参数量为 1410 亿。
常见问题解答
Mixtral 8x22B 的上下文窗口是多少?
截至2026年6月,Mistral 官方模型卡显示 Mixtral 8x22B 的上下文窗口为 64K 令牌。
Mixtral 8x22B 的费用是多少?
当前官方 Mistral 托管 API 未公布定价,因官方模型卡已将 Mixtral 8x22B 标记为退役。任何第三方或历史价格请单独参考。
我能通过 Mistral API 使用 Mixtral 8x22B 吗?
Mistral 当前文档列出模型 ID 为 open-mixtral-8x22b,但托管访问已于 2025年3月30日退役。
Mixtral 8x22B 适合哪些场景?
适用于自托管开源 LLM 实验、多语言文本生成、长文档分析、编程辅助及函数调用研究,但需对输出结果进行验证。


