Mistral Small 4:完整规格、定价、API 接入与应用场景(2026)
什么是 Mistral Small 4?
Mistral Small 4 是 Mistral AI 于2026年3月16日发布的开放权重多模态大语言模型,具备256K令牌上下文窗口,支持混合指令、推理、代码生成及图像理解能力。截至2026年6月,其API定价为每100万输入令牌0.15美元、每100万输出令牌0.60美元。
Mistral AI 将该模型描述为 Mistral Small 系列的重要版本,整合了推理、多模态理解和代理式代码能力于一体。官方模型卡显示总参数量为1190亿,活跃参数为65亿,属于专家混合模型(Mixture-of-Experts),旨在高效推理,而非等规模的稠密模型。
用户通常关注 Mistral Small 4 是否是较大前沿模型的成本敏感替代方案,其长上下文窗口是否适合文档工作流,以及是否能处理文本与图像输入。团队在对比其与 Mistral Large 部署选项 时,应分别考虑成本、上下文长度、模态支持和推理需求,而非简单认为某一模型适用于所有场景。
Mistral Small 4 的核心规格与定价
| 字段 | 经核实的数值 |
|---|---|
| 提供方 | Mistral AI(截至2026年6月)。 |
| 模型系列 | Mistral Small(截至2026年6月)。 |
| 模型类型 | 开放权重多模态专家混合大语言模型,支持指令、推理和代码能力(截至2026年6月)。 |
| 发布日期 | 2026年3月16日(截至2026年6月)。 |
| 上下文窗口 | 256K令牌(截至2026年6月)。 |
| 输入定价 | 每100万输入令牌0.15美元(截至2026年6月)。 |
| 缓存输入定价 | 缓存令牌按标准输入令牌价格的10%计费;Mistral Small 4 缓存提示词适用时为每100万缓存输入令牌0.015美元(截至2026年6月)。 |
| 输出定价 | 每100万输出令牌0.60美元(截至2026年6月)。 |
| 计价单位 | 按处理的每100万令牌计价,输入与输出分开计费(截至2026年6月)。 |
| 模态支持 | 支持文本与图像输入,输出为文本(截至2026年6月)。 |
| 支持的输入类型 | 文本输入与图像输入(截至2026年6月)。 |
| 支持的输出类型 | 通过聊天补全响应输出文本(截至2026年6月)。 |
| API访问 | 支持 Mistral API 与 AI Studio,也可通过 Hugging Face 和 NVIDIA 渠道获取(截至2026年6月)。 |
| 模型ID | mistral-small-latest;模型卡还列出 mistral-small-2603+1(截至2026年6月)。 |
| 可用性 | Mistral API、AI Studio、Hugging Face 仓库及 NVIDIA 部署选项(截至2026年6月)。 |
| 知识截止时间 | 截至2026年6月,官方来源未确认。 |
| 速率限制 | 截至2026年6月,官方来源未确认。 |
| 微调支持 | 支持开放权重定制与微调,但截至2026年6月,供应商管理的微调细节尚未完全确认。 |
| 流式支持 | 通过聊天补全API的 stream 参数支持流式(截至2026年6月)。 |
| 批量API支持 | 模型卡功能中列出支持 /v1/batch 批量处理(截至2026年6月)。 |
| 工具/函数调用 | 通过聊天补全与对话端点支持(截至2026年6月)。 |
| 结构化输出/JSON模式 | 支持响应格式选项,包括 JSON 对象与 JSON schema 模式(截至2026年6月)。 |
| 许可/使用限制 | 开放权重版本采用 Apache 2.0 许可(截至2026年6月)。 |
Mistral Small 4 在生产环境中的实用价值
Mistral Small 4 可用于一般聊天与指令跟随场景,适合团队需要低成本文本生成、摘要、信息抽取和自动化支持。其256K上下文窗口适用于长提示词和文档密集型工作流,但长上下文仍需精心设计提示词并验证检索结果。
该模型可处理图像输入,支持多模态分析,如文档与视觉理解场景。这对抽取与审核流程有帮助,但在高风险场景下,图像解释仍需人工复核,因为视觉-语言模型可能误读细节。
支持函数调用、结构化输出与 JSON schema 模式,适用于需要模型输出与工具、API及类型化下游系统连接的应用。理解 GPT-4o mini API 模式,有助于团队对比不同供应商的低成本多模态与工具增强模型选项。
Mistral Small 4 还具备可调节推理力度,开发者可针对普通任务选择更快响应,或对复杂提示词采用更深入推理。这并不能消除幻觉风险,输出仍需针对准确性、延迟与成本进行评估。
Mistral Small 4 支持哪些模态?
| 模态 | 是否支持 | 说明 |
|---|---|---|
| 文本输入 | 是 | 通过聊天补全与一般指令工作流支持(截至2026年6月)。 |
| 图像输入 | 是 | Mistral AI 表示 Mistral Small 4 原生支持文本与图像输入的多模态能力(截至2026年6月)。 |
| 文本输出 | 是 | 聊天补全输出返回助手消息内容(截至2026年6月)。 |
| 音频输入 | 未确认 | 截至2026年6月,官方来源未确认 Mistral Small 4 支持音频输入。 |
| 音频输出 | 未确认 | 截至2026年6月,官方来源未确认 Mistral Small 4 支持音频输出。 |
| 视频输入/输出 | 未确认 | 截至2026年6月,官方来源未确认 Mistral Small 4 支持视频相关模态。 |
Mistral Small 4 的局限性
Mistral Small 4 并非所有运营细节都已公开。官方已确认上下文窗口、定价、核心模态、功能、模型ID及许可,但截至2026年6月,尚未明确知识截止时间或统一速率限制。
这属于一般AI局限,除非供应商特别声明:模型可能出现幻觉、遗漏上下文、误读图像或生成看似合理但错误的输出。法律、医疗、金融、安全与合规决策需专家审核。
长上下文支持并不保证长文档推理能力完美。即使具备256K令牌窗口,团队在生产文档工作流中仍需采用检索、分块、引用、评估集与回归测试。对比长上下文替代方案如 Gemini 1.5 Pro 时,应结合实际文档长度、检索方式与答案质量需求进行测试。
开放权重版本也可能带来部署复杂性。自托管或微调可提升控制力,但基础设施要求、服务栈成熟度、量化选择与运维监控会影响延迟、吞吐与成本。Mistral 官方公告列出推荐基础设施示例,较小团队可优先选择托管API进行初步生产测试。
Mistral Small 4 最适合哪些应用场景?
| 应用场景 | 适用理由 | 重要限制 |
|---|---|---|
| 成本敏感聊天助手 | 输入/输出定价低,支持高并发文本生成,适用于大规模助手工作流(截至2026年6月)。 | 需安全测试、幻觉控制与监控。 |
| 文档理解 | 256K上下文与图像输入支持长文档及视觉文档工作流(截至2026年6月)。 | 长上下文不能替代检索验证。 |
| 编码与代理任务 | Mistral 官方描述编码与代理工作流为主要应用场景(截至2026年6月)。 | 工具执行与代码变更需沙盒与审核。 |
| 结构化抽取 | JSON schema 模式与函数调用适用于类型化输出与工具连接系统(截至2026年6月)。 | Schema 可减少格式错误,但不能保证事实正确。 |
| 多语言与多模态工作流 | 官方资料描述支持多模态与多语言场景(截至2026年6月)。 | 需按工作流评估语言与图像质量。 |
Mistral Small 4 与 Mistral Medium 3.5、Mistral Large 3 对比
| 对比维度 | Mistral Small 4 | Mistral Medium 3.5 | Mistral Large 3 | 场景适配 |
|---|---|---|---|---|
| 提供方 | Mistral AI(截至2026年6月)。 | Mistral AI(截至2026年6月)。 | Mistral AI(截至2026年6月)。 | 同一供应商对比可减少API集成差异。 |
| 发布日期 | 2026年3月16日。 | 2026年4月28日。 | 2025年12月2日。 | 发布时点不应成为生产适配唯一依据。 |
| 上下文窗口 | 256K令牌。 | 256K令牌。 | 256K令牌。 | 三者均支持长上下文工作流。 |
| 定价 | 输入0.15美元/输出0.60美元每100万令牌。 | 输入1.50美元/输出7.50美元每100万令牌。 | 输入0.50美元/输出1.50美元每100万令牌。 | Small 4 适合成本敏感场景;Medium 3.5、Large 3 适合高能力评估。 |
| 核心定位 | 混合指令、推理、编码与多模态模型。 | 前沿级多模态模型,优化代理与编码场景。 | 通用多模态开放权重模型,6750亿总参数,410亿活跃参数。 | 应按工作负载、预算与评估结果选择。 |
如何访问 Mistral Small 4?
Mistral Small 4 可通过 Mistral API 与 AI Studio 获取,托管API别名为 mistral-small-latest。官方API文档列出 POST /v1/chat/completions、Bearer令牌认证、model字段、消息式请求、流式支持、函数/工具字段与结构化响应格式。
Python 示例
from mistralai.client import Mistralimport osapi_key = os.environ["MISTRAL_API_KEY"]client = Mistral(api_key=api_key)response = client.chat.complete(model="mistral-small-latest",messages=[{"role": "user","content": "Summarize the main production use cases for Mistral Small 4."}],)print(response.choices[0].message.content)
curl 示例
curl https://api.mistral.ai/v1/chat/completions \-X POST \-H "Authorization: Bearer $MISTRAL_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "mistral-small-latest","messages": [{"role": "user","content": "Summarize the main production use cases for Mistral Small 4."}]}'
常见问题
Mistral Small 4 的上下文窗口是多少?
根据 Mistral AI 官方模型卡与公告,截至2026年6月,Mistral Small 4 支持256K令牌上下文窗口。
Mistral Small 4 的定价是多少?
截至2026年6月,Mistral Small 4 API定价为每100万输入令牌0.15美元、每100万输出令牌0.60美元。缓存提示令牌在适用时按标准输入价格的10%计费。
开发者如何访问 Mistral Small 4?
开发者可通过 Mistral API,使用 mistral-small-latest,结合 /v1/chat/completions 端点与 Bearer令牌认证访问。
Mistral Small 4 适合哪些场景?
Mistral Small 4 可用于成本敏感聊天、文档理解、多模态抽取、编码辅助、代理工作流及结构化输出任务,但生产部署需包含评估、高风险场景人工审核与幻觉控制。


