Hy3 预览:完整规格、定价、API 接入与应用场景(2026)
Hy3 Preview 简介
Hy3 Preview 是腾讯于2026年4月发布的2950亿参数专家混合(Mixture-of-Experts, MoE)推理与智能体模型,具备256K Token上下文窗口和文本生成能力。根据2026年7月Gate.AI定价,输入Token为每百万0.18美元,输出Token为每百万0.60美元。
腾讯将Hy3 Preview描述为由腾讯Hy团队研发的MoE模型,总参数量2950亿,激活参数量210亿,MTP层参数量3.8亿。官方材料定位该模型于复杂推理、指令跟随、上下文学习、编程及智能体任务。
Hy3 Preview适用于开发者和AI团队评估长上下文推理模型在智能体流程、代码辅助、文档处理及多步规划中的应用。腾讯表示Hy3 Preview已开源,可通过GitHub、Hugging Face、ModelScope和GitCode获取,并支持主流推理框架,包括vLLM和SGLang。
Hy3 Preview 主要参数与定价
| 字段 | 取值 |
|---|---|
| 提供方 | 腾讯 / 腾讯Hy团队(截至2026年7月) |
| 模型系列 | Hy / 腾讯Hy模型系列(截至2026年7月) |
| 模型类型 | 专家混合推理与智能体模型;文本生成模型(截至2026年7月) |
| 发布时间 | 2026年4月;腾讯公告确认Hy3 Preview已开放获取及开源(截至2026年7月) |
| 上下文窗口 | 256K Token(截至2026年7月) |
| 总参数量 | 2950亿参数(截至2026年7月) |
| 激活参数量 | 210亿激活参数(截至2026年7月) |
| MTP层参数量 | 3.8亿MTP层参数(截至2026年7月) |
| 架构 | 专家混合(MoE),192个专家,激活Top-8,模型卡标注BF16精度(截至2026年7月) |
| 输入定价 | 每百万输入Token 0.18美元,Gate.AI与腾讯云起步价一致(截至2026年7月) |
| 缓存读取定价 | 每百万缓存读取Token 0.06美元,Gate.AI与腾讯云缓存读取价一致(截至2026年7月) |
| 缓存写入定价 | 2026年7月Gate.AI未明确标注 |
| 输出定价 | 每百万输出Token 0.60美元,Gate.AI标注;腾讯云称输出价约0.59美元起(截至2026年7月) |
| 计价单位 | 每百万Token(截至2026年7月) |
| 支持模态 | 已验证文本输入与输出;截至2026年7月,未确认支持图像、音频、视频 |
| 支持输入类型 | 文本提示、长上下文文本输入、代码、结构化自然语言指令(截至2026年7月) |
| 支持输出类型 | 文本生成响应(截至2026年7月) |
| API接入 | Gate.AI OpenAI兼容API;腾讯云TokenHub;GitHub、Hugging Face、ModelScope、GitCode开源权重部署(截至2026年7月) |
| 模型ID | tencent/hy3-preview,Gate.AI目录标注(截至2026年7月) |
| 可用性 | Gate.AI模型目录、腾讯云TokenHub、腾讯官方OpenRouter入口及开源权重库(截至2026年7月) |
| 知识截止时间 | 截至2026年7月,官方未确认 |
| 速率限制 | 可能有账户级与路由级限制,Hy3 Preview具体限制截至2026年7月官方未确认 |
| 微调支持 | 腾讯仓库有训练与LoRA/全量微调资源;Gate.AI托管微调支持截至2026年7月未确认 |
| 流式输出支持 | Gate.AI通用对话API支持流式输出,Hy3具体流式表现需按部署环境验证(截至2026年7月) |
| 批量API支持 | 截至2026年7月官方未确认 |
| 工具/函数调用 | 腾讯描述支持智能体框架集成和工具链编排,Hy3 Preview具体托管工具调用方案需生产前验证(截至2026年7月) |
| 结构化输出/JSON模式 | 截至2026年7月官方未确认 |
| 许可/使用限制 | 腾讯Hy社区许可协议(截至2026年7月) |
Hy3 Preview 在生产环境中的应用价值
Hy3 Preview 适合长上下文推理流程,腾讯官方模型材料标注其上下文长度为256K Token,能够支持大规模提示、长文档、多文件分析及智能体记忆块,尤其适用于检索校验和Token预算控制等场景。理解AI模型的上下文窗口,有助于团队评估单次请求可处理的数据量。
Hy3 Preview 同样适合智能体流程。腾讯报告称该模型已集成于元宝、ima、CodeBuddy、WorkBuddy、QQ、QQ浏览器、腾讯文档、腾讯学堂等产品,并支持多达495步的复杂真实用户智能体流程。相关数据为官方自述,生产应用前建议团队结合自身业务场景充分验证。
在代码与软件智能体实验方面,腾讯强调Hy3 Preview具备更强的代码与智能体能力,官方仓库提供vLLM和SGLang部署指导。适用于代码库分析、代码解释、规划、调试支持及多步工程助手,但生成代码需经过审查和测试。
Hy3 Preview 也适合关注成本的推理部署。Gate.AI标注的Token价格为输入每百万0.18美元、缓存读取每百万0.06美元、输出每百万0.60美元(截至2026年7月)。团队在与DeepSeek-R1推理流程或Kimi K2智能体场景对比时,应综合评估任务可靠性、延迟、输出长度、工具表现及整体流程成本,而不仅仅是Token单价。
Hy3 Preview 支持哪些模态?
| 模态 | 是否支持 | 说明 |
|---|---|---|
| 文本输入 | 支持 | 官方示例与模型卡描述文本生成、长上下文提示、代码与自然语言指令(截至2026年7月) |
| 文本输出 | 支持 | Hugging Face与腾讯材料均将Hy3 Preview定位为文本生成模型(截至2026年7月) |
| 图像输入 | 未确认 | 截至2026年7月,未有官方Hy3 Preview图像输入支持 |
| 音频输入 | 未确认 | 截至2026年7月,未有官方Hy3 Preview音频输入支持 |
| 视频输入 | 未确认 | 截至2026年7月,未有官方Hy3 Preview视频输入支持 |
| 向量嵌入 | 未确认 | 截至2026年7月,Hy3 Preview未标注为嵌入模型 |
| 工具输出 | 概念上部分支持 | 腾讯描述智能体框架与工具链编排场景,具体API方案生产前需验证 |
Hy3 Preview 有哪些局限?
Hy3 Preview 最大的限制在于截至2026年7月,部分运行细节尚未在官方公开资料中完全披露。知识截止时间、模型专属速率限制、批量API支持、结构化输出模式及具体服务级别条款,均建议生产部署前核查。
自托管部署对基础设施要求较高。腾讯将Hy3 Preview标注为2950亿参数MoE模型,激活参数210亿,BF16精度,并提供高端推理框架部署指导。即使具备MoE效率,本地部署仍需专用GPU、推理优化、监控与运维能力。
需要注意,这属于通用AI模型特性,非Hy3 Preview特有:推理模型可能生成看似合理但实际错误的内容。Hy3 Preview响应在法律、医疗、金融、网络安全、安全关键或高风险场景下使用前,务必核查权威来源。
高推理深度流程可能带来更高延迟和更长输出。团队应在客户智能体或自动决策流程部署前,明确提示策略、输出上限、检索约束、日志规则及人工审核阈值。
Hy3 Preview 最适合哪些场景?
| 应用场景 | 适用原因 | 重要限制说明 |
|---|---|---|
| 多步智能体流程 | 腾讯定位Hy3 Preview于推理、编程与智能体任务,并报告已在腾讯产品中落地(截至2026年7月) | 智能体行为需结合真实工具、权限与回滚机制充分测试 |
| 长文档分析 | 256K Token上下文长度可支持长提示与文档集(截至2026年7月) | 长上下文不保证检索、引用或指令完全准确 |
| 编程助手 | 腾讯强调代码与智能体能力提升,并提供部署示例(截至2026年7月) | 生成代码需测试、安全审查与开发者监督 |
| 复杂规划 | Hy3 Preview定位于复杂推理与多步执行(截至2026年7月) | 更高推理深度可能带来更高延迟和成本 |
| 企业开源权重实验 | 腾讯声明模型已在GitHub、Hugging Face、ModelScope、GitCode开源(截至2026年7月) | 需评估许可条款、部署成本与治理要求 |
| 成本敏感API路由 | Gate.AI定价为输入、缓存读取、输出Token单价低(截至2026年7月) | 总成本取决于提示规模、输出长度、重试、缓存命中率及路由策略 |
Hy3 Preview 与 DeepSeek-R1、Kimi K2 对比
| 对比维度 | Hy3 Preview | DeepSeek-R1 | Kimi K2 | 场景适配说明 |
|---|---|---|---|---|
| 核心定位 | 腾讯MoE推理与智能体模型,2950亿总参数,210亿激活参数(截至2026年7月) | 注重推理的模型系列,常用于复杂问题解决 | 偏向智能体与编程场景,常用于工具流程 | 适合优先考虑腾讯开源MoE设计与长上下文推理需求的团队 |
| 上下文窗口 | 256K Token,腾讯官方材料验证(截至2026年7月) | 需按实际路由核查上下文窗口 | 需按实际路由核查上下文窗口 | 需大上下文窗口时,Hy3 Preview具有优势 |
| 接入方式 | Gate.AI目录、腾讯云TokenHub、OpenRouter、开源权重库(截至2026年7月) | 不同提供方、网关、路由接入方式各异 | 不同提供方、网关、路由接入方式各异 | 生产切换前建议按路由实际表现评估 |
| 智能体能力 | 腾讯报告产品集成与复杂智能体流程支持(截至2026年7月) | 常用于推理链与问题求解 | 常用于编程与智能体任务 | 建议基于私有任务基准测试选择,而非泛泛“优劣”判断 |
| 成本评估 | Gate.AI定价:输入0.18、缓存读取0.06、输出0.60美元/百万Token(截至2026年7月) | 价格随路由与提供方不同 | 价格随路由与提供方不同 | 应综合评估总流程成本,包括重试、缓存命中、输出长度与延迟 |
如何通过 Gate.AI 访问 Hy3 Preview?
Gate.AI已在模型目录上线Hy3 Preview,并通过https://api.gate.ai/openai/v1提供OpenAI兼容API。官方文档说明平台完全兼容OpenAI API,支持Python、Node.js、curl及主流开发工具,采用Gate.AI API密钥配合OpenAI格式请求。
Gate.AI标注的模型ID为:
tencent/hy3-preview
Gate.AI文档确认通用对话API基础URL、Bearer Token认证、OpenAI兼容格式、按量计费及POST /chat/completions端点。
Python 示例
from openai import OpenAIimport osclient = OpenAI(api_key=os.environ["GATEAI_API_KEY"],base_url="https://api.gate.ai/openai/v1",)completion = client.chat.completions.create(model="tencent/hy3-preview",messages=[{"role": "system","content": "You are a concise technical assistant."},{"role": "user","content": "Summarize when a high-reasoning model is useful for an agent workflow."}],)print(completion.choices[0].message.content)
curl 示例
curl https://api.gate.ai/openai/v1/chat/completions \-H "Authorization: Bearer $GATEAI_API_KEY" \-H "Content-Type: application/json" \-d '{"model": "tencent/hy3-preview","messages": [{"role": "system","content": "You are a concise technical assistant."},{"role": "user","content": "Explain when Hy3 Preview may fit long-context agent workflows."}]}'
通过Gate.AI,开发者可统一采用OpenAI兼容请求模式调用支持的模型。生产部署前,建议团队核查账户级模型可用性、路由配置、速率限制、计费与缓存策略,以及Gate.AI控制台的Hy3专属参数。
常见问题
Hy3 Preview的上下文窗口是多少?
Hy3 Preview官方腾讯模型材料标注上下文长度为256K Token(截至2026年7月)。可支持长提示、文档分析与智能体记忆,但应用仍需检索校验、提示预算与输出验证。
Hy3 Preview在Gate.AI上的价格是多少?
Gate.AI标注Hy3 Preview输入Token每百万0.18美元,缓存读取每百万0.06美元,输出每百万0.60美元(截至2026年7月)。缓存写入定价未在当前目录中明确。
开发者如何接入Hy3 Preview?
开发者可通过Gate.AI,使用模型ID tencent/hy3-preview 及OpenAI兼容API访问。腾讯还通过GitHub、Hugging Face、ModelScope、GitCode提供开源权重,并有vLLM与SGLang部署指导。
Hy3 Preview适用于哪些场景?
Hy3 Preview适合长上下文推理、代码辅助、复杂规划、文档分析及多步智能体流程。生产应用前建议结合私有任务充分评估,尤其关注准确性、延迟、成本或安全控制等需求。


