Gate.AI博客Hy3 预览:完整规格、定价、API 接入与应用场景(2026)

    Hy3 预览:完整规格、定价、API 接入与应用场景(2026)

    模型

    Hy3 Preview 简介

    Hy3 Preview 是腾讯于2026年4月发布的2950亿参数专家混合(Mixture-of-Experts, MoE)推理与智能体模型,具备256K Token上下文窗口和文本生成能力。根据2026年7月Gate.AI定价,输入Token为每百万0.18美元,输出Token为每百万0.60美元。

    腾讯将Hy3 Preview描述为由腾讯Hy团队研发的MoE模型,总参数量2950亿,激活参数量210亿,MTP层参数量3.8亿。官方材料定位该模型于复杂推理、指令跟随、上下文学习、编程及智能体任务。

    Hy3 Preview适用于开发者和AI团队评估长上下文推理模型在智能体流程、代码辅助、文档处理及多步规划中的应用。腾讯表示Hy3 Preview已开源,可通过GitHub、Hugging Face、ModelScope和GitCode获取,并支持主流推理框架,包括vLLM和SGLang。

    Hy3 Preview 主要参数与定价

    字段 取值
    提供方 腾讯 / 腾讯Hy团队(截至2026年7月)
    模型系列 Hy / 腾讯Hy模型系列(截至2026年7月)
    模型类型 专家混合推理与智能体模型;文本生成模型(截至2026年7月)
    发布时间 2026年4月;腾讯公告确认Hy3 Preview已开放获取及开源(截至2026年7月)
    上下文窗口 256K Token(截至2026年7月)
    总参数量 2950亿参数(截至2026年7月)
    激活参数量 210亿激活参数(截至2026年7月)
    MTP层参数量 3.8亿MTP层参数(截至2026年7月)
    架构 专家混合(MoE),192个专家,激活Top-8,模型卡标注BF16精度(截至2026年7月)
    输入定价 每百万输入Token 0.18美元,Gate.AI与腾讯云起步价一致(截至2026年7月)
    缓存读取定价 每百万缓存读取Token 0.06美元,Gate.AI与腾讯云缓存读取价一致(截至2026年7月)
    缓存写入定价 2026年7月Gate.AI未明确标注
    输出定价 每百万输出Token 0.60美元,Gate.AI标注;腾讯云称输出价约0.59美元起(截至2026年7月)
    计价单位 每百万Token(截至2026年7月)
    支持模态 已验证文本输入与输出;截至2026年7月,未确认支持图像、音频、视频
    支持输入类型 文本提示、长上下文文本输入、代码、结构化自然语言指令(截至2026年7月)
    支持输出类型 文本生成响应(截至2026年7月)
    API接入 Gate.AI OpenAI兼容API;腾讯云TokenHub;GitHub、Hugging Face、ModelScope、GitCode开源权重部署(截至2026年7月)
    模型ID tencent/hy3-preview,Gate.AI目录标注(截至2026年7月)
    可用性 Gate.AI模型目录、腾讯云TokenHub、腾讯官方OpenRouter入口及开源权重库(截至2026年7月)
    知识截止时间 截至2026年7月,官方未确认
    速率限制 可能有账户级与路由级限制,Hy3 Preview具体限制截至2026年7月官方未确认
    微调支持 腾讯仓库有训练与LoRA/全量微调资源;Gate.AI托管微调支持截至2026年7月未确认
    流式输出支持 Gate.AI通用对话API支持流式输出,Hy3具体流式表现需按部署环境验证(截至2026年7月)
    批量API支持 截至2026年7月官方未确认
    工具/函数调用 腾讯描述支持智能体框架集成和工具链编排,Hy3 Preview具体托管工具调用方案需生产前验证(截至2026年7月)
    结构化输出/JSON模式 截至2026年7月官方未确认
    许可/使用限制 腾讯Hy社区许可协议(截至2026年7月)

    Hy3 Preview 在生产环境中的应用价值

    Hy3 Preview 适合长上下文推理流程,腾讯官方模型材料标注其上下文长度为256K Token,能够支持大规模提示、长文档、多文件分析及智能体记忆块,尤其适用于检索校验和Token预算控制等场景。理解AI模型的上下文窗口,有助于团队评估单次请求可处理的数据量。

    Hy3 Preview 同样适合智能体流程。腾讯报告称该模型已集成于元宝、ima、CodeBuddy、WorkBuddy、QQ、QQ浏览器、腾讯文档、腾讯学堂等产品,并支持多达495步的复杂真实用户智能体流程。相关数据为官方自述,生产应用前建议团队结合自身业务场景充分验证。

    在代码与软件智能体实验方面,腾讯强调Hy3 Preview具备更强的代码与智能体能力,官方仓库提供vLLM和SGLang部署指导。适用于代码库分析、代码解释、规划、调试支持及多步工程助手,但生成代码需经过审查和测试。

    Hy3 Preview 也适合关注成本的推理部署。Gate.AI标注的Token价格为输入每百万0.18美元、缓存读取每百万0.06美元、输出每百万0.60美元(截至2026年7月)。团队在与DeepSeek-R1推理流程Kimi K2智能体场景对比时,应综合评估任务可靠性、延迟、输出长度、工具表现及整体流程成本,而不仅仅是Token单价。

    Hy3 Preview 支持哪些模态?

    模态 是否支持 说明
    文本输入 支持 官方示例与模型卡描述文本生成、长上下文提示、代码与自然语言指令(截至2026年7月)
    文本输出 支持 Hugging Face与腾讯材料均将Hy3 Preview定位为文本生成模型(截至2026年7月)
    图像输入 未确认 截至2026年7月,未有官方Hy3 Preview图像输入支持
    音频输入 未确认 截至2026年7月,未有官方Hy3 Preview音频输入支持
    视频输入 未确认 截至2026年7月,未有官方Hy3 Preview视频输入支持
    向量嵌入 未确认 截至2026年7月,Hy3 Preview未标注为嵌入模型
    工具输出 概念上部分支持 腾讯描述智能体框架与工具链编排场景,具体API方案生产前需验证

    Hy3 Preview 有哪些局限?

    Hy3 Preview 最大的限制在于截至2026年7月,部分运行细节尚未在官方公开资料中完全披露。知识截止时间、模型专属速率限制、批量API支持、结构化输出模式及具体服务级别条款,均建议生产部署前核查。

    自托管部署对基础设施要求较高。腾讯将Hy3 Preview标注为2950亿参数MoE模型,激活参数210亿,BF16精度,并提供高端推理框架部署指导。即使具备MoE效率,本地部署仍需专用GPU、推理优化、监控与运维能力。

    需要注意,这属于通用AI模型特性,非Hy3 Preview特有:推理模型可能生成看似合理但实际错误的内容。Hy3 Preview响应在法律、医疗、金融、网络安全、安全关键或高风险场景下使用前,务必核查权威来源。

    高推理深度流程可能带来更高延迟和更长输出。团队应在客户智能体或自动决策流程部署前,明确提示策略、输出上限、检索约束、日志规则及人工审核阈值。

    Hy3 Preview 最适合哪些场景?

    应用场景 适用原因 重要限制说明
    多步智能体流程 腾讯定位Hy3 Preview于推理、编程与智能体任务,并报告已在腾讯产品中落地(截至2026年7月) 智能体行为需结合真实工具、权限与回滚机制充分测试
    长文档分析 256K Token上下文长度可支持长提示与文档集(截至2026年7月) 长上下文不保证检索、引用或指令完全准确
    编程助手 腾讯强调代码与智能体能力提升,并提供部署示例(截至2026年7月) 生成代码需测试、安全审查与开发者监督
    复杂规划 Hy3 Preview定位于复杂推理与多步执行(截至2026年7月) 更高推理深度可能带来更高延迟和成本
    企业开源权重实验 腾讯声明模型已在GitHub、Hugging Face、ModelScope、GitCode开源(截至2026年7月) 需评估许可条款、部署成本与治理要求
    成本敏感API路由 Gate.AI定价为输入、缓存读取、输出Token单价低(截至2026年7月) 总成本取决于提示规模、输出长度、重试、缓存命中率及路由策略

    Hy3 Preview 与 DeepSeek-R1、Kimi K2 对比

    对比维度 Hy3 Preview DeepSeek-R1 Kimi K2 场景适配说明
    核心定位 腾讯MoE推理与智能体模型,2950亿总参数,210亿激活参数(截至2026年7月) 注重推理的模型系列,常用于复杂问题解决 偏向智能体与编程场景,常用于工具流程 适合优先考虑腾讯开源MoE设计与长上下文推理需求的团队
    上下文窗口 256K Token,腾讯官方材料验证(截至2026年7月) 需按实际路由核查上下文窗口 需按实际路由核查上下文窗口 需大上下文窗口时,Hy3 Preview具有优势
    接入方式 Gate.AI目录、腾讯云TokenHub、OpenRouter、开源权重库(截至2026年7月) 不同提供方、网关、路由接入方式各异 不同提供方、网关、路由接入方式各异 生产切换前建议按路由实际表现评估
    智能体能力 腾讯报告产品集成与复杂智能体流程支持(截至2026年7月) 常用于推理链与问题求解 常用于编程与智能体任务 建议基于私有任务基准测试选择,而非泛泛“优劣”判断
    成本评估 Gate.AI定价:输入0.18、缓存读取0.06、输出0.60美元/百万Token(截至2026年7月) 价格随路由与提供方不同 价格随路由与提供方不同 应综合评估总流程成本,包括重试、缓存命中、输出长度与延迟

    如何通过 Gate.AI 访问 Hy3 Preview?

    Gate.AI已在模型目录上线Hy3 Preview,并通过https://api.gate.ai/openai/v1提供OpenAI兼容API。官方文档说明平台完全兼容OpenAI API,支持Python、Node.js、curl及主流开发工具,采用Gate.AI API密钥配合OpenAI格式请求。

    Gate.AI标注的模型ID为:

    1. tencent/hy3-preview

    Gate.AI文档确认通用对话API基础URL、Bearer Token认证、OpenAI兼容格式、按量计费及POST /chat/completions端点。

    Python 示例

    1. from openai import OpenAI
    2. import os
    3. client = OpenAI(
    4. api_key=os.environ["GATEAI_API_KEY"],
    5. base_url="https://api.gate.ai/openai/v1",
    6. )
    7. completion = client.chat.completions.create(
    8. model="tencent/hy3-preview",
    9. messages=[
    10. {
    11. "role": "system",
    12. "content": "You are a concise technical assistant."
    13. },
    14. {
    15. "role": "user",
    16. "content": "Summarize when a high-reasoning model is useful for an agent workflow."
    17. }
    18. ],
    19. )
    20. print(completion.choices[0].message.content)

    curl 示例

    1. curl https://api.gate.ai/openai/v1/chat/completions \
    2. -H "Authorization: Bearer $GATEAI_API_KEY" \
    3. -H "Content-Type: application/json" \
    4. -d '{
    5. "model": "tencent/hy3-preview",
    6. "messages": [
    7. {
    8. "role": "system",
    9. "content": "You are a concise technical assistant."
    10. },
    11. {
    12. "role": "user",
    13. "content": "Explain when Hy3 Preview may fit long-context agent workflows."
    14. }
    15. ]
    16. }'

    通过Gate.AI,开发者可统一采用OpenAI兼容请求模式调用支持的模型。生产部署前,建议团队核查账户级模型可用性、路由配置、速率限制、计费与缓存策略,以及Gate.AI控制台的Hy3专属参数。

    常见问题

    Hy3 Preview的上下文窗口是多少?
    Hy3 Preview官方腾讯模型材料标注上下文长度为256K Token(截至2026年7月)。可支持长提示、文档分析与智能体记忆,但应用仍需检索校验、提示预算与输出验证。

    Hy3 Preview在Gate.AI上的价格是多少?
    Gate.AI标注Hy3 Preview输入Token每百万0.18美元,缓存读取每百万0.06美元,输出每百万0.60美元(截至2026年7月)。缓存写入定价未在当前目录中明确。

    开发者如何接入Hy3 Preview?
    开发者可通过Gate.AI,使用模型ID tencent/hy3-preview 及OpenAI兼容API访问。腾讯还通过GitHub、Hugging Face、ModelScope、GitCode提供开源权重,并有vLLM与SGLang部署指导。

    Hy3 Preview适用于哪些场景?
    Hy3 Preview适合长上下文推理、代码辅助、复杂规划、文档分析及多步智能体流程。生产应用前建议结合私有任务充分评估,尤其关注准确性、延迟、成本或安全控制等需求。

    本内容不构成任何要约、招揽、或建议。您在做出任何投资决定之前应始终寻求独立的专业建议。请注意,Gate 可能会限制或禁止来自受限制地区的所有或部分服务。请阅读 用户协议了解更多信息。

    相关文章