Tencent上新
模型 ID:

tencent/hy4-preview

Hy4 Preview 是腾讯混元推出的新一代开源 MoE 旗舰生产力模型,支持 1M 超长上下文,面向智能体、代码开发、办公分析及复杂推理任务优化。

立即接入
发布时间:2026.08.28
工具调用结构化输出深度思考内容缓存
上下文
1000K
最大输出
128K
输入类型
文本
输出类型
文本
价格方案
不同上下文区间和计费项可能采用不同单价,请以请求实际命中的价格规则为准。
条件计费项价格
输入长度 (0, 无限] 且输出长度 (0, 无限]输出0.018 元 / K
缓存输入0.0003 元 / K
非缓存输入0.006 元 / K
API 接入
使用模型 ID 和对应的 Base URL,即可通过兼容接口接入模型。
Model ID
tencent/hy4-preview
用于在推理接口中指定模型
API Key
用于设置推理接口的 Bearer Token(OAuth 2.0 认证令牌)
Completions BaseURL
https://api.qnaigc.com/v1
兼容 Completions 接口(即 /chat/completions),支持 OpenAI SDK、Codex 等
API 文档
详细的接口说明、参数定义和使用示例
模型介绍
关于模型能力、适用场景与使用限制的官方说明。

Hy4 Preview 是腾讯混元推出的新一代开源 MoE(混合专家)旗舰生产力模型,总参数量 770B、激活参数量 49B,支持 1M 超长上下文。模型重点面向智能体协作、复杂代码工程、办公分析、游戏开发及科学研究等长程任务优化,具备任务规划、工具调用、深度推理、跨文件信息整合、代码生成与调试等能力。 该模型默认启用高强度思考模式,适合复杂推理、编程与多步骤任务;在日常对话场景也可关闭思考模式以获得更直接的响应。Hy4 Preview 已开源模型权重,支持通过 vLLM、SGLang 等框架部署,并可使用 OpenAI 兼容接口调用。作为预览版本,官方说明其在复杂任务中仍可能出现思考时间较长、过度自我验证等情况,后续会持续迭代优化。