Hy4 preview是一款由腾讯混元于2026年8月推出的新一代旗舰大语言模型,主要用于代码编写、办公文档处理、游戏开发与科研计算等真实生产力场景,采用稀疏化 MoE 架构与超长上下文设计,适用于需要长上下文理解、复杂推理与高吞吐的企业级应用与科研任务。
| 基础信息 | 内容 |
|---|---|
| 开发团队 | 腾讯混元(腾讯 AI Lab) |
| 发布时间 | 2026年8月28日(preview 预览版上线) |
| 产品定位 | 新一代旗舰大语言模型(稀疏化 MoE 架构,原生百万 token 上下文) |
| 参数规模 | 770B 总参数 / 49B 激活参数 |
| 上下文长度 | 100万 token(1M) |
| 推理性能 | 端到端推理吞吐较上一代提升 31.8% |
| 开源情况 | 已开源(权重开放,HuggingFace / Github / Modelscope / Gitcode 可获取) |
| 调用入口 | WorkBuddy / CodeBuddy / 元宝 / ima、aistudio.tencent.com、TokenHub、OpenRouter、HuggingFace |

Hy4 preview的核心能力
Hy4 preview 把旗舰推理、超长上下文与科研计算收拢到同一模型,是腾讯混元在 腾讯混元大模型 下的旗舰级迭代。
稀疏化MoE架构与百万上下文
Hy4 preview 采用 OpenRouter 上可调用的 770B/49B 稀疏化 MoE 架构,仅激活约 6.4% 参数即可完成单次推理,显著降低算力开销。原生 100 万 token 上下文可容纳整本技术文档或大型代码仓库,减少分块摘要的信息损失。
真实生产力任务表现
在代码、办公、游戏与科研四类生产力任务中,Hy4 preview 均有明显增益,官方实测端到端推理吞吐提升 31.8%,相同硬件下可支撑更高并发与更低延迟。
科研突破与基础推演
科研侧进展更受关注:Hy4 preview 把分子动力学模拟效率提升至 2 倍,与 Hyra 协同将三维 Blaschke-Lebesgue 体积下界推进到 0.41104,展现参与基础数理推演的潜力。
Hy4 preview与主流旗舰大模型的对比
把 Hy4 preview 与同档位开源轻量旗舰、闭源专业旗舰放在一张表里对比,三者上下文窗口均达 100 万 token,参数规模、开源策略与定价逻辑差异明显。
| 对比维度 | Hy4 preview | DeepSeek-V4-Flash | Claude Opus 4.6 |
|---|---|---|---|
| 参数规模(总/激活) | 770B / 49B | 284B / 13B | 未公开 |
| 上下文长度 | 100万 token | 100万 token | 100万 token |
| 开源情况 | 已开源(权重开放) | 已开源(MIT) | 闭源商业模型 |
| 输入价格 | ¥6 / 百万 tokens | $0.14(约¥1.0) | $5.00(约¥35.5) |
| 输出价格 | ¥18 / 百万 tokens | $0.28(约¥2.0) | $25.00(约¥177.5) |
| 核心定位 | 旗舰通用 + 科研计算 | 高性价比轻量 | 旗舰专业任务 |
注:以上参数与定价分别取自 Hy4 preview 官方公告、DeepSeek API 与 Anthropic 官方定价页。三款模型均支持 100 万 token 上下文,差异集中在架构路线(稀疏化 MoE 770B/49B vs 稠密)与开源策略(开源 vs 闭源),价格区间因此拉开;成本敏感的高并发场景更宜轻量开源路线,复杂专业任务仍以闭源旗舰为主。
从官方数据可以看出,三款百万上下文模型走出了三条路线:Hy4 preview 以 770B/49B 稀疏架构在旗舰通用与科研场景发力,按官方人民币定价兼顾质量与成本;DeepSeek-V4-Flash 用轻量配置把单价压到最低,主打性价比与高并发 Agent;Claude Opus 4.6 维持旗舰溢价并在 1M 上下文检索领先。成本敏感场景轻量开源更划算,复杂专业任务闭源旗舰仍不可替代。更多横向评测见 DeepSeek-V4。
Hy4 preview的应用场景与适用人群
Hy4 preview 把长上下文、复杂推理与高吞吐收拢到同一模型,以下场景最能发挥价值:
- 长文档与代码库分析:一次性载入整本技术手册或大型仓库,做跨文件依赖梳理与重构建议。
- 科研计算与推演:分子动力学、几何与物理建模等需要长程推理的任务。
- 高并发 Agent:多轮工具调用与长链路推理,依赖低延迟与稳定上下文。
适用人群:主要面向三类用户:企业与开发者需百万级上下文与可预期成本;科研机构与高校看重数学与物理推演潜力;注重性价比的团队可在旗舰质量与轻量成本间获得更宽选择。
如何使用Hy4 preview
前提条件:
- 腾讯系产品账号:WorkBuddy / CodeBuddy(国内版及国际版)/ 元宝 / ima 任一账号,即可直接在线体验。
- 在线试玩:使用腾讯账号访问 aistudio.tencent.com,无需配置环境即可与模型交互。
- API 接入:在 OpenRouter 或腾讯云 TokenHub 注册并获取 API Key。
- 自部署:从 HuggingFace / Github / Modelscope / Gitcode 拉取开源权重,需自备 GPU 环境。
操作步骤:
- 选择入口:在 WorkBuddy / CodeBuddy / 元宝 / ima 中切换模型为 Hy4 preview 直接体验,或访问 aistudio.tencent.com 在线试玩,也可通过 OpenRouter / TokenHub 接入 API。
- 配置 API:将请求中的 model 设为 tencent/hy4-preview,使用 OpenAI 兼容格式。
- 设定上下文:按任务设定上下文长度,长文档可直接载入接近 100 万 token 的输入。
- 发起推理:提交提示词观察吞吐表现,高并发场景可并行多路请求。
当前定价与限制:Hy4 preview 走官方普惠路线,人民币计价——输入 6 元 / 输出 18 元每百万 tokens、缓存命中 0.3 元;OpenRouter 等渠道约 $0.83 / $2.5 每百万 token(汇率折算,与官方一致)。WorkBuddy / CodeBuddy 当前 2 周限时免费。作为 preview,能力持续迭代,生产环境建议先小流量验证。权重与开源见 GitHub 仓库。
Hy4 preview的开源情况与使用局限
Hy4 preview 已开源,权重对外开放:开发者可在 HuggingFace / Github / Modelscope / Gitcode 获取并自部署,或通过 aistudio.tencent.com 免环境试玩;普通用户也能在 WorkBuddy、CodeBuddy、元宝、ima 等腾讯系产品直接体验。
作为 preview,能力持续迭代,生产环境建议先小流量验证;百万 token 上下文对自部署显存算力要求较高,2 周限时免费为阶段性活动,后续定价可能调整;在线体验目前集中在腾讯系产品。
Hy4 preview常见问题
Hy4 preview 是开源模型吗?
是。Hy4 preview 是腾讯混元推出的开源模型,权重已开放,可在 HuggingFace、Github、Modelscope、Gitcode 获取,也可通过 OpenRouter 等平台以 API 方式调用。
Hy4 preview 的上下文长度是多少?
原生支持 100 万 token(1M)上下文,可一次性载入大型代码仓库或整本技术文档,减少分块与摘要带来的信息损失。
Hy4 preview 相比上一代提升多少?
官方实测显示,端到端推理吞吐较上一代提升 31.8%,在相同硬件下可支撑更高并发与更低单次延迟。
Hy4 preview 适合哪些场景?
适合长文档与代码库分析、科研计算与推演、高并发 Agent 以及企业知识处理等需要长上下文与复杂推理的任务。
Hy4 preview 怎么调用?
可通过 WorkBuddy / CodeBuddy / 元宝 / ima 等腾讯系产品在线体验,或访问 aistudio.tencent.com 试玩;开发者也可通过 OpenRouter、TokenHub 或 HuggingFace 获取入口,API 兼容 OpenAI 格式,将 model 设为 tencent/hy4-preview 即可发起推理。
浙公网安备33010202004812号