2026-08-28,腾讯混元发布并开源新一代大语言模型 Hy4 preview:770B 总参数 / 49B 激活(MoE)、100 万 token 上下文、Apache 2.0 权重。
一句话定位:「为生产力而生」的开源第一梯队模型——在代码、办公、游戏、科研四类真实工程任务上较上代 Hy3 大幅跃升,并与腾讯系生产力产品(WorkBuddy / CodeBuddy / 元宝 / ima)深度协同(Co-Design)。
Hy4 是腾讯 2 月重建训练基础设施以来的第三个大版本(平均每两月一迭代)。
| 项 | Hy3 | Hy4 preview | 变化 |
|---|---|---|---|
| 总参数 | 295B | 770B | ≈2.6× |
| 激活参数 | 21B | 49B | ≈2.3× |
| 上下文窗口 | 256K | 1M(1,048,576) | ≈4× |
| 最大输出 | — | 64,000 token | — |
| 架构 | 稠密 | MoE(256 专家,每次激活 8+1) | 路线切换 |
| 许可证 | 开放权重 | Apache 2.0 开放权重 | — |
| 模型体积 | 598 GB | 1.56 TB | — |
chat_template.jinja):
high(默认)—— 启用推理no_think —— 关闭推理reasoning_effort 严格校验,传 None 或范围外值会直接抛异常,不可设其他档位。腾讯公布的 12 项基准中,Hy4 preview 没有一项垫底。关键数字:
| 基准 | Hy3 | Hy4 preview | 备注 |
|---|---|---|---|
| Terminal-Bench 2.1(终端命令行编码) | 70.8 | 85.4 | 超 DeepSeek V4 Pro,持平 Claude Opus 5 第一梯队 |
| DeepSWE(真实软件工程长任务) | 28.0 | 64.3 | 本次提升最猛 |
| Toolathlon-Verified(工具调用马拉松) | — | 74.1 | 领先 Qwen 3.8 Max、GPT-5.6 Sol,逼近 Kimi K3 / Claude Opus 5 |
| APEX-Agents(pass@1 智能体首试成功率) | — | 37.1 | 几乎追平 Kimi K3(37.2) |
770B 总 / 49B 激活,远低于同档竞品的总参。MoE 路由使推理实际算力远低于总参暗示值——自部署团队可用更少 GPU 跑出近第一梯队能力(OrcaRouter 对比文特别点名:Terminal-Bench 已超 DeepSeek V4 Pro,而后者激活参数量大得多)。
Hy4 preview 首次参与自身研发全流程:自动优化训练方法、数据策略、评估体系、底层算子。模型提方案 → 跑实验 → 读结果 → 代码与日志喂回下一轮,形成递归自我改进闭环。
这是大模型「自主优化自身基础设施」的早期实证,也是混元区别于多数开源模型的关键叙事点。
| 类型 | 价格 |
|---|---|
| 输入 | $0.834 |
| 输出 | $2.501 |
| 缓存命中 | $0.042 |
延续混元「普惠、高性价比」策略。
high / no_think 两档,不可细调推理强度。Hy4 preview 是腾讯「为生产力而生」的开源大模型:770B MoE + 1M 上下文 + 递归自我改进,在代码/办公/游戏/科研上较 Hy3 大幅跃升,并通过与 WorkBuddy 等产品的 Co-Design 把模型能力直接变成可用的生产力工具。它是混元冲击 2027 国内第一梯队的主力砝码。