AI · 开源大模型 · Tencent Hunyuan

腾讯混元 Hy4 preview 技术文档

整理日期:2026-08-30 | 性质:腾讯新一代开放权重大语言模型(纯文本)
官方来源:hunyuan.tencent.com | 发布时间 2026-08-28
目录: 1. 概述 2. 参数对比 3. 架构设计 4. 能力评测 5. 生产力场景 6. 递归自我改进 7. 获取方式 8. 战略背景 9. 风险边界 10. 参考链接

1. 概述

2026-08-28,腾讯混元发布并开源新一代大语言模型 Hy4 preview:770B 总参数 / 49B 激活(MoE)、100 万 token 上下文、Apache 2.0 权重。

一句话定位:「为生产力而生」的开源第一梯队模型——在代码、办公、游戏、科研四类真实工程任务上较上代 Hy3 大幅跃升,并与腾讯系生产力产品(WorkBuddy / CodeBuddy / 元宝 / ima)深度协同(Co-Design)。

770B
总参数(MoE)
49B
激活参数
1M
上下文 token
Apache 2.0
开放权重许可证

Hy4 是腾讯 2 月重建训练基础设施以来的第三个大版本(平均每两月一迭代)。

2. 核心参数(Hy3 → Hy4 对比)

Hy3Hy4 preview变化
总参数295B770B≈2.6×
激活参数21B49B≈2.3×
上下文窗口256K1M(1,048,576)≈4×
最大输出64,000 token
架构稠密MoE(256 专家,每次激活 8+1)路线切换
许可证开放权重Apache 2.0 开放权重
模型体积598 GB1.56 TB

3. 架构与关键设计

4. 能力评测

4.1 12 项公开基准全面超越 Hy3

腾讯公布的 12 项基准中,Hy4 preview 没有一项垫底。关键数字:

基准Hy3Hy4 preview备注
Terminal-Bench 2.1(终端命令行编码)70.885.4超 DeepSeek V4 Pro,持平 Claude Opus 5 第一梯队
DeepSWE(真实软件工程长任务)28.064.3本次提升最猛
Toolathlon-Verified(工具调用马拉松)74.1领先 Qwen 3.8 Max、GPT-5.6 Sol,逼近 Kimi K3 / Claude Opus 5
APEX-Agents(pass@1 智能体首试成功率)37.1几乎追平 Kimi K3(37.2)

4.2 内部盲测

4.3 参数效率

770B 总 / 49B 激活,远低于同档竞品的总参。MoE 路由使推理实际算力远低于总参暗示值——自部署团队可用更少 GPU 跑出近第一梯队能力(OrcaRouter 对比文特别点名:Terminal-Bench 已超 DeepSeek V4 Pro,而后者激活参数量大得多)。

5. 四大生产力场景

6. 递归自我改进(关键看点)

Hy4 preview 首次参与自身研发全流程:自动优化训练方法、数据策略、评估体系、底层算子。模型提方案 → 跑实验 → 读结果 → 代码与日志喂回下一轮,形成递归自我改进闭环

这是大模型「自主优化自身基础设施」的早期实证,也是混元区别于多数开源模型的关键叙事点。

7. 获取方式

定价(API,美元 / 百万 token)

类型价格
输入$0.834
输出$2.501
缓存命中$0.042

延续混元「普惠、高性价比」策略。

8. 战略背景

9. 风险与边界(如实标注)

10. 参考链接

11. 一句话总结

Hy4 preview 是腾讯「为生产力而生」的开源大模型:770B MoE + 1M 上下文 + 递归自我改进,在代码/办公/游戏/科研上较 Hy3 大幅跃升,并通过与 WorkBuddy 等产品的 Co-Design 把模型能力直接变成可用的生产力工具。它是混元冲击 2027 国内第一梯队的主力砝码。