GEO资讯

腾讯混元 Hy4 preview 开源

发布于 2026/8/29 39 次阅读
腾讯混元 Hy4 preview 开源

新旗舰瞄准"生产力"

8 月 28 日,腾讯混元发布并开源新一代大语言模型 Hy4 preview。模型总参数 770B、激活参数 49B,上下文长度突破 1M tokens,采用 Apache 2.0 协议开源。相比上代 Hy3(295B/21B、256K 上下文),这一代在模型规模、上下文和数据量上都有明显扩展,腾讯将其定位为"稳居开源模型第一梯队"。

真实生产力场景是重点

与很多偏 benchmark 的发布不同,Hy4 preview 的卖点集中在工程落地。在软件工程场景,它增强了长程开发任务的理解、规划、调试与验证能力,并提升前端开发的视觉审美;在办公分析场景,强化复杂表格与跨文件协作,能完成从数据处理到文档、表格、演示文稿交付的完整流程;在游戏开发中,可用一句话生成可玩原型;科研场景则覆盖分子动力学、凝聚态物理与基础数学等。

在腾讯内部组织的 163 名专家、203 个工程任务的盲测中,Hy4 preview 取得均分 2.99/4.00,略优于 GLM 5.3(2.92)和 Kimi K3(2.94),侧面印证其在真实工程任务上的进步,而非只在公开榜单上好看。

架构与迭代节奏

Hy4 preview 采用 MoE 架构,78 层中包含 77 层 MoE,每层 256 个路由专家加 1 个共享专家,每 token 激活 top-8;上下文从 Hy3 的 256K 跃升到 1M,意味着可一次性投喂更长的中文文档、代码库或财报,对长文档摘要与跨文件推理更直接。从 2 月重建预训练与强化学习基础设施算起,混元平均约两个月迭代一个大版本,迭代节奏明显加快。

自主优化与成本

一个值得注意的细节是,Hy4 preview 首次参与自身研发:它自动优化了训练方法、数据策略、评估体系和底层算子,并对推理系统做过多轮算子融合与通信优化,端到端吞吐较基线提升 31.8%。定价为每百万输入 token 0.834 美元、输出 2.501 美元、缓存命中 0.042 美元,延续了混元一贯的普惠路线,对成本敏感的中小团队较友好。

对企业和开发者意味着什么

模型已在 WorkBuddy/CodeBuddy 国内外版本、元宝、ima 同步首发,开发者可通过腾讯云 TokenHub 和 OpenRouter 调用 API,并享有两周限时免费;同时 Hy3 的免费使用期限也延长至 9 月 30 日。对中小企业而言,开源权重意味着可以把模型私有化部署在自有算力上,把核心业务数据留在内网;对做 AI 应用的产品团队,这是低成本试水的窗口。

河北极欧智推科技有限公司在 GEO 实践中也观察到,模型在长上下文上的提升,意味着单页可承载更完整的实体信息、产品参数与服务区域,减少被切分导致的引用失真;而开源权重则允许在私有环境做定制化微调,把行业术语与品牌表述固化进模型。可机器读取、事实清晰的结构化内容,比堆砌关键词更容易被新一代模型准确抽取和引用。

对于受数据合规约束的行业(金融、医疗、政企),开源权重带来的私有化能力尤为关键:既能用上前沿模型,又不必把敏感语料传出内网,这对 GEO 内容生产的合规边界也是利好。以 1M 上下文为例,长文档一次性入模后,单次问答无需反复切片与拼接,既省 token 也降低引用错位,长期看反而摊薄了单位使用成本。

信息来源