腾讯混元Hy4开源旗舰770B参数,1M上下文盲测力压GLM与Kimi

首页 / AI资讯 / 大模型

国产开源大模型的军备竞赛再次提速。8月28日,腾讯混元发布并开源新一代大语言模型Hy4 preview,总参数高达770B、激活参数仅49B,上下文长度突破100万Token,成为国产开源阵营中参数规模最大的旗舰模型之一。在腾讯内部组织的163名专家、203个工程任务的盲测中,Hy4 preview均分2.99/4,略优于GLM-5.3的2.92与Kimi K3的2.94,直接用成绩宣告了国产开源旗舰已经进入贴身肉搏阶段。

770B总参49B激活,效率与能力兼得

Hy4 preview最值得关注的设计是悬殊的稀疏激活比例。770B的总参数量意味着模型拥有庞大的知识容量,而每次推理仅激活49B参数,则保证了实际运行时的计算效率。这种MoE架构的极致运用,让模型在保持旗舰级能力的同时,推理成本被控制在可接受的范围内。腾讯官方披露,Hy4 preview在多个内部基准测试中展现出与闭源顶级模型接近的能力水平,尤其在长文档理解、复杂推理与代码生成等场景表现突出。

上下文长度的突破是另一个看点。100万Token的上下文窗口,意味着模型可以一次性处理约150万字的中文内容,整本长篇小说、全套技术文档、完整的代码仓库都能被模型完整读取和理解。这一能力直接瞄准企业级应用场景,法律文书审查、金融研报分析、科研文献综述等超长文本任务,过去需要分块处理并忍受信息割裂,如今可以交给模型一次性消化。混元团队表示,长上下文能力的背后是注意力机制与显存管理的多项创新,为后续更大规模的上下文扩展打下了基础。

更值得玩味的是模型开始参与自身优化的趋势。腾讯方面透露,Hy4 preview首次参与了自身训练方法与推理算子的自动优化,端到端吞吐较基线提升31.8%。这意味着模型不仅能回答问题,还能反过来改进自己的训练和推理流程,这种递归式自我改进虽然只是雏形,却预示着下一代大模型竞争将从拼人力转向拼模型自治,谁能率先建立自我优化的循环,谁就能在后续迭代中形成速度优势。

内部盲测胜出,国产开源旗舰贴身肉搏

Hy4 preview的发布,最直接的信号是国产开源大模型的能力天花板被再次抬高。腾讯内部组织的盲测覆盖163名专家、203个工程任务,横跨代码、数学、写作、知识问答等多个维度,Hy4 preview以均分2.99的成绩略胜GLM-5.3与Kimi K3。虽然2.99与2.92的差距看似微小,但在国产开源旗舰普遍逼近闭源模型的背景下,每一次毫厘之间的领先都意味着工程优化能力的实质性突破。

值得注意的是,这场竞争的节奏正在加快。腾讯混元采用preview先行加场景Co-Design的打法,把开源节奏提到两个月一个大版本,用实际场景的反馈反哺模型迭代。智谱的GLM-5.3-Flash、阿里的Qwen3.8-Flash等国产模型也在同周密集发布,国产开源阵营已经进入谁更懂生产力场景的贴身肉搏阶段。对开发者而言,这意味着选择更加丰富,过去只能依赖海外开源模型的场景,如今国产模型在性能与本地化支持上都有了更扎实的选项。

混元Hy4 preview的发布时机同样意味深长。就在前一天,智谱GLM-5.3完整权重在Hugging Face开源,阿里的Qwen3.8-Flash-Next也已完成开源预览,国产开源模型一周内三连发,形成了明显的集团作战态势。这种密集节奏既是技术积累的集中释放,也是生态卡位的主动出击,开源社区的选择越多,国产模型在全球开发者心中的存在感就越强。

六元十八元定价,WorkBuddy元宝同步首发

Hy4 preview的定价延续了国产大模型的价格攻势。API输入每百万Token 6元、输出18元,与同级别海外旗舰模型相比具备明显的性价比优势。更值得注意的是它的首发渠道,模型已在WorkBuddy和CodeBuddy的国内及国际版、元宝、ima等产品同步上线,腾讯把自家应用矩阵变成了新模型的试验田和展示窗。这种自有生态首发策略,让模型能力能够第一时间触达海量用户,也通过真实使用数据加速模型优化循环。

从产业格局看,腾讯混元的这次发布补齐了国产开源旗舰的重要拼图。此前国产开源阵营中,阿里千问、智谱GLM、月之暗面Kimi各有拥趸,腾讯混元虽然背靠腾讯生态,但在开源社区的声量一度不及前三者。Hy4 preview以770B参数、1M上下文的硬实力回归,配合腾讯在社交、办公、云服务上的场景资源,有望在国产开源竞争中重新划分势力范围。对企业和开发者来说,多一个实力派开源旗舰,就意味着多一份选择余地和议价空间,这场由腾讯点燃的国产开源新战事,值得持续关注。

开源生态再扩容,国产模型全球话语权上升

Hy4 preview的权重发布延续了腾讯混元的开源承诺。模型发布即开源,开发者可以在Hugging Face等社区平台直接下载权重进行本地部署与二次开发,这为希望掌控数据主权、规避云端依赖的企业提供了重要选项。开源带来的生态反馈同样可观,社区开发者围绕模型衍生出的微调版本、行业适配与工具链,反过来又提升了模型的影响力,形成良性循环。腾讯内部多个产品线率先接入Hy4 preview,用真实业务场景的反馈驱动模型迭代,这种产研一体的开源打法,让模型不止停留在技术展示层面,而是直接进入生产力环节。

从全球视角看,Hy4 preview的发布让国产开源模型的存在感进一步增强。过去开源大模型的话语权长期掌握在Meta的Llama、Mistral等海外团队手中,如今千问、GLM、Kimi、混元组成的国产开源矩阵,在参数量级、上下文长度、多模态能力上已经可以与国际顶流正面竞争,且凭借更激进的定价策略在性价比维度形成优势。国际开发者社区对中文友好的国产模型关注度持续上升,Qwen系列全球下载量已突破30亿次,混元的加入让这个阵营更加厚实。

当然,Hy4 preview作为preview版本,其稳定性与生态成熟度仍需时间检验,盲测成绩也只是一个维度的参考。但无论后续迭代如何,腾讯混元此次的发布已经传递出清晰信号,国产大模型的竞争不再局限于闭源API的比拼,开源生态的深度与广度正在成为新的决胜维度,而中国模型厂商在这一维度上的集体发力,才刚刚开始。

素材来源:腾讯混元官方、IT之家、智东西、界面新闻 发布时间:2026-08-29