腾讯混元 Hy4 preview发布,稳居开源模型第一梯队
腾讯混元 Hy4 preview 发布并开源,腾讯梯队在真实生产力任务上展现卓越能力
8 月 28 日,混元腾讯混元发布并开源新一代大语言模型 Hy4 preview ,布稳总参数 770B、居开激活参数 49B,源模上下文长度突破 1M,型第在代码、腾讯梯队办公、混元科学等真实生产力任务上展现出卓越能力。布稳
Hy4 preview 在模型尺寸、居开上下文长度、源模数据规模上都进行了显著的型第扩展,预训练和后训练的腾讯梯队共同进步带来了智能水平的又一次巨大提升,稳居开源模型第一梯队。混元

混元持续与 CodeBuddy / WorkBuddy 等产品深度协同,优化生产力场景的真实用户体验。在腾讯内部组织的 163 名内部专家、203 个工程任务的盲测中, Hy4 preview(均分2.99/4)略优于 GLM 5.3(均分2.92/4.00) 和 Kimi K3(均分2.94/4.00)。
Hy4 preview 定位“为生产力而生”的模型,通过与软件工程、游戏、金融、安全等顶尖腾讯专家的高质量数据共建,以及与 WorkBuddy 等产品的深度协同(Co-Design),模型在各类真实生产力任务上取得显著进步。
具体来看,在软件工程场景下,模型增强了长程开发任务的理解、规划、调试与验证能力,进一步提升前端开发的视觉审美和交互质量。
在办公分析场景下,显著提升了复杂办公环境理解和金融分析能力,着重优化数据分析、跨文件协作,完成从信息处理到文档、表格与演示文稿交付的完整流程。
在游戏开发场景中,增强了一句需求直接生成可玩原型能力,并能熟练使用游戏引擎,开发者可以通过多轮交互持续完善复杂游戏项目。
在科学研究场景下,显著提升复杂科研问题的理解、推理与求解能力,模型在 AI 研发、分子动力学模拟、凝聚态物理、基础数学等各类场景中均有长足进步。
值得一提的是,Hy4 preview 在自身研发的全链路过程中发挥了积极价值,首次参与训练方法、数据策略、评估体系和底层算子的自动优化。模型提出方案、运行实验并根据结果继续迭代,实验产生的代码、日志和反馈进入下一轮探索,形成初步的递归自我改进闭环。
Hy4 preview 还通过自主分析推理系统瓶颈,并围绕算子融合、通信优化等方向开展多轮优化,端到端吞吐相较基线提升 31.8%,在不同上下文长度和并发度下均取得稳定收益,初步展现了自主开展推理基础设施优化的能力。
Hy4 preview 已经开源,并在 WorkBuddy/CodeBuddy 国内版及国际版、元宝、ima 等腾讯产品同步首发,用户可直接通过产品体验,还可以通过腾讯云 Tokenhub 和 OpenRouter 接入 API 使用。定价方面,Hy4 preview 继续走普惠的高性价比路线,输入 6元/百万 tokens,输出 18 元/百万 tokens,缓存命中 0.3 元 / 百万 tokens。
为进一步收集用户对模型的反馈以进一步提升模型性能,WorkBuddy/CodeBuddy 将面向用户开展为期2周的限时免费活动。
自 2 月重建基础设施以来,混元大模型平均每两个月迭代一次大版本。通过 preview 先行、正式版跟进的方式,混元把真实世界的反馈持续引入研发过程,让模型在解决实际问题中进步。按照这一节奏,Hy4 的下一版模型也将在近期陆续上线。雷峰网(公众号:雷峰网) 雷峰网
- ·35岁女重疾险多少钱?35岁女重疾险要花多少钱?
- ·蔚来李斌:中国汽车品牌正进入长收敛期,希望蔚来还能活在舞台上
- ·定期寿险买多少年合适?定期寿险买多少保额会有收入限制?
- ·长安汽车赵非谈“成为世界一流”:2035年要奔着500万辆销售目标努力
- ·玻璃从区域看北方地区真的要好过南方地区吗?,行业资讯
- ·郑州工作16年老环保人:起床先刷空气质量(图)
- ·貿易協議即將簽署,但貿易戰還沒完|天下雜誌
- ·英國脫歐協議失敗收場 票數差距史上最大|天下雜誌
- ·2022百万医疗险哪家好,中国人寿的百万医疗保险怎么样?
- ·英國脫歐協議失敗收場 票數差距史上最大|天下雜誌
- ·前瞻:杜兰特首回俄城战雷霆 火箭有望取四连胜
- ·追觅G1 Pro即将登陆硅谷,108℃真沸腾让每一杯都真正滚烫
- ·可不可以只买重疾险?买保险只买重疾险可以吗?
- ·两全保险属于人寿保险吗,两全保险在人身保险中的作用
- ·淋浴房玻璃该怎么确定质量 玻璃淋浴房的验收标准 ,行业资讯
- ·钢化玻璃发生爆开的原因 引起玻璃风化的原因是什么,行业资讯
