深度协同:燧原科技全面支持腾讯混元Hy4 preview

来源:燧原科技Enflame #燧原科技#
1289

2026年8月28日,腾讯混元发布并开源新一代大语言模型Hy4 preview,模型总参数770B,激活参数49B,上下文长度突破1M,在代码、办公、科学等生产力任务上展现出卓越能力。

Hy4 preview在模型尺寸、上下文长度、数据规模上都进行了显著的扩展,预训练和后训练的共同进步带来了智能水平的又一次巨大提升,稳居开源模型第一梯队。

Hy4 preview模型在设计初期就充分考虑了燧原产品的特性,双方进行了深度“芯模协同”的联合设计,使得混元的新模型结构可以充分发挥燧原产品的优势。与此同时,燧原科技依托自研全栈软硬件架构,持续完善算子覆盖与生态兼容能力,实现了对Hy4 preview模型能力、推理性能与算力效率的深度协同匹配。

针对Hy4 preview百万级长上下文、MoE专家模型的部署特性,燧原的驭算软件平台结合了算子融合、通信加速、低精度量化、PD分离架构、集群大EP等核心技术,叠加KV Cache优化、编译器、内存管理、推理引擎等全栈调优手段,在保障业务SLO指标前提下,实现百万token长上下文场景下的高吞吐推理能力。该适配方案有效提升推理吞吐量、优化首字响应时延,降低显存占用,显著提升硬件算力利用率,在复杂任务、超长序列高并发的场景下保持服务稳定高效,可广泛支撑多样化大模型业务落地需求。

一个更面向生产力的混元

混元持续与CodeBuddy/WorkBuddy等产品深度协同,优化生产力场景的用户体验。

在腾讯内部组织的163名内部专家、203个工程任务的盲测中,Hy4 preview(均分2.99/4)略优于 GLM 5.3(均分2.92/4.00)和 Kimi K3(均分2.94/4.00)。

Hy4 preview定位“为生产力而生”的模型,通过与软件工程、游戏、金融、安全等顶尖腾讯专家的高质量数据共建,以及与WorkBuddy等产品的Co-Design,模型在各类生产力任务上取得显著进步。

软件工程场景

模型增强了长程开发任务的理解、规划、调试与验证能力,进一步提升前端开发的视觉审美和交互质量。

办公分析场景

显著提升了对复杂办公环境的理解和金融分析能力,着重优化数据分析、跨文件协作,以及从信息处理到文档、表格和演示文稿交付的完整流程。

游戏开发场景

增强了从一句话需求直接生成可玩原型的能力,并能熟练使用游戏引擎,开发者可以通过多轮交互持续完善复杂游戏项目。

科学研究场景

显著提升复杂科研问题的理解、推理与求解能力,在AI研发、分子动力学模拟、凝聚态物理、基础数学等各类场景中均有长足进步。

值得一提的是,Hy4 preview也参与到了自身研发的全链路过程中,首次参与训练方法、数据策略、评估体系和底层算子的自动优化。模型提出方案、运行实验并根据结果继续迭代,实验产生的代码、日志和反馈进入下一轮探索,形成初步的递归自我改进闭环。

Hy4 preview还通过自主分析推理系统瓶颈,围绕算子融合、通信优化等方向开展多轮优化,端到端吞吐相较基线提升31.8%,在不同上下文长度和并发度下均取得稳定收益,初步展现了自主开展推理基础设施优化的能力。

今年2月重建基础设施以来,混元平均每两个月迭代一次大版本。通过preview先行、正式版跟进的方式,混元将真实世界的反馈持续引入研发过程,让模型在解决实际问题中进步。

责编: 爱集微
来源:燧原科技Enflame #燧原科技#
THE END
关闭
加载

PDF 加载中...