深圳商报·读创客户端首席记者 袁静娴
7月23日,腾讯官宣一项架构调整:混元多模态模型部门与大语言模型部门正式合并,组建基础模型部。该部门由腾讯首席AI科学家姚顺雨统管,旨在优化研发协同效率,全力探索全模态模型的智能极限。
以大语言模型为底座,腾讯混元已搭建起涵盖图像、视频、语音及3D生成的完整矩阵。进入2026年,混元模型的迭代步伐明显提速,与腾讯内部业务的融合度也日益加深。
今年7月上线的大语言模型Hy3,智能水平显著超越同尺寸竞品,甚至能与参数规模大2至5倍的旗舰模型相媲美。目前,Hy3已接入WorkBuddy、CodeBuddy、元宝、Marvis、ima等多个业务场景,其API亦在腾讯云TokenHub及多个海外平台开放。发布仅一周,Hy3总调用量较上一代Hy2暴涨超68倍;在WorkBuddy自选模型的用户中,选择Hy3的比例高达60%。
混元多模态能力也在持续进阶。4月发布并开源的混元3D世界模型2.0(Hy World 2.0),可依据文字、图片或视频输入,自动完成3D世界的生成、重建与模拟。它支持多格式3D资产导出,能无缝对接现有游戏工作流,快速产出地图与关卡原型。截至目前,混元3D系列社区下载量突破300万次,稳居全球最热门3D开源模型之列。此外,混元图像模型3.0在LMArena榜单上位列国内开源模型第一。







