摘要
7月24日下午,腾讯宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,由腾讯首席AI科学家姚顺雨统一管理,以提升模型研发和协同效率,探索全模态模型的智能上限。混元已构建图像、视频、语音、3D生成等完整模型矩阵。2026年以来模型迭代速度加快,与业务协同增强。大语言模型Hy3上线后展现显著智能水平,调用量较前代增长超68倍。混元多模态模型持续进化,3D世界模型2.0支持多种输入生成3D世界,图像模型3.0在开源榜单居国内第一。
腾讯混元组织架构调整:合并大语言模型和多模态团队
7月24日下午消息,腾讯宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由腾讯首席AI科学家姚顺雨管理,以进一步提升模型研发和协同效率,探索全模态模型的智能上限。
以大语言模型为基础,腾讯混元构建了图像、视频、语音、3D生成模型等完整的模型矩阵。2026年以来,腾讯混元模型迭代速度不断加快,与腾讯公司业务的协同也持续增强。
据介绍,7月正式上线的大语言模型Hy3,展现出显著强于同尺寸模型且比肩参数规模2-5倍的旗舰模型的智能水平,已在WorkBuddy/CodeBuddy、元宝、Marvis、ima等多个业务接入,API已在腾讯云TokenHub以及多个海外平台上线。发布一周后,Hy3总调用量较上一代模型(Hy2)增长超68倍,WorkBuddy自选模型的用户中,选择Hy3的占比达到60%。
混元多模态模型也在持续进化。4月发布并开源的混元3D世界模型2.0(Hy World 2.0)能够根据文字、图片、视频等不同类型输入,自动生成、重建和模拟3D世界,同时支持多格式3D资产导出,能与现有的游戏工作流无缝对接,快速生成游戏地图和关卡原型。混元3D系列模型的社区下载量超过300万。混元图像模型3.0在LMArena榜单上居国内开源模型第一。