腾讯发布并开源混元语音数字人模型_资讯

腾讯发布并开源混元语音数字人模型

创始人

2025-05-28 12:42:07

格隆汇5月28日｜腾讯混元发布并开源的语音数字人模型HunyuanVideo-Avatar，由腾讯混元视频大模型及腾讯音乐天琴实验室MuseV技术联合研发，支持头肩、半身与全身景别，以及多风格、多物种与双人场景，面向视频创作者提供高一致性、高动态性的视频生成能力。用户可上传人物图像与音频，HunyuanVideo-Avatar模型会自动理解图片与音频，比如人物所在环境、音频所蕴含的情感等，让图中人物自然地说话或唱歌，生成包含自然表情、唇形同步及全身动作的视频。

上一篇：上海乐高乐园度假区一日票及酒店正式开启销售

下一篇：上海市政府残工委（扩大）会议上午为一批在沪全国自强模范和扶残助残先进颁证

腾讯发布并开源混元语音数字人模型

相关内容

热门资讯