腾讯混元发布并开源语音数字人模型

钛媒体App 5月28日消息,腾讯混元发布并开源语音数字人模型HunyuanVideo-Avatar,支持头肩、半身与全身景别,以及多风格、多物种与双人场景,面向视频创作者提供高一致性、高动态性的视频生成能力。据介绍,用户可上传人物图像与音频,HunyuanVideo-Avatar模型会自动理解图片与音频,比如人物所在环境、音频所蕴含的情感等,让图中人物自然地说话或唱歌,生成包含自然表情、唇形同步及全身动作的视频。

展开阅读全文

更新时间:2025-06-02

标签:科技   腾讯   语音   模型   数字   音频   人物   视频   全身   创作者   物种   双人   半身

1 2 3 4 5

上滑加载更多 ↓
推荐阅读:
友情链接:
更多:

本站资料均由网友自行发布提供,仅用于学习交流。如有版权问题,请与我联系,QQ:4156828  

© CopyRight 2020- All Rights Reserved. Powered By 61893.com 闽ICP备11008920号
闽公网安备35020302035593号

Top