<汇港通讯> 腾讯混元发布并开源的语音数字人模型HunyuanVideo-Avatar,由腾讯混元视频大模型及腾讯音乐天琴实验室MuseV技术联合研发,支持头肩、半身与全身景别,以及多动态风格、多物种与双人视频场景,面向高视讯创作者的高视讯性场景。
使用者可上传人物影像与音频,HunyuanVideo-Avatar模型会自动理解图片与音频,例如人物所在环境、音频所蕴含的情感等,让图中人物自然地说话或唱歌,生成包含自然表情、唇形同步及全身动作的视频。
#腾讯 #人工智能 (CW)
新闻来源 (不包括新闻图片): 汇港资讯