腾讯混元发布并开源语音数字人模型

腾讯混元发布并开源语音数字人模型

K图 00700_0

  在丁冬财经看资讯行情,选丁冬财经证券一站式开户交易>>

  5月28日,腾讯混元发布并开源的语音数字人模型HunyuanVideo-Avatar,由腾讯混元视频大模型(HunyuanVideo)及腾讯音乐天琴实验室MuseV技术联合研发,支持头肩、半身与全身景别,以及多风格、多物种与双人场景,面向视频创作者提供高一致性、高动态性的视频生成能力。用户可上传人物图像与音频,HunyuanVideo-Avatar模型会自动理解图片与音频,比如人物所在环境、音频所蕴含的情感等,让图中人物自然地说话或唱歌,生成包含自然表情、唇形同步及全身动作的视频。

(文章来源:人民财讯)


鲜花

握手

雷人

路过

鸡蛋
上一篇:
地瓜机器人宣布完成1亿美元A轮融资发布时间:1970-01-01
下一篇:
知名进口癫痫药恢复采购资格 此前已被转手发布时间:1970-01-01
相关推荐
热门排行

在线客服(服务时间 9:00~18:00)

在线QQ客服
公司地址:广州市黄埔区康富路32号101房
客服电话:13326565461
电子邮箱:30376048757@qq.com

Powered by 广州丁冬科技有限公司 © 2025 aiwsw.com Inc.( 粤ICP备2024347580号-3 )