科学家开发DIRFA:输入图片和音频,可生成说话视频
智能科技 2023-11-17 user639632
11 月 17 日消息,来自新加坡南洋理工大学(NTU Singapore)的科研团队近日开发出了 DIRFA 工具,用户给一张图片以及音频内容,可以自动生成 3D 视频,并实现口型和声音的同步协调。

DIRFA 的全称为 DIverse yet Realistic Facial Animations,训练了超过 6000 多人的 100 万个视频片段,音频片段来自一个名为 VoxCeleb2 数据集的开源数据库,并关联面部表情和头部运动。
研究人员表示,DIRFA 可能会在包括医疗保健在内的各个行业和领域带来新的应用,因为它可以实现更复杂和逼真的虚拟助手和聊天机器人,从而改善用户体验。
DIRFA 还可以作为言语或面部残疾人士的强大工具,帮助他们通过富有表现力的头像或数字表示来传达他们的想法和情感,从而增强他们的沟通能力。
【来源:IT之家】
The End
相关阅读
- 波音暂停打造自家"星链"计划,原本计划部署147颗卫星
- 快手“AI创想剧场”成果丰硕,AIGC影像创作营在中国传媒大学圆满举办
- 力挺美国人工智能法案,OpenAI“未雨绸缪”?
- 大疆发布入门级航拍新品Lito系列,Lito 1主打轻便智能与4K/8K影像
- 澳大利亚旅游局出席携程集团全球合作伙伴峰会,共谋可持续发展韧性竞争力
- 飞猪双11将于10月24日晚8点正式启动
- 与车企合作:央视频发布车载版,将为众多国产汽车品牌提供服务
- 消息称滴滴将于2024年在香港上市,开始回购员工股票
- 曼秀雷敦男士素颜霜小黑砖74.6元
- 持续推动中巴技术合作,快手获中国-金砖国家人工智能发展与合作中心驻巴西成果转化中心授牌