科学家开发DIRFA:输入图片和音频,可生成说话视频
智能科技 2023-11-17 user639632
11 月 17 日消息,来自新加坡南洋理工大学(NTU Singapore)的科研团队近日开发出了 DIRFA 工具,用户给一张图片以及音频内容,可以自动生成 3D 视频,并实现口型和声音的同步协调。

DIRFA 的全称为 DIverse yet Realistic Facial Animations,训练了超过 6000 多人的 100 万个视频片段,音频片段来自一个名为 VoxCeleb2 数据集的开源数据库,并关联面部表情和头部运动。
研究人员表示,DIRFA 可能会在包括医疗保健在内的各个行业和领域带来新的应用,因为它可以实现更复杂和逼真的虚拟助手和聊天机器人,从而改善用户体验。
DIRFA 还可以作为言语或面部残疾人士的强大工具,帮助他们通过富有表现力的头像或数字表示来传达他们的想法和情感,从而增强他们的沟通能力。
【来源:IT之家】
The End
相关阅读
- 快递100一月月报:荣获深圳(湾区)知名品牌等八项重磅大奖
- 充电桩主动找车!小米汽车产业链公司进军充电机器人
- 苹果为AirPods Pro 2推出了新的测试版固件6E188
- 华硕灵耀魔方无界WiFi7户外路由器,重新定义庭院别墅的网络体验
- 新石器无人车入围《2025年度中国估值TOP 100独角兽》榜单
- 消息称代码托管平台GitLab正考虑出售,目前市值约80亿美元
- 张靓颖助阵 岚图知音即将在2024岚图用户之夜震撼上市
- 新华三入选Gartner《中国AI算力管理平台创新洞察》代表厂商
- 小米申请Ultra系列商标,涵盖运输工具、健身器材等领域
- 小米SU7纽北圈速7分10秒?顺为资本投资合伙人胡峥楠:所有信息都不是真的