新闻中心
魔搭社区上线AI视频生成工具Live Portait,可一键让照片开口说话
魔搭社区推出了一款名为live portrait的ai视频生成工具,能够通过一键操作使照片中的人物开口说话
阿里云推出了一项名为Live Portrait的数字人视频生成工具,用户只需上传一张照片和一段文本或语音,即可生成一段开口说话的数字人视频。这项工具可应用于视频|直播|、聊天机器人、企业营销等多个场景。目前,该工具已在魔搭社区创空间开放体验
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

随着自对话大模型和AI绘画模型的风靡,研究界正逐渐将生成式AI的研究推向更多模态的方向,其中AI视频生成技术备受关注。该技术能够将文本或音频等信息转化为面部运动信息,从而生成具有人物形象的动画照片,有效降低了视频拍摄和制作的门槛
阿里云最新上线的Live Portait工具,结合了
运动模块和生成模块。该工具采用了阿里云自研的口型预测算法,大幅提高了口型生成的准确度,相较于传统方法有显著提升。在训练阶段,增加了姿态的显式控制,使得生成的视频可以呈现任意动作,无需底板视频,从而大幅提升了数字人说话的真实感。此外,通过眼神主动控制技术,Live Portait可以为眼球增加自然运动,使得生成结果更加接近真人效果。据介绍,Live Portait相关技术已被国际AI顶会CVPR、ICCV等收录

Tome
先进的AI智能PPT制作工具
143
查看详情
根据魔搭社区的信息,Live Portait提供了两种方式供用户选择上传照片后,即文本驱动和音频驱动。在文本驱动模式下,用户可以选择28种不同的声音,包括普通话、英语、粤语和童声等。此外,Live Portait还提供了轻量模型选择,以帮助用户更快地生成视频
张邦,该工具算法负责人,表示:“Live Portait整合了团队多项自主研发的创新技术,包括利用单张图片即可生成逼真的面部动画,突破了传统对抗生成网络的限制。随着技术的不断演进,图像生成视频具有广阔的应用前景,有望成为企业提高生产效率、降低成本的重要工具。”
据了解,该团队的研究方向包括数字人、3D模型AI生成、高逼真渲染和自然人机交互等领域,已经在国际顶级会议上发表了50多篇论文
以上就是魔搭社区上线AI视频生成工具Live Portait,可一键让照片开口说话的详细内容,更多请关注其它相关文章!
# 广州市移动网站建设方案
# 外贸网站谷歌优化价格
# 融水网络推广营销
# php网站优惠seo
# 清远网站建设做网站公司
# 安阳网络营销推广获客
# 迪庆如何优化网站设计图
# 广东百度推广网站平台
# 林州网站建设教程
# 网站建设报价模板范文
# 一键
# 中文网
# 相关文章
# 据了解
# 只需
# 已被
# 两种
# 多个
# 粤语
# 推出了
相关栏目:
【
行业资讯67740 】
【
技术百科0 】
【
网络运营39195 】
相关推荐:
typescript是做什么用的
爱奇艺会员qq登录可以几个人用?
启辰星power标志是什么意思
苹果16有哪些不同
ao3镜像网站永久地址入口
电动车power灯亮是什么意思
如何测固态硬盘芯片
五十铃x-power是什么意思
夸克*免费吗
ai如何重复使用上一命令
为什么夸克网盘下载不了
bored是什么意思
360手机壁纸怎么改
12306放票时间规律(2025)
如何修改cad命令
命令指示符如何打开盘符
typescript中如何定义json
python如何命令行换行
如何在命令行执行一个jar
没网环境如何安装typescript
typescript学会要多久
如何自己加装固态硬盘
debian和ubuntu命令一样吗
win7怎么做幻灯片
春运抢票需要抢几天
j*a怎么把数组输出
如何使用命令行界面
反向春运抢票方式
单片机怎么储存和显示
苹果16都有哪些型号
ai文件里无法找到链接文件要怎么解决步骤
如何提高import命令的性能
如何看固态硬盘型号
一年多少周
51单片机贴片怎么*
cmd如何定时执行命令
5r是多少钱
如何进入 dos 命令行
联想手机如何输入命令行
mac 如何启动命令行模式
夸克是什么空间单位
爱奇艺中下载的视频怎么在PPT中播放操作方法
苹果16系统有哪些缺陷
mac如何使用vi命令
vs如何输入命令行参数
如果公司ttm市盈率为负数是什么意思
华为的type-c接口是什么接口
电瓶车充电器power是什么意思
夸克用的什么服务器
每日推荐电声音乐软件有哪些


2023-08-19
浏览次数:次
返回列表