新闻中心

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

2024-05-08
浏览次数:
返回列表

最快5分钟,打造一个直接上岗工作的3d数字人。

这是大模型给数字人领域带来的最新震撼。

就像这样,一句话描述需求:

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

生成的数字人直接就能进驻|直播|间当主播。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

跳起女团舞也不在话下。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

整个制作过程中,想到什么说什么就行,大模型都能自动拆解需求,瞬间get设计、修改思路。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

△2倍速

再也不怕老板/甲方的想法太新奇。

这样的文生数字人技术,来自百度智能云最新发布。该说不说,是要把数字人的使用门槛一口气砍没的节奏了。

听闻如此神器,我们照例第一时间争取到了内测资格,更多细节,一起先睹为快~

一句话5分钟,3D数字人直接上岗

从Chatbot到文生图片,再到文生视频,大模型带来的交互方式的变革,已经无需赘言。

现在,在百度智能云曦灵平台上,基于文心一言4.0,数字人定制这件事,同样能通过自然语言对话的形式实现。

举个例子,生成一个品牌代言人,需要几步?

首先,输入“生成一个百度智能云品牌代言人”这样的提示词,同时上传logo图片。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

大模型就会自动从脸型、发型、妆容、服装、配饰等多个维度,开始一步一步思考:

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

自动打造出符合要求的数字人。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

△8倍速

如果需要调整细节,一样“说话”就能完成。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

也就5-10分钟,一个360°无死角的高质量数字人就基本成型了。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

捏脸完毕,下一步就是给数字人绑上表情,让Ta能动起来。同样只需要一键操作,等待1-2分钟。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

相比于过去高精度3D数字人好几天、甚至好几个月的定制周期,这个分钟级的效率,确实称得上是“颠覆”了。

值得一提的是,效率如此大幅提升的前提下,这样的文生数字人细节质量依然保持着高水准。

表情细节:

易标AI 易标AI

告别低效手工,迎接AI标书新时代!3分钟智能生成,行业唯一具备查重功能,自动避雷废标项

易标AI 135 查看详情 易标AI

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

动作质量:

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

结合百度智能云在数字人领域的长期积累,上岗播新闻、|直播|带货都不在话下。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

数字人技术全面AI化

效率和落地能力的直观提升之外,此次百度智能云推出的文生数字人方案背后,不少技术细节也值得好好说道说道。

正如前文所说,其技术基座,正是文心一言4.0.

而起到关键作用的大模型能力包括:

  • 自动拆解要做的任务和子任务
  • 显示思考过程,做到有理有据,让整个生成过程“白盒化”
  • 实现了基于内容提炼的短期记忆,可以通过对话持续调整数字人形象

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

这样一来,大模型就成了一个能懂人类甲方心理的数字人造型助理,可以模仿人类思路,去抠数字人定制的每一个细节,并且做到过程可控。

同时,大模型还在背后施展出了调用工具的能力。

比如,调用涵盖6000+维度的脸型及五官细节“知识库”,整体调整数字人面容。

大模型技术之外,百度智能云还在曦灵平台中加入了新的AI渲染技术,支持AI驱动、AI布料模拟,让数字人的表情肢体动作更自然,服装面料质感更真实。包括:

  • 动态褶皱贴图,让纹理更加真实。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

  • 分钟级4D自动绑定,让眼睛、嘴唇等部位能够完美闭合,并支持表情风格切换。
  • 肢体肌肉挤压、碰撞实时模拟。
  • ……

官方还透露,接下来,百度智能云计划实现角色、行为、场景、灯光、镜头要素的全面AI化。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

数字人,步入大模型时代应用新范式

如果说去年大家还在热火朝天地讨论基础模型,那么今年以来由Sora而起,大模型带来的应用范式的变革,已经成为科技圈新的热议焦点。

在交互方式的改变之上,核心受到关注的,其实还是效率提升

输出创意,生成所需,大模型正在让越来越多本来需要消耗大量时间、人力、金钱的工作,变得简单、高效、人人可用。

现在,百度智能云在3D数字人领域的最新技术进展,就是这种可能性在人们更为熟知的图像、视频领域之外,拓展开来的一个代表。

大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住

可以预见的是,过去更多在大企业、大机构中被使用的数字人员工,在新范式的驱动之下,步入“寻常百姓家”正在成为可能。

此前,清华大学《虚拟数字人研究报告2.0版》数据显示,从头部企业的布局来看,面向B端的数字人产品服务是市场的主要组成部分,占比达到79%。

而随着大模型技术对数字人应用模式的颠覆,不仅中小企业不用再对6位数的3D高精度数字人望而却步,C端的应用也将得以拓展。

这也就意味着,数字人的应用和商业化,已经翻开新的一页。

以上就是大模型卷爆数字人:一句话5分钟实现定制,跳舞主持带货都能hold住的详细内容,更多请关注其它相关文章!


# 数字人  # 茂名网站推广单位招聘信息  # 天水网站优化推广公司  # 张家界搜狗问答推广营销  # 倍速  # 人面  # 开源  # 不在话下  # 就能  # 的是  # 还在  # 一言  # 句话  # 都能  # sora  # 文心一言  # 大模型  # 人工智能  # 广州番禺高端网站建设  # 昌乐网站推广方案  # 商务网站建设与发展  # 安顺大数据网站建设程序  # 孟州网站建设报价  # 建设网站视频拍摄  # 宜春房产网站建设招标 


相关栏目: 【 行业资讯67740 】 【 技术百科0 】 【 网络运营39195


相关推荐: 新买的固态硬盘如何查  移动固态硬盘如何使用  怎么更新typescript  单片机log怎么看  HTML5如何引用typescript  linux如何切换到命令行模式  春运抢票哪个平台好一点  ai文件在线打开工具有哪些  mysql的datediff函数怎么用  如何安装tree命令  命令行如何打开文件  春运车站抢票和网上抢票  如何通过命令行聊天  win10电脑如何使用命令提示符  虽千万人吾往矣什么意思  春运抢票多久能知道成功  如何判断固态硬盘  电动车充电器上的power是什么意思  animal是什么意思  单片机串口接收怎么实现  datediff快捷函数怎么用  如何进入 dos 命令行  春运抢票可以抢几次票  typescript为什么现在才火  市盈率市净率是什么意思  ensp命令如何提示  软件命令行参数如何设置  为什么有的夸克带电  51单片机怎么用flash  单片机是怎么计时的  单片机怎么进行排序操作  商誉是什么意思  课程伴侣电脑怎么登录  ai如何重复使用上一命令  安卓手机怎么打开5g  苹果16系统有哪些系列  51单片机怎么连接端口  破太岁是什么意思  市盈率pe是什么意思  喇叭上标的power30w是什么意思  typescript学会要多久  固态硬盘2m如何修复  360n5锁屏壁纸怎么设置  如何学好typescript  什么是泛域名解析  vivo手机爱奇艺怎么投屏到电视操作步骤  typescript是做什么用的  苹果16系统有哪些缺陷  typescript和es6先学哪个  哪个牌子的折叠屏手机好 

搜索