元峰AI笔记 · AI数字人

“C位出道”的高光时刻

<title【破局】 不出镜、不拍摄,他竟然用全能AI数字人拿下1000万播放量</title

【破局】 不出镜、不拍摄,他竟然用全能AI数字人拿下1000万播放量

图片为“AI破局俱乐部”标识,背景为黑色,中间以蓝色线条构成类似科技感的图案,两侧各有一个类似电路板的装饰。图案上方有白色文字“AI破局俱乐部”。该图片位于文档开头部分,可能是作为介绍或标题部分,用于引出接下来关于“全能AI数字人”等内容。

大家好,我是元峰,累计36 颗 AI 之心获得者。

因为一次偶然的机会,一次灵光乍现,彻底改变了我的创作轨迹——我成为了**"全能AI数字人"**的先行者。

这一切的开始,始于2024 年 6 月 8 日那条**"致青春:动物高考"**的视频。

就是因为可灵 AI 刚刚上线时,我抓住机会创作了这个作品,结果被可灵 AI 发现,成为官方转发的第 1 条用户视频!这个小小的"第一"让我获得了可灵AI超级创作者的身份

图片展示了可灵AI官方第一条用户视频的相关内容。画面中有一个红色箭头指向视频封面,封面背景为老虎图案,上方有“可灵AI”标识及“青春”字样。下方显示该视频由北京市快手总部发布,发布日期为2024年6月8日,点赞数694、评论数212、收藏数884、分享数26。该图片与上下文紧密相关,上下文提到作者获得了可灵AI超级创作者身份,获得内测功能,此图可能是在展示其创作成果或相关视频内容。

有了超创的加持,也因此获得了许多普通用户无法触及的内测功能。比如可灵AI的人脸模型功能——当大多数人还在苦苦等待时,我已经玩了整整两个月。

玩这么久AI了,我越发认可一句话:技术从来不是赚钱的核心,场景才是。

说白了,技术不是赚钱的核心,能解决什么痛点才是关键。

我开始思考,别人来咨询我数字人,问我最多的问题是什么?"我害怕出镜,能让AI替我露脸吗?"

我灵机一动,可灵 AI 训练人脸模型出人物形象,AI 数字人匹配嘴型。这样就能做到只有脸是自己的,其余身体、场景全由AI虚拟生成。真正实现不用 IP出镜,也不用拍视频,就能更新作品。用的是 IP本人的脸,且保持人物一致。这个方案简直太完美了。

对比真人实拍的“全真AI数字人”,我们将其定义为“全能 AI 数字人”。

“C位出道”的高光时刻

为了验证想法是否可行,我自己先测试了一把。

2024年11月5日,这一天我永远难忘。

第一条全能AI数字人视频问世,让我开了人生第一场AI演唱会,后面又连续发布几条视频,疯狂弹奏《克罗地亚狂想曲》,马斯克与我握手庆祝实现全能 AI 数字人自由。

做 AI 以来,我一直想做一个赛博朋克风格的自己,和野火老师沟通之后,他帮我制作了这个由多个分身组合的视频,过了一把未来科技风的瘾。

这些视频让我的评论区、朋友圈瞬间爆炸!

无数消息涌入:"这是怎么做到的?"、"太神奇了!"、"教教我!"

这一刻,感谢可灵 AI,感谢全能 AI 数字人,让我“C 位出道了”。

紧接着文冠也开始了他的全能数字人,通过 AI 实现他的好多梦想,在纳斯达克敲了钟。

让野火解决了一直头疼的科技博主背景问题。

让树科圆了一把“皇帝梦”。

还满有意思的,只要你脑洞够大,你可以画出任何想要的场景。

图片展示了文冠的多个视频截图。左上角是文冠在纳斯达克敲钟上市的视频截图,背景有“纳斯达克”字样。左下角是文冠在视频中介绍自己能去纳斯达克敲钟的截图。中间部分是文冠在视频中介绍AI技术制作的内容。右上角是文冠在视频中介绍AI技术制作的内容。右下角是文冠在视频中介绍AI技术制作的内容,画面中有“也是给老美看的”字样。这些截图与上下文提到的文冠通过AI实现梦想、解决科技博主背景问题等内容相呼应。

看到这里,请叫我“全能 AI 数字人第一人”,不为过吧?😎

但我很快想通了一个事情:独乐乐不如众乐乐

从"独乐乐"到"众乐乐"

技术这东西,藏着掖着有什么意思?于是我决定:除了自己玩,更要让所有人都能玩起来!

我便开始开直播,写详细教程,把这个玩法开源了,不光是我们合伙人圈子里的伙伴跟着操作,后面可灵 AI 这个功能全面上线之后,外面也有大批创作者开始模仿。

不仅仅是视频制作的流程,甚至连我的视频封面设计,我也是毫无保留地分享给大家。

图片展示了多个视频封面,每个封面中有不同人物形象,且配有相应标题,如“用AI玩懂短视频轻松收割流量密码”等。视频封面排列整齐,以蓝色为主色调。结合上下文可知,这些可能是创作者们运用可灵AI功能制作的视频封面,体现了在分享玩法教程后,大批创作者积极实践的成果,反映出大家惊人的执行力。

不得不说,大家的执行力真是惊人!教程一发,立马就有人开干。

于是乎,有了下面这样的场景,到处都是全能 AI 数字人,甚至场景都几乎一模一样。

图片展示了DeepSeek数字人应用的多个场景。上方左侧是AI钢琴家弹奏世界名曲《卡农》的场景,下方有“AI音乐人”标识;右侧是DeepSeek震撼发布数学推理最强AI的场景,下方有“AI工具系列”标识。中间部分有“DeepSeek打破语言障碍助力缅甸救援”“DeepSeek重磅更新代码能力直接起飞”“震撼!国产机器人实现‘黄鱼打挺’美日技术彻底被超越”等场景,下方有“AI干货合辑”“@AI数字人强哥”“AI资讯系列”标识。下方还有“梦中的婚礼”“黄金年代”“好用先试”等场景。这些场景体现了DeepSeek数字人在不同领域的应用。

更让我欣慰的是,有不少伙伴通过这个玩法取得了惊人成绩。

伟豪:结合春节期间Deepseek的热点,一条视频直接爆了1000万播放量!没错,你没看错,不仅仅是千,而是后面还有一个万字,是千万级播放

看到这里的时候,还是有点自豪的,哈哈。

不过,坦诚地说,这里面运气成分不小。这条视频是春节期间发布的,当时只要沾上Deepseek话题几乎都能火。而这条视频经过几个月的累积,最终才突破了千万大关。占尽了天时地利人和,如果放在现在发布,可能连百万播放都很难达到。

但我始终相信:运气也是实力的一部分

为什么伟豪能抓住这波流量红利?关键在于他平时就在持续输出、不断积累。正是这种日复一日的内容创作习惯,为他打下了坚实基础。当机会来临时,他才能从容应对,顺势而为。

这也是我想强调的核心观点:只有注重平时积累,突如其来的流量才能被真正抓住。否则,每一次爆款都只是昙花一现,每一波红利都只是擦肩而过。

我相信,如果再有下一次"泼天富贵"般的流量机会,伟豪依然能稳稳抓住——因为他的实力不是靠一时运气,而是靠长期积累。

图片展示了两位数字人主播的直播画面及数据分析。左侧主播身穿黑色T恤,双手交叉,画面下方有“小白也能变大神”字幕。右侧主播身穿灰色连帽衫,比出“1”手势,画面下方有“会飞的AI数字人,你能够学会”字幕。中间弹出数据分析窗口,显示30条“deepseek指令”相关内容,截至3月2日05:00,总播放量为10078610,数量超过99.89%的同类视频。该图片与上下文介绍的数字人主播玩法及播放量情况相呼应。

**文冠,**也是通过这个玩法,结合春节 Deepseek 热点,出了好多百万播放视频,累计播放量也是千万级别。除了短视频,当时直播更是突破了 23 万场观。

图片展示了三位数字人主播的直播画面。左侧主播身穿黑色上衣,背景为科技感十足的场景;中间主播着黑色西装,背景为蓝色调的科技环境;右侧主播穿深色卫衣,背景同样科技感强。画面下方有播放量、点赞数等数据,如左侧主播有10.1万+播放量、2475点赞,中间主播有1.1万播放量、5352点赞等。图片与上下文关系紧密,直观呈现了文中提到的数字人主播相关内容。

至于我自己嘛,比起这两位"优秀学生"就有点逊色了,最高一条才70多万播放。看到这里,**叫我一声"雷锋"应该不过分吧?**😂

虽然流量上没被上天特别眷顾,但这也让我有幸接到了腾讯元宝的官方广告合作。

图片展示了腾讯元宝的官方广告合作相关内容。左侧是视频平台界面,显示“1分钟教你...”等内容,画面中人物在介绍。中间是腾讯元宝的宣传图,有“腾讯元宝 轻松工作、多点生活”字样。右侧是人物在麦克风前演唱的画面,下方有歌词“so I think I'll fly away...”及播放进度条。该图片与文档中提到的腾讯元宝官方广告合作相关,展示了合作内容的呈现形式。

好,看到这里你一定已经按捺不住了:"这个全能AI数字人到底是怎么制作的?"

别急,今天这篇文章不是为了吹牛我有多么厉害,既然写,懂我的人都知道,我是要么不写,要么就是得写能实操落地的内容。接下来,我会把最新版全能AI数字人的完整教程毫无保留地分享出来。

是战士 or 秀才?

我始终相信,在这个信息爆炸的时代:

单纯的知识分享已不再稀缺,真正珍贵的是持续的陪伴与不断创新的能力。

正如洋哥所说,我们的目标是帮助10万人顺利迈入AI时代。当我思考自己能为这个宏大目标贡献什么时,答案很明确:就是坚持做我最擅长的事——持续输出有价值的内容

我始终认为,努力创新、持续输出干货的人,才能称得上是真正的战士。

而那些只说不做、头头是道的人,只能算是"秀才"。

全能 AI 数字人制作流程揭秘

最新的全能 AI 数字人操作流程,希望能帮助到同样热爱创作的你👇

首先要了解全能数字人工作流是怎样的流程:

  1. 对目标人脸采样+训练
  2. 训练【人脸模型】
  3. 目标场景转化
  4. 生成AI人物视频
  5. 剪辑数字人样本
  6. 训练数字人形象
  7. 训练数字人声音
  8. 生成数字人视频

如何开始训练模型呢?

要制作全能数字人视频,我们需要先借助AI视频工具进行“人物捏造”。

这里用到的是可灵AI这个工具,最近推出了一个新功能,就是它的人脸模型

可灵AI的视频人脸模型到底是什么呢?

简单来说,用户可以在**可灵 1.5 模型(1.6模型目前还不支持)**上上传多段多角度的高清视频,自己训练出一个独特的人脸模型。训练完成后,你就能用这个人脸模型生成多个短视频,5 秒、10 秒都可以制作。这种自由度真是太赞了,相当于给创作者开了一扇新世界的大门,随心所欲地塑造角色。

可灵AI官网: https://klingai.kuaishou.com/h5-app/invitation?code=6BEEFZJAKSVU 这个视频生成工具超好用!使用我的邀请码 6BEEFZJAKSVU 成为新会员,首月可额外加赠 50% 创作积分(灵感值),快来让灵感成真~

图片展示了可灵AI平台的界面。左侧为电脑端界面,显示“可灵AI”标识及“AI光影未来之路”等作品,下方有“AI定制模型”“AI创作”“AI素材”等功能选项。右侧为手机端界面,同样有“可灵AI”标识,下方有“AI创作”“AI素材”“AI定制模型”等功能板块,还展示了“快看未来”“快看未来2”等作品。该图片与上文介绍的AI定制模型功能相呼应,直观呈现了平台操作界面。

第1步:AI模型定制

打开【功能入口】Web端首页侧边栏 > AI创作 > AI定制模型。

图片展示了可灵AI训练人脸模型的步骤1。左侧是多张不同角度的女性面部照片,右侧是可灵AI界面,显示“可灵AI”标识及“AI定制模型”选项。文字说明可灵AI支持通过上传多段高清视频素材,定制训练人脸模型,后续可在可灵1.5模型的文生视频中生成人脸一致的视频结果,满足创作诉求。图片与上下文紧密相关,直观呈现了AI定制模型的操作入口及功能介绍。

【AI定制模型】可以训练自己专属人脸,此功能只有铂金会员和钻石会员才能使用。

图片展示了可灵AI平台中训练人脸模型的会员等级选择界面。左侧显示可灵AI平台首页,有会员等级、功能介绍等内容。右侧是会员等级选择区域,分别有铂金会员、钻石会员选项,其中钻石会员有266灵感值、3000创作积分,铂金会员有66灵感值、900创作积分。图片与上文提到的“使用人脸模型功能,需要先购买可灵AI [铂金会员] 或者 [钻石会员]”相呼应,直观呈现了会员等级及相应权益。

第2步:同意并使用

点击AI定制模型后进入功能使用须知界面,点击同意并使用按钮完成操作

第3步:上传一个正面的视频

上传1段正面人脸视频(10-15s,1080p,横竖屏均可),在①的位置输入模型名字点保存,然后点击下一步。 备注:主视频对训练结果占比很大。

图片展示了全能AI数字人制作流程中第1步“训练人脸模型”的内容。左侧是可灵AI平台界面,提示上传一段正面人脸视频(5 - 15秒,1080p,横竖屏均可)。右侧是可灵AI平台的视频库界面,显示多个视频缩略图,其中有一个视频正在播放。该图片与上下文紧密相关,直观呈现了制作流程中上传正面人脸视频这一关键步骤,帮助用户了解操作要求。

第4步:补充多角度的视频

需要补充 10-30 段同一人物的更多动作/表情视频(每段视频 10-15s,1080p),上传至少10个视频之后,就可以开始训练了。 每一个模型需要消耗 999 个可灵值,且用且珍惜。

图片展示了全能AI数字人制作流程中“步骤1——训练人脸模型”的内容。画面左侧是视频录制界面,显示录制时间为19:40 - 20:00,有多个视频窗口,人物多为男性,背景各异。右侧是视频列表,有多个视频缩略图。图片下方文字说明补充10 - 30段同一人物的更多动作/表情视频,每段视频5 - 15秒,短边分辨率需≥1080像素。该图片与上下文介绍的数字人制作流程相关,是制作步骤中的关键环节。

同样的,小姐姐也会做演示应该上传什么样的视频。

❌常见错误:视频分辨率太低,短边需要 ≥1080像素

图片展示了两个失败视频示例。左侧视频名为“元峰-走动-10秒.mp4”,画面中人物穿着蓝色西装,背景为室内环境,下方提示“视频分辨率过高,长边需要≤2520像素”。右侧视频名为“元峰人脸模型训练素材_错误案...”,画面中人物同样穿着蓝色西装,背景为室内书架,下方提示“视频分辨率过低,短边需要≥1080像素”。该图片与上下文对应,直观呈现了视频分辨率不达标时的错误示例,帮助理解视频分辨率要求。

图片展示的是全能AI数字人制作流程中“同意并使用”步骤的错误提示界面。画面中显示“视频分辨率过低,短边需要≥1080像素”,并有红色圆圈和箭头指向该提示。下方提示支持mp4、mov等视频格式,文件大小不超过100MB,且需确保上传的是自己的视频或有合法使用权利的视频。右下角有“下一步”按钮。该图片与上下文紧密相关,直观呈现了视频分辨率过低的错误情况,帮助用户了解常见错误并找到解决办法。 错误提示:视频分辨率太低,短边需要 ≥1080像素

图片展示的是视频文件的详细信息界面。其中,帧宽度为720,帧高度为1280,帧速率显示为19.98帧/秒,被红色圈重点标注。该图片与文档中“视频分辨率太低,短边需要≥1080像素”的错误提示相关,用于说明视频短边分辨率只有720P,与标准的1080P格式不符,是视频制作中常见的错误原因。 错误原因:视频短边分辨率只有720P

比如这里问题分辨率不对,就去剪映里面重新导出一遍标准的视频分辨率格式。

解决办法:使用电脑版剪映重新导出一遍视频

图片展示的是全能AI数字人制作流程中训练人脸模型步骤的相关内容。解决办法是使用电脑版剪映重新导出一遍视频。画面中有三点关键信息:①提醒将时长控制在10 - 15秒之间;②要求比例选择9:16;③导出时分辨率选择1080P,且在电脑上找视频文件通过【属性】 - 【详细信息】可检查分辨率情况,还提到竖屏视频分辨率为10801920 ,横屏为19201080。图片内容与上下文介绍的视频导出及分辨率要求相契合。

  • ①时长控制在 10-15秒之间
  • ②比例选择 9:16
  • ③导出时选择 1080P

在电脑上面找到这个视频文件,点右键,【属性】【详细信息】检查自己的分辨率是不是 1080*1920

图片展示了电脑版剪映中视频文件的属性界面,重点突出视频分辨率信息。画面左侧有两张视频缩略图,右侧属性界面中“分辨率”一栏显示为“10801920”,并有红色框线和箭头标注。该图片与上下文紧密相关,上下文提到在电脑上找到视频文件,右键选择【属性】,【详细信息】检查分辨率是否为10801920,此图直观呈现了检查分辨率的操作结果,帮助用户确认视频分辨率是否符合要求。

正确的视频分辨率

视频要求

  • 竖屏视频:1080*1920 分辨率
  • 横屏视频:1920*1080 分辨率

等待 1小时左右之后,我们的视频人脸模型就炼好了。训练完成之后就会给我们一个 5 秒的模型效果视频,这逼真程度,已经非常 Nice 了。

图片展示了可灵AI平台中训练人脸模型的步骤。画面左上角有“步骤1——训练人脸模型”的标题,下方提示在【资产】->【我的模型】中找到训练好的模型。画面中间是可灵AI平台界面,左侧有“可灵AI”标识及多个功能选项,右侧显示了4个不同风格的数字人模型。画面底部黄色文字说明人脸模型训练大概需等待1小时左右。该图片与上文提到的使用可灵AI制作数字人视频的流程内容相关,直观呈现了模型训练后的查找位置。

AI人物模型视频制作

第1步:文生视频

图片展示了“步骤2——合成视频”的内容。左侧是一张人物照片,右侧是可灵AI界面,显示“可灵AI”标识及多个功能选项,如AI视频、AI图片等。下方文字说明输入一段文字,可灵大模型根据文本表达生成5s或10s视频,将文字转变为视频画面。底部黄色文字强调“文生图,给你想要的动感”。该图片与上文“文生视频”制作流程相关,是制作视频的第二步操作展示。

然后我们接着使用 **【文生视频】**时,输入提示词后就可以选择人物模型了。

选择好人物模型之后,自动会添加到提示词后面,等待几分钟生成AI视频,正面本条视频会调用此人物模型。

图片展示了全能AI数字人制作流程中“步骤2——合成视频”环节。左侧是可灵AI平台界面,有模型选择、输入文字描述、选择人脸模型等操作选项,还列出不希望出现的内容。右侧是合成视频示例,展示了不同背景下的数字人形象。下方列出合成视频的建议设置,包括选择高品质模式、10秒(不建议5秒)、竖屏9:16和横屏16:9比例,建议每次生成2条。该图片与上文介绍的AI人物模型视频制作流程紧密相关,直观呈现了合成视频的操作与设置。

提示词: @元峰(主体特征: 一位约30岁的男性科技博主,穿着黑色短袖,正在讲内容,充满对科技的热情。 场景设置: 直播间背景是现代科技风格,墙上有各种电子设备、科技书籍,桌上摆着笔记本电脑、智能音箱和几款小型AI机器人模型。背景灯光冷色调的蓝色和紫色,几何造型的LED灯饰进一步增强了科技氛围。 动作与姿态: 博主站在桌旁,双手自然摆动,边说话边用手势表达,姿态轻松亲切,带有很强的亲和力,仿佛在向观众介绍有趣的AI技术。 灯光与氛围: 冷色调的灯光效果突显科技氛围,聚光灯照亮博主的面部和手势,电脑和设备上的光芒映在他的脸上,营造出互动科技的未来感。 技术规格: 超高清8K分辨率,写实风格,聚焦博主的表情和手势,呈现一种兼具科技感和互动感的画面。

可设置自己需要的参数之后在生成。

**生成模式:**高品质 **生成时长:**5秒和10秒可选(5秒消耗35可灵值,10秒消耗70可灵值),建议是选择10秒 **视频比例:**做短视频,建议9:16 **生成数量:**可以一次出1-4条(可灵值会叠加)

第2步:写提示词

图片展示了可灵AI人物模型提示词示例,用于AI视频制作的第2步写提示词。左侧为一位30岁男性科技领域主持人,背景有科技感装饰。右侧是其视频片段,画面灯光柔和,舞台夜晚,主持人身穿黑色休闲装,背景有暖色灯光。提示词包含特征、场景、动作姿态、灯光氛围、技术规格等信息,如特征为30岁男性科技主持人,场景为灯光柔和的舞台夜晚等,技术规格为超高清8K分辨率等。

点击立即生成,大约等20分钟,AI视频就生成好了。

提示词应该如何写呢?可用Deepseek,举例如下:

可灵自己也已经把DeepSeek的模型接入网页当中,可以直接写提示词。

图片展示了AI视频制作平台的界面,重点突出“DeepSeek”功能。界面上方有“AI视频”“提示词”“对口型”选项卡,当前选中“提示词”。右侧弹出“DeepSeek R1 灵感版”窗口,提示“我是DeepSeek,我可以帮你丰富提示词,快来分享你的烦恼,我将为你提供内容”。窗口下方有多个提示词示例,如“一只小狗在咖啡厅看书”“2个镜头,奶奶在海上的行,船长在望远方”等。该图片与上下文介绍的AI视频制作流程中写提示词的内容相关,展示了DeepSeek功能的使用界面。

第3步:常见问题

对已经生成好的数字人视频下载(可下载有水印或无水印),这里下载的是无水印。

数字人视频效果视频。

问题:可灵文生视频,手变形了,动作呆板

回答: 有两个层面,

  1. 换提示词,可能这个提示词出的就是有问题,觉得不行就换
  2. 所有提示词都有问题,那就证明你训练人脸模型的时候,真人录制的素材就不好,可以重新录重新训练

图片展示的是可灵AI制作视频时遇到的问题及解决思路。画面左侧列出问题“可灵文生视频,手变形了,动作呆板”,并指出有两个层面解决:1. 换提示词,若提示词有问题可更换;2. 若所有提示词都有问题,说明训练人脸模型时素材不好,需重新录重新训练。画面右侧是可灵AI的标志及多张视频截图,展示了不同场景和人物。该图与上下文紧密相关,直观呈现了解决视频制作问题的思路。

数字人视频合成

大家有没有发现,可灵直接出来的视频形象场景已经很Nice了,但人物是没有开口讲话的,下一步我们就可以通过数字人软件,让“活”起来,开始讲话。

用到的数字人软件是上面咱们讲到的 必火AI数字人

💻必火AI数字人:https://www.bihuoai.com/welcome(复制到电脑浏览器里面打开)

图片展示了必火AI数字人平台的界面。左侧是电脑端界面,显示“用必火,一定火 AI数字人一站式创作平台”,并有“去创作”按钮。右侧是手机端界面,上方有“突破传统 极速克隆”字样,下方有“扫码进入 必火AI微信小程序”及二维码,还展示了“克隆”“编辑”“发布”等功能按钮。图片与上下文紧密相关,直观呈现了必火AI数字人制作平台的使用场景,帮助用户了解其操作界面。

全能AI数字人唱歌

第1步:形象克隆

可灵生成好的数字人视频上传必火AI克隆数字人分身。

图片展示了必火AI数字人形象克隆的制作流程。左侧红框突出显示“我的数字分身”按钮,下方有“形象克隆”“AI换脸”“AI换身”选项。右侧红框标注“1. 点击数字分身--->快速复刻”“2. 上传之前我们在可灵生成的视频”“3. 提交后,几分钟即可完成克隆”,并配有对应操作步骤的图标。该图片与上文“全能AI数字人制作流程揭秘”中“第1步:数字人形象克隆”内容相呼应,直观呈现了克隆操作步骤。

视频要求

视频方向:横向或纵向 文件格式:mp4、mov 视频时长:10秒~30分钟 分辨率:360p~4K 文件大小:小于500MB

克隆完成之后,点击【去创作】。

图片展示了必火AI平台中数字人形象克隆的第1步操作界面。画面左上角有“必火AI”标识,左侧有用户、作品、视频、模板、直播、数字人等导航栏。中间部分显示“我的数字分身”及多个数字人形象缩略图,其中“AI视频配音男_10秒”被红框突出显示。右下角有“去创作”按钮。画面右下角有“必火AI”标识。图片下方文字说明“4.选择形象,点击【去创作】进入操作台,开始制作数字人视频”。该图片与上文“克隆完成之后,点击【去创作】”的内容相呼应,指导用户进行下一步操作。

生成数字人口播有两种驱动方式:

  • ①文本驱动(可输入台词,数字人根据提供的台词进行匹配口型)
  • ②音频驱动(上传已准备好的音频,数字人会通过音频内容进行匹配口型)。

第2步:数字人唱歌🎤 | 音频驱动

如果唱歌的数字人,使用音频驱动功能,直接上传唱歌的mp3音频文件上去进行音频驱动。音乐从抖音,QQ音乐,网易云音乐找即可。

图片展示了全能AI数字人视频合成的第2步操作流程,即音频驱动模式。左侧红框突出显示“选择数字人形象”,并有数字人形象示例。中间红框标注“切换音频驱动模式”,下方红框提示上传提前录制好的声音文件,格式为mp3、wav、m4a,时长10秒 - 3分钟。右侧红框显示视频合成后可在此下载视频。底部红框为视频合成配置。该图与上文介绍的数字人视频合成流程紧密相关,直观呈现操作步骤。

这里为了效果好,建议使用【超清版本】模型来匹配唱歌的嘴型。

图片展示了全能AI数字人制作流程中数字人视频合成的参数设置界面。其中,“生成模式”部分以红色框突出显示,有“高清版本”和“超清版本”两个选项,当前选中的是“超清版本”。该图片与上下文紧密相关,上下文提到为了效果好,建议使用“超清版本”模型来匹配唱歌的嘴型,此图直观呈现了“超清版本”这一选项,帮助用户明确选择。

第3步:视频剪辑 | 剪映

图片展示了全能AI数字人视频剪辑过程中的剪映操作界面及成片效果。左侧是剪映软件界面,显示视频剪辑时间线,有多个视频片段和音频轨道。右侧是手机播放视频画面,画面中数字人正在演唱,背景有光效,下方有中英文字幕。该图片与上文“第3步:视频剪辑 | 剪映”内容对应,直观呈现了视频剪辑操作及成片展示情况。

成片展示。

全能AI数字人口播制作

第1步:声音克隆

图片展示了必火AI数字人声音克隆的方案选择界面。界面上方有“第1步:数字人声音克隆”标题,右上角有“必火AI”标识。下方有三个方案选项,分别是基础版、专业情感版和专业级旗舰版,每个方案有详细的核心优势、声音情感、声音语速、语种支持、试听机制等信息。其中专业情感版被红色框线突出显示,标注“推荐”。该图片与上下文紧密相关,是数字人口播制作中声音克隆步骤的展示,帮助用户了解不同方案的特点。

图片展示了必火AI情感版声音克隆功能,核心优势为多情感、多语言,声音相似度80 - 95%,有7种情感模式,支持12种语言。左侧为手机界面,显示“必火AI情感版普通话案例”,并有“视频可播放”提示。右侧红框内列出支持语言及对应的情感模式,如中文(普通话)对应高兴、悲伤等情感。该图与上下文紧密相关,直观呈现了声音克隆功能的特性及支持内容,为后续数字人口播视频制作提供参考。

点击声音克隆,选择克隆声音模式。

图片展示了必火AI平台中情感版声音克隆步骤。画面左侧有“必火AI”标识及导航栏,右侧上方显示“情感版 - 声音克隆步骤”。画面中间突出显示“声音克隆”区域,有“快速克隆”按钮,旁边有红色箭头指向该按钮,并标注“①点击快速克隆”。下方是“我的声音克隆”区域,展示了两个克隆好的声音,每个声音下方有“试听”按钮。该图片与上下文紧密相关,直观呈现了声音克隆的第一步操作。

图片展示了必火AI情感版声音克隆步骤。左侧界面有“声音克隆”按钮,点击后弹出设置窗口,可设置声音名称、选择语言、设置性别。下方有“上传原始音频试听”区域,可上传10段音频,建议上传3 - 5个声音。右侧是克隆完成界面,显示克隆完成按钮。该图片与上文“全能AI数字人口播制作”中“第1步:声音克隆”内容对应,直观呈现了声音克隆的操作步骤和界面。

第2步:数字人口播视频 | 文本驱动

选择之前克隆好的数字人形象,点击**【去创作】。**

输入台词,选择已训练克隆好的声音,可鼠标滑动选取文本内容, 进行逐句试听, 点击插入停顿在光标处调整文字之间的停顿时长。

图片展示了全能AI数字人口播视频制作流程中“数字人口播视频|文本驱动”步骤的界面。左侧为数字人形象选择区域,可选择不同形象。中间部分有文本编辑框,可输入台词并试听声音。下方是声音语言选择区域,有多种语言选项。右侧是作品记录区域,可下载视频。该图片与上下文紧密相关,直观呈现了数字人口播视频制作的具体操作步骤和界面布局。

点击提交,等待几分钟之后,数字人视频就制作好了。

然后我们下载之后来看看效果。

第3步:数字人口播视频剪辑

剪辑工具:剪映、开拍等等。

剪映

打开剪映点击首页,在点开始创作,进入剪辑界面。

图片展示了剪映软件的界面。左侧为导航栏,有“首页”“模板”等选项,其中“首页”被红色箭头1指向。右侧是功能模块区域,有“开始创作”按钮,被红色箭头2指向。该图片与文档中“剪映”部分内容相关,对应打开剪映点击首页,在点开始创作,进入剪辑界面的操作步骤,直观呈现了操作入口。

视频剪辑

导入数字人视频之后进行剪辑,添加字幕,标题,背景音乐等。

图片展示的是全能AI数字人视频制作软件界面。左侧是素材库,有多个视频缩略图。中间是视频预览窗口,显示一位男士在电脑前讲解,下方有中文字幕。右侧是视频参数设置区域,有分辨率、帧率等选项。底部是时间轴,有多个视频片段和字幕素材。该图与文档中“全能AI数字人制作流程揭秘”部分相关,直观呈现了数字人视频制作的界面及素材安排情况。

导出并发布

图片展示了全能AI数字人视频制作中导出并发布设置界面。画面左侧是视频预览窗口,显示蓝色背景的数字人形象及文字。右侧是导出设置区域,突出显示视频输出部分,包括分辨率(4K)、编码(H.264)、格式(mp4)等参数,下方有“导出”和“取消”按钮。画面右上角有“导出”按钮。该图片与上下文紧密相关,直观呈现了视频导出设置的操作界面,是制作流程中导出并发布步骤的展示。

成片展示。

OK,以上就是完整的制作一个全能数字人视频的整体过程。

共创AI内容新时代

回顾这段全能AI数字人的旅程,我深刻体会到了知识共享的巨大力量。从最初的个人探索,到如今的广泛应用,这不仅仅是技术的传播,更是一种创新思维的扩散。

当看到越来越多的创作者通过我分享的方法取得成功,那种成就感远超过个人荣誉。这正是我一直坚信的:真正的价值不在于你独自掌握了什么,而在于你能帮助多少人一起成长。

希望这篇教程能成为你迈入AI创作领域的第一步。最重要的不是工具本身,而是如何创造性地运用这些工具,表达独特的思想和价值。

让我们一起AI破局,在这个AI新时代创造更多精彩!