
大家好,我是元峰,累计36 颗 AI 之心获得者。
因为一次偶然的机会,一次灵光乍现,彻底改变了我的创作轨迹——我成为了**"全能AI数字人"**的先行者。
这一切的开始,始于2024 年 6 月 8 日那条**"致青春:动物高考"**的视频。
就是因为可灵 AI 刚刚上线时,我抓住机会创作了这个作品,结果被可灵 AI 发现,成为官方转发的第 1 条用户视频!这个小小的"第一"让我获得了可灵AI超级创作者的身份。

有了超创的加持,也因此获得了许多普通用户无法触及的内测功能。比如可灵AI的人脸模型功能——当大多数人还在苦苦等待时,我已经玩了整整两个月。
玩这么久AI了,我越发认可一句话:技术从来不是赚钱的核心,场景才是。
说白了,技术不是赚钱的核心,能解决什么痛点才是关键。
我开始思考,别人来咨询我数字人,问我最多的问题是什么?"我害怕出镜,能让AI替我露脸吗?"
我灵机一动,可灵 AI 训练人脸模型出人物形象,AI 数字人匹配嘴型。这样就能做到只有脸是自己的,其余身体、场景全由AI虚拟生成。真正实现不用 IP出镜,也不用拍视频,就能更新作品。用的是 IP本人的脸,且保持人物一致。这个方案简直太完美了。
对比真人实拍的“全真AI数字人”,我们将其定义为“全能 AI 数字人”。
“C位出道”的高光时刻
为了验证想法是否可行,我自己先测试了一把。
2024年11月5日,这一天我永远难忘。
第一条全能AI数字人视频问世,让我开了人生第一场AI演唱会,后面又连续发布几条视频,疯狂弹奏《克罗地亚狂想曲》,马斯克与我握手庆祝实现全能 AI 数字人自由。
做 AI 以来,我一直想做一个赛博朋克风格的自己,和野火老师沟通之后,他帮我制作了这个由多个分身组合的视频,过了一把未来科技风的瘾。
这些视频让我的评论区、朋友圈瞬间爆炸!
无数消息涌入:"这是怎么做到的?"、"太神奇了!"、"教教我!"
这一刻,感谢可灵 AI,感谢全能 AI 数字人,让我“C 位出道了”。
紧接着文冠也开始了他的全能数字人,通过 AI 实现他的好多梦想,在纳斯达克敲了钟。
让野火解决了一直头疼的科技博主背景问题。
让树科圆了一把“皇帝梦”。
还满有意思的,只要你脑洞够大,你可以画出任何想要的场景。

看到这里,请叫我“全能 AI 数字人第一人”,不为过吧?😎
但我很快想通了一个事情:独乐乐不如众乐乐。
从"独乐乐"到"众乐乐"
技术这东西,藏着掖着有什么意思?于是我决定:除了自己玩,更要让所有人都能玩起来!
我便开始开直播,写详细教程,把这个玩法开源了,不光是我们合伙人圈子里的伙伴跟着操作,后面可灵 AI 这个功能全面上线之后,外面也有大批创作者开始模仿。
不仅仅是视频制作的流程,甚至连我的视频封面设计,我也是毫无保留地分享给大家。

不得不说,大家的执行力真是惊人!教程一发,立马就有人开干。
于是乎,有了下面这样的场景,到处都是全能 AI 数字人,甚至场景都几乎一模一样。

更让我欣慰的是,有不少伙伴通过这个玩法取得了惊人成绩。
伟豪:结合春节期间Deepseek的热点,一条视频直接爆了1000万播放量!没错,你没看错,不仅仅是千,而是后面还有一个万字,是千万级播放。
看到这里的时候,还是有点自豪的,哈哈。
不过,坦诚地说,这里面运气成分不小。这条视频是春节期间发布的,当时只要沾上Deepseek话题几乎都能火。而这条视频经过几个月的累积,最终才突破了千万大关。占尽了天时地利人和,如果放在现在发布,可能连百万播放都很难达到。
但我始终相信:运气也是实力的一部分。
为什么伟豪能抓住这波流量红利?关键在于他平时就在持续输出、不断积累。正是这种日复一日的内容创作习惯,为他打下了坚实基础。当机会来临时,他才能从容应对,顺势而为。
这也是我想强调的核心观点:只有注重平时积累,突如其来的流量才能被真正抓住。否则,每一次爆款都只是昙花一现,每一波红利都只是擦肩而过。
我相信,如果再有下一次"泼天富贵"般的流量机会,伟豪依然能稳稳抓住——因为他的实力不是靠一时运气,而是靠长期积累。

**文冠,**也是通过这个玩法,结合春节 Deepseek 热点,出了好多百万播放视频,累计播放量也是千万级别。除了短视频,当时直播更是突破了 23 万场观。

至于我自己嘛,比起这两位"优秀学生"就有点逊色了,最高一条才70多万播放。看到这里,**叫我一声"雷锋"应该不过分吧?**😂
虽然流量上没被上天特别眷顾,但这也让我有幸接到了腾讯元宝的官方广告合作。

好,看到这里你一定已经按捺不住了:"这个全能AI数字人到底是怎么制作的?"
别急,今天这篇文章不是为了吹牛我有多么厉害,既然写,懂我的人都知道,我是要么不写,要么就是得写能实操落地的内容。接下来,我会把最新版全能AI数字人的完整教程毫无保留地分享出来。
是战士 or 秀才?
我始终相信,在这个信息爆炸的时代:
单纯的知识分享已不再稀缺,真正珍贵的是持续的陪伴与不断创新的能力。
正如洋哥所说,我们的目标是帮助10万人顺利迈入AI时代。当我思考自己能为这个宏大目标贡献什么时,答案很明确:就是坚持做我最擅长的事——持续输出有价值的内容。
我始终认为,努力创新、持续输出干货的人,才能称得上是真正的战士。
而那些只说不做、头头是道的人,只能算是"秀才"。
全能 AI 数字人制作流程揭秘
最新的全能 AI 数字人操作流程,希望能帮助到同样热爱创作的你👇
首先要了解全能数字人工作流是怎样的流程:
- 对目标人脸采样+训练
- 训练【人脸模型】
- 目标场景转化
- 生成AI人物视频
- 剪辑数字人样本
- 训练数字人形象
- 训练数字人声音
- 生成数字人视频
如何开始训练模型呢?
要制作全能数字人视频,我们需要先借助AI视频工具进行“人物捏造”。
这里用到的是可灵AI这个工具,最近推出了一个新功能,就是它的人脸模型。
可灵AI的视频人脸模型到底是什么呢?
简单来说,用户可以在**可灵 1.5 模型(1.6模型目前还不支持)**上上传多段多角度的高清视频,自己训练出一个独特的人脸模型。训练完成后,你就能用这个人脸模型生成多个短视频,5 秒、10 秒都可以制作。这种自由度真是太赞了,相当于给创作者开了一扇新世界的大门,随心所欲地塑造角色。
可灵AI官网: https://klingai.kuaishou.com/h5-app/invitation?code=6BEEFZJAKSVU 这个视频生成工具超好用!使用我的邀请码 6BEEFZJAKSVU 成为新会员,首月可额外加赠 50% 创作积分(灵感值),快来让灵感成真~

第1步:AI模型定制
打开【功能入口】Web端首页侧边栏 > AI创作 > AI定制模型。

【AI定制模型】可以训练自己专属人脸,此功能只有铂金会员和钻石会员才能使用。
第2步:同意并使用
点击AI定制模型后进入功能使用须知界面,点击同意并使用按钮完成操作。
第3步:上传一个正面的视频
上传1段正面人脸视频(10-15s,1080p,横竖屏均可),在①的位置输入模型名字点保存,然后点击下一步。 备注:主视频对训练结果占比很大。

第4步:补充多角度的视频
需要补充 10-30 段同一人物的更多动作/表情视频(每段视频 10-15s,1080p),上传至少10个视频之后,就可以开始训练了。 每一个模型需要消耗 999 个可灵值,且用且珍惜。

同样的,小姐姐也会做演示应该上传什么样的视频。
❌常见错误:视频分辨率太低,短边需要 ≥1080像素

错误提示:视频分辨率太低,短边需要 ≥1080像素
错误原因:视频短边分辨率只有720P
❌比如这里问题分辨率不对,就去剪映里面重新导出一遍标准的视频分辨率格式。
✅解决办法:使用电脑版剪映重新导出一遍视频

- ①时长控制在 10-15秒之间
- ②比例选择 9:16
- ③导出时选择 1080P
在电脑上面找到这个视频文件,点右键,【属性】,【详细信息】检查自己的分辨率是不是 1080*1920

正确的视频分辨率
视频要求
- 竖屏视频:1080*1920 分辨率
- 横屏视频:1920*1080 分辨率
等待 1小时左右之后,我们的视频人脸模型就炼好了。训练完成之后就会给我们一个 5 秒的模型效果视频,这逼真程度,已经非常 Nice 了。

AI人物模型视频制作
第1步:文生视频

然后我们接着使用 **【文生视频】**时,输入提示词后就可以选择人物模型了。
选择好人物模型之后,自动会添加到提示词后面,等待几分钟生成AI视频,正面本条视频会调用此人物模型。

提示词: @元峰(主体特征: 一位约30岁的男性科技博主,穿着黑色短袖,正在讲内容,充满对科技的热情。 场景设置: 直播间背景是现代科技风格,墙上有各种电子设备、科技书籍,桌上摆着笔记本电脑、智能音箱和几款小型AI机器人模型。背景灯光冷色调的蓝色和紫色,几何造型的LED灯饰进一步增强了科技氛围。 动作与姿态: 博主站在桌旁,双手自然摆动,边说话边用手势表达,姿态轻松亲切,带有很强的亲和力,仿佛在向观众介绍有趣的AI技术。 灯光与氛围: 冷色调的灯光效果突显科技氛围,聚光灯照亮博主的面部和手势,电脑和设备上的光芒映在他的脸上,营造出互动科技的未来感。 技术规格: 超高清8K分辨率,写实风格,聚焦博主的表情和手势,呈现一种兼具科技感和互动感的画面。
可设置自己需要的参数之后在生成。
**生成模式:**高品质 **生成时长:**5秒和10秒可选(5秒消耗35可灵值,10秒消耗70可灵值),建议是选择10秒 **视频比例:**做短视频,建议9:16 **生成数量:**可以一次出1-4条(可灵值会叠加)
第2步:写提示词

点击立即生成,大约等20分钟,AI视频就生成好了。
提示词应该如何写呢?可用Deepseek,举例如下:
可灵自己也已经把DeepSeek的模型接入网页当中,可以直接写提示词。

第3步:常见问题
对已经生成好的数字人视频下载(可下载有水印或无水印),这里下载的是无水印。
数字人视频效果视频。
问题:可灵文生视频,手变形了,动作呆板
回答: 有两个层面,
- 换提示词,可能这个提示词出的就是有问题,觉得不行就换
- 所有提示词都有问题,那就证明你训练人脸模型的时候,真人录制的素材就不好,可以重新录重新训练

数字人视频合成
大家有没有发现,可灵直接出来的视频形象场景已经很Nice了,但人物是没有开口讲话的,下一步我们就可以通过数字人软件,让“活”起来,开始讲话。
用到的数字人软件是上面咱们讲到的 必火AI数字人。
💻必火AI数字人:https://www.bihuoai.com/welcome(复制到电脑浏览器里面打开)

全能AI数字人唱歌
第1步:形象克隆
可灵生成好的数字人视频上传必火AI克隆数字人分身。

视频要求
视频方向:横向或纵向 文件格式:mp4、mov 视频时长:10秒~30分钟 分辨率:360p~4K 文件大小:小于500MB
克隆完成之后,点击【去创作】。

生成数字人口播有两种驱动方式:
- ①文本驱动(可输入台词,数字人根据提供的台词进行匹配口型)
- ②音频驱动(上传已准备好的音频,数字人会通过音频内容进行匹配口型)。
第2步:数字人唱歌🎤 | 音频驱动
如果唱歌的数字人,使用音频驱动功能,直接上传唱歌的mp3音频文件上去进行音频驱动。音乐从抖音,QQ音乐,网易云音乐找即可。

这里为了效果好,建议使用【超清版本】模型来匹配唱歌的嘴型。

第3步:视频剪辑 | 剪映

成片展示。
全能AI数字人口播制作
第1步:声音克隆


点击声音克隆,选择克隆声音模式。


第2步:数字人口播视频 | 文本驱动
选择之前克隆好的数字人形象,点击**【去创作】。**
输入台词,选择已训练克隆好的声音,可鼠标滑动选取文本内容, 进行逐句试听, 点击插入停顿在光标处调整文字之间的停顿时长。

点击提交,等待几分钟之后,数字人视频就制作好了。
然后我们下载之后来看看效果。
第3步:数字人口播视频剪辑
剪辑工具:剪映、开拍等等。
剪映
打开剪映点击首页,在点开始创作,进入剪辑界面。

视频剪辑
导入数字人视频之后进行剪辑,添加字幕,标题,背景音乐等。

导出并发布

成片展示。
OK,以上就是完整的制作一个全能数字人视频的整体过程。
共创AI内容新时代
回顾这段全能AI数字人的旅程,我深刻体会到了知识共享的巨大力量。从最初的个人探索,到如今的广泛应用,这不仅仅是技术的传播,更是一种创新思维的扩散。
当看到越来越多的创作者通过我分享的方法取得成功,那种成就感远超过个人荣誉。这正是我一直坚信的:真正的价值不在于你独自掌握了什么,而在于你能帮助多少人一起成长。
希望这篇教程能成为你迈入AI创作领域的第一步。最重要的不是工具本身,而是如何创造性地运用这些工具,表达独特的思想和价值。
让我们一起AI破局,在这个AI新时代创造更多精彩!