🎉报个喜,9 号那天,通过可灵的内测之后,马不停蹄做了一个高考话题的视频,结果没想到,它居然被可灵AI的快手和视频号官方账号转发分享了!

之所以能吃到第一批螃蟹,很大原因是运气好,另一方面也是因为我足够的 AI 嗅觉,看到信息的第一时间,就申请了内测,另外,可灵大模型足够强,出素材非常精准,基本都是一条过,出来的视频就是我想要的,指哪打哪,大大降低了视频创作的门槛!
目前还没通过的伙伴也不要着急,只能耐心等待,再无他法。
这个片子,昨天破局官方团队已经发了这是视频完整版了,大家可以点击此链接过去查看:https://t.zsxq.com/LAt3n
有很多伙伴问我,有没有教程!说实话,操作简单到我不知道如何去写这个教程,因为就是输入提示词,等出片,完事!就和把大象放入冰箱需要几步一模一样。
我简单的讲一下这个片子的思路吧。
第一步:先确定下主题,要画什么
因为昨天正好是6月7日,高考的日子。那么,最应景的便是高考了。但是画真人就有点单调了,于是我就想到了让动物来参加高考。所以,这里我用 ChatGPT 帮我生成了一些分镜脚本。


第二步:进入 快影,输入提示词出片
可灵是在快手的剪辑软件 快影 里面的,大家下载完 APP 之后,进入到 AI玩法-> AI 生视频 里面。目前都还是内测阶段,没有全面开放。还没通过的伙伴只能在耐心等一等,再没有其他办法了。

进来之后,直接输入提示词即可,没有任何多余操作。然后等待 3 分钟,一个短片就完成了,目前支持的片段都只有 5 秒。

画面1: 长颈鹿站在一棵大树下,树叶为它提供了阴凉。长颈鹿低头看着摊开的书,眼神专注,脖子微微弯曲,显得非常认真。
画面2:一群猴子聚在一起,手舞足蹈地讨论问题。它们的表情丰富,有的眉头紧锁,有的手指着书本,显得非常活跃和热烈。
画面3:大象坐在地上,用长鼻子卷着一支笔,在地上的纸上写字。大象的眼神专注,笔尖在纸上移动,显得非常用心。
出来的 80% 的画面都是非常满意的,一步到位。但是肯定不是 100%,有一些还是需要调整的。比如下面这个长颈鹿和大象对答案的画面,第一次出来的是卡通漫画风格,很明显和其他写实风格画面是不一致的,所以在提示词中我加了“写实风格”重新出了一个片段,就符合预期了。

画面4:长颈鹿和大象站在一起,手里拿着试卷,互相对着答案。长颈鹿低头看着试卷,大象则用鼻子指着某个答案,两人讨论得热火朝天。
还有一些画面是自己编的,直接大白话写提示词就行了。

画面5:一道极光出现,老虎拼搏奋斗的特写
画面6:动物园的环境从白天到夜晚
第三步:剪辑
剪辑就是把这些个 5 秒的视频片段拼接在一起,这里需要的就是剪辑功底了,要想精细化剪辑,肯定得需要人工。如果满分100💯的话,有一些 AI 也是可以快速剪辑的,但在我看来只能达到 30-40 分吧。

ok,这就是可灵的使用,简单到没法写教程。最后,希望大家都尽快通过内测,早点用到可灵来出大片。
昨天中午,我正准备眯个午觉,突然手机震个不停,一看,群里消息跟疯了似的,几百条一眨眼就冒出来了。仔细一瞧,原来是因为可灵新出的**“图生视频”和“视频续写”**功能,这消息一出来,大家就炸锅了。

图生视频
上传任意图片,生成5秒精彩视频。支持添加提示词控制图像运动。

这里的提示词很简单,就是让他们 3 打起来。
让这个表情包老哥再一次亮瞎你的眼。
这一届网友真是太有才了,让玉帝哥哥也经不起诱惑了。
这个更狠,直接让 C 罗从嘴里面喝进去,头顶喷出来。
可灵是懂这位国外小哥的,渣男气质拿捏的死死的。
视频续写
对生成视频一键续写4~5秒,支持多次续写(最长3分钟),可通过微调提示词进行续写视频创作。
这里我用昨天晚上拍摄的一段视频做了个测试,完美的帮我实现了延时摄影的拍摄。


修改比例
文生视频多比例选择:文生视频新增9:16和1:1视频尺寸选择,提供更多创作可能。

你可以看到这个示例视频中的时间一致性非常好。
AI 视频中的时间一致性是指视频生成模型在时间上创建一致且逻辑连接的帧序列的能力。
这意味着模型应该能够保持一致的叙述,保持相同的场景或设置,并确保场景中的物体的动作和运动在时间上是连贯且合理的。
AI 视频的有多卷?
这话我都快说烂了,但还得提一嘴:AI 一天,人间十年。瞅瞅最近 AI 视频产品的进展,就知道这个领域竞争多激烈了。
17 号晚上,Runway 的 Gen-3 模型亮相了,看了宣传片,效果只能用炸裂来形容了。

就在同一天,Luma AI 也不甘示弱,推出了他们的 Dream Machine,真是梦想机器,就是价格有点让人望而却步。

你可能都没想到,可灵的文生视频才在 8 号发布,热乎劲儿还没过 3 天,就被其他 AI 模型给盖过去了。不过今天,因为“图生视频”功能一开,又重新回到了大众视野。

AI 视频领域的卷,也许没有比下面这张图更形象的了,老大的王座是以天为单位来交换的!

可灵与 Sora 的比较如何?
再简单介绍一下可灵,它是快手公司推出的一款新型 AI 视频模型,根据官方的介绍,可灵能够制作出长达 120 秒的视频,并且支持每秒 30 帧的流畅播放,分辨率达到 1080P,视频比例可以根据需求自由调整。更厉害的是,它能够准确深入地理解物理原理,准确模拟出复杂的运动场景。
但这里有一个有趣的事实:Sora 需要八个 NVIDIA A100 图形处理单元(GPU)运行超过三个小时才能生成一分钟的视频片段。一个 NVIDIA A100 的价格超过 1 万美元。因此,可灵可能需要双倍的计算能力来生成两分钟的视频。
模拟影响世界状态的动作是 AI 视频生成器面临的最大挑战之一。例如,画家可以在画布上留下新的笔触,这些笔触会随着时间的推移而保留,或者一个男人可以吃汉堡,留下咬痕。
Sora 和 可灵都能做到这一点。那为什么不把它们放在一起对比下呢?看看这个吃汉堡的视频案例:


可灵提示词:一个戴眼镜的中国男孩在快餐店内闭眼享受美味的芝士汉堡
嗯,这两个结果都令人惊叹。乍一看,很容易被迷惑,认为这些不是真实的视频。
但是仔细观察这些示例,你会发现 Sora 的结果在主题细节和光照条件方面更好,但是咬痕方面却差点意思。