AI 生成与多媒体 ·
LibTV
以前我觉得做个视频,得先花 3 天学 Stable Diffusion,再花 2 天学剪辑。学完之后,热情都没了。
以前我觉得做个视频,得先花 3 天学 Stable Diffusion,再花 2 天学剪辑。学完之后,热情都没了。
但这次,我只花了30分钟吃早饭的时间,就搞定了。全靠这个叫 LibTV 的东西。
不过说实话,光说快没什么意思,因为市面上声称一键生成的工具太多了。
我体验过一些视频平台,我发现做视频创作这事儿,最终还是会回到生成器、画布和节点上面,因为这三个点才是灵魂。
虽然现在视频创作不再是只有专业人士才能完成的事情,但流程基本上还是那一套:写剧本、镜头编排、角色统一、画面返工,而且只要其中一个小细节修改之后,就可能会影响整个工作流。
Agent 很容易完成第一步,但真正困难的是把视频完整交付。
我体验了一圈,我认为 LibTV 在整个流程上做的非常好。
它大幅的降低了视频创作的门槛,接下来我会跟大家聊聊我为啥这么说。
这是 LibTV 的官网,可以直达 https://www.liblib.tv/
在视频创作这块,我跟大家一样都是小白,所以我会从刚开始的选题开始到最后的生成成片的过程,给大家分享一下,希望能够让大家更好的了解这个工具。
最近处于世界杯期间,刚刚法国和西班牙都进入了四强,这是一场焦点比赛。所以我的第一个想法就是做一个法国和西班牙的比赛预告片。
我先大致描述了一下自己想要的风格,然后用 LibTV 的 Agent 模式会给我许多风格来进行选择,我选择了电影史诗级风格,结合了一下两队的历史背景,再上传了两对几个核心球员的肖像,开始生成制作脚本。
在整个体验过程中,我发现有 LibTV 有两种模式,一种是工作流、一种是故事板。
工作流好理解,就是从创作资产 -> 生成分镜视频 -> 合成最终视频的一整套流程。

故事板是按照这个视频创作的故事背景来铺开,相当于直接编辑对应分镜的故事剧本了,我觉得这个模式非常方便。

如果你对某个资产、分镜不满意,可以直接对其进行修改,而且方式非常多样化,有机位可以做多角度,还可以做调光,剧情推演和场景设定。

如果分镜不满意,可以修改分镜,支持添加非常多的特效和运镜。


给大家看下我的整个工作流程:
这个 LibTV 的这个 Agent,能够基于多模态理解,从任务规划、模型调度和工作流画布进行联动,它能够将文本、图片、视频、音频拆解为剧本、镜头、画面和剪辑任务,并且完成端到端的视频生成。
给大家看下我完整的视频:
做到这里,我对 LibTV 有了第一层感触:
全能 Agent 先把我的想法拆成剧本、角色、场景和镜头,再安排后面的生成任务。我不用一上来就研究每一步该选哪个模型,这对小白来说很友好。
工作流让我知道每一步走到了哪里,故事板让我从整个故事的角度看每个分镜。
两种模式可以随时切换,一个管制作流程,一个管叙事风格。
如果某个球员的肖像、机位或者运镜有问题,我可以回到对应资产和分镜单独修改,不用把整个视频推倒重来。背后的图片、视频和声音模型,也可以直接在同一个项目里调度。
当然,视频也不可能每次都一遍过。像球员一致性、分镜衔接这些地方,我也返工了几次。但是能定位到具体镜头改,和重新从头做一遍,完全是两回事。
我觉得 LibTV 降低的,是把一条视频做完的难度。
你以为这就完了吗,不是的,上面只是我测试了一下 LibTV 的全能 Agent 功能,接下来给大家看一个东西。
我刚开始看到这么多的 skills 也是被惊艳到了,现在很多某音和某书上的小短剧,估计都是这里来的,这些 skills 库简直太丰富了。
果然 LibTV 拥有行业最丰富的专业视频创作者生态。
我估计这些 skills ,都是各行各业的大佬沉淀下来的创意资产,比如广告导演、MV 导演、短剧团队、品牌创意、自媒体创业等领域,这些 skills 沉淀下来,我们可以直接复用就行了。
于是我选好了一个 skill 来尝鲜了一下。
现在我要用无厘头喜剧的 skill 制作一个故事剧本。

这个 skill 会根据 Prompt 向我询问剧本内容的偏好的形式。

它给我想了一个具有反差萌的故事剧本,剧本的标题叫 《最强面试官》。
大致意思是:一个穿着精致套装、气场全开的"资深HR面试官",对着紧张的应聘者步步施压,台词犀利、眼神凌厉……结尾一个硬切,揭示她其实是……刚入职第一天的实习生,自己的工牌还写错了字。
这个 skill 给我生成了四段分镜 Prompt,我的整个工作流如下:
最终成片如下:
这个案例做完之后,我也大概理解了 Skill 对于视频创作的价值。
说白了,Skill 就是把别人已经验证过的创作方法保存下来。我不需要先学会怎么当喜剧编剧,也不需要从空白 Prompt 开始试,它会先问清楚我的偏好,再给出剧本和分镜 Prompt。
对于广告、短剧、MV 和自媒体视频这种经常重复出现的创作需求,这个方式还是挺省事的。
除了选用已有的 skill hub 中的 skill 之外,你也可以自己创建 skill ,这才是 LibTV 生态如此繁荣的原因,自己创建自己的 skill 来成片,我感觉很有意思,所以我也创建了一下自己的 skill 。

点击创建 skill 按钮来创建自己的 skill 。
我创建了一条自己的 skill ,主题大概是: 把一句日常经历、心情或温暖想法,创作成一条具有完整起承转合的治愈系微缩城市横屏短片。让小精灵、拟人动物或生活物件承担情绪表达,用轻奇幻方式呈现普通生活中的善意、陪伴和小惊喜。
(突然我这个老登顿时也有了一颗软萌的心)

由于这个 skill 还没有封面,于是我就直接用这个 skill 来做了一个封面视频预览。
下面是成片:
我把这个成片上传之后,就把这个 skill 提交审核了。

下面我就用这个 skill 来做一个完整的 1min 的视频,看看效果如何。

我做了一个机器人小短片,名字叫《家有 ROLO》,想象一下,你的家里有一个叫做 ROLO 的机器人,它能够帮你做许多事情,帮你打扫卫生,帮你关灯,给你做早餐,甚至你淋雨回家之后,它都会等着你,为你送上毛巾和换洗的衣物,一直陪伴着你,你是不是会感觉到这个机器人,仿佛有了人的温度?
这是我这个片子想要传达出来的内涵。
给大家看下我的制作过程。
最终的成片效果如下。
从创建 Skill、制作封面、提交审核,到最后调用自己的 Skill 做出一条完整的一分钟视频,这条线我算是完整跑通了。
以前我们讲 Prompt,更多时候是在保存一段文字。但是 Skill 保存的是一套做事的方法。下次我再想做治愈系微缩城市短片,不用重新解释一遍角色、美术、节奏和故事结构,直接调用自己的 Skill 就行了。
这是 skill 对于内容创作最好的诠释,LibTV 在这块做的很到位。
三个案例做完,我对 LibTV 了解的也比较清楚了。
世界杯预告片让我体验了全能 Agent、工作流和故事板;《最强面试官》让我直接复用了别人沉淀好的 Skill;《家有 ROLO》则是我自己创建 Skill,再用它完成成片。
这三个案例刚好对应了三种完全不同的创作方式。
你可以把自己的想法直接交给 Agent,让它拆剧本、准备资产、生成分镜,再合成视频。
你也可以从 Skill Hub 里找一个成熟方法,跟着它一步一步做。
如果你已经有自己的创作习惯,还可以把这套习惯做成 Skill,下一次直接复用。
在我看来,LibTV 最有价值的地方,就是把 Agent、工作流、故事板和 Skill 放在一起,让一个想法能够落地成片。
当然,输入一句话并不能保证所有镜头一次成功。角色一致性、镜头衔接和最后的审美判断,还是需要人来把关。
但是对于我这种视频创作小白来说,以前看到写剧本、做分镜、准备素材、选模型和剪成片这一大串流程,基本就已经想放弃了。现在我至少可以先做起来,遇到问题再回到具体资产和镜头修改。
工具把门槛降下来,最后成片好不好,依然取决于你想表达什么。
如果你平时会做广告、短剧、MV、电商视频或者自媒体内容,可以自己去体验一下:https://www.liblib.tv/