cxuan-ai-labs

AI 生成与多媒体 ·

LibTV

以前我觉得做个视频,得先花 3 天学 Stable Diffusion,再花 2 天学剪辑。学完之后,热情都没了。

进入动态阅读模式 ↗

以前我觉得做个视频,得先花 3 天学 Stable Diffusion,再花 2 天学剪辑。学完之后,热情都没了。

但这次,我只花了30分钟吃早饭的时间,就搞定了。全靠这个叫 LibTV 的东西。

不过说实话,光说快没什么意思,因为市面上声称一键生成的工具太多了。

我体验过一些视频平台,我发现做视频创作这事儿,最终还是会回到生成器、画布和节点上面,因为这三个点才是灵魂。

虽然现在视频创作不再是只有专业人士才能完成的事情,但流程基本上还是那一套:写剧本、镜头编排、角色统一、画面返工,而且只要其中一个小细节修改之后,就可能会影响整个工作流。

Agent 很容易完成第一步,但真正困难的是把视频完整交付。

我体验了一圈,我认为 LibTV 在整个流程上做的非常好。

它大幅的降低了视频创作的门槛,接下来我会跟大家聊聊我为啥这么说。

这是 LibTV 的官网,可以直达 https://www.liblib.tv/


在视频创作这块,我跟大家一样都是小白,所以我会从刚开始的选题开始到最后的生成成片的过程,给大家分享一下,希望能够让大家更好的了解这个工具。

最近处于世界杯期间,刚刚法国和西班牙都进入了四强,这是一场焦点比赛。所以我的第一个想法就是做一个法国和西班牙的比赛预告片。

我先大致描述了一下自己想要的风格,然后用 LibTV 的 Agent 模式会给我许多风格来进行选择,我选择了电影史诗级风格,结合了一下两队的历史背景,再上传了两对几个核心球员的肖像,开始生成制作脚本。

在整个体验过程中,我发现有 LibTV 有两种模式,一种是工作流、一种是故事板。

工作流好理解,就是从创作资产 -> 生成分镜视频 -> 合成最终视频的一整套流程。

image-20260712111742456

故事板是按照这个视频创作的故事背景来铺开,相当于直接编辑对应分镜的故事剧本了,我觉得这个模式非常方便。

image-20260712113242744

如果你对某个资产、分镜不满意,可以直接对其进行修改,而且方式非常多样化,有机位可以做多角度,还可以做调光,剧情推演和场景设定。

image-20260712112327377

如果分镜不满意,可以修改分镜,支持添加非常多的特效和运镜。

image-20260712112859387

image-20260712112846729

给大家看下我的整个工作流程:

这个 LibTV 的这个 Agent,能够基于多模态理解,从任务规划、模型调度和工作流画布进行联动,它能够将文本、图片、视频、音频拆解为剧本、镜头、画面和剪辑任务,并且完成端到端的视频生成。

给大家看下我完整的视频:

做到这里,我对 LibTV 有了第一层感触:

全能 Agent 先把我的想法拆成剧本、角色、场景和镜头,再安排后面的生成任务。我不用一上来就研究每一步该选哪个模型,这对小白来说很友好。

工作流让我知道每一步走到了哪里,故事板让我从整个故事的角度看每个分镜。

两种模式可以随时切换,一个管制作流程,一个管叙事风格。

如果某个球员的肖像、机位或者运镜有问题,我可以回到对应资产和分镜单独修改,不用把整个视频推倒重来。背后的图片、视频和声音模型,也可以直接在同一个项目里调度。

当然,视频也不可能每次都一遍过。像球员一致性、分镜衔接这些地方,我也返工了几次。但是能定位到具体镜头改,和重新从头做一遍,完全是两回事。

我觉得 LibTV 降低的,是把一条视频做完的难度。


你以为这就完了吗,不是的,上面只是我测试了一下 LibTV 的全能 Agent 功能,接下来给大家看一个东西。

我刚开始看到这么多的 skills 也是被惊艳到了,现在很多某音和某书上的小短剧,估计都是这里来的,这些 skills 库简直太丰富了。

果然 LibTV 拥有行业最丰富的专业视频创作者生态。

我估计这些 skills ,都是各行各业的大佬沉淀下来的创意资产,比如广告导演、MV 导演、短剧团队、品牌创意、自媒体创业等领域,这些 skills 沉淀下来,我们可以直接复用就行了。

于是我选好了一个 skill 来尝鲜了一下。

现在我要用无厘头喜剧的 skill 制作一个故事剧本。

image-20260713162812015

这个 skill 会根据 Prompt 向我询问剧本内容的偏好的形式。

image-20260713162944740

它给我想了一个具有反差萌的故事剧本,剧本的标题叫 《最强面试官》

大致意思是:一个穿着精致套装、气场全开的"资深HR面试官",对着紧张的应聘者步步施压,台词犀利、眼神凌厉……结尾一个硬切,揭示她其实是……刚入职第一天的实习生,自己的工牌还写错了字。

这个 skill 给我生成了四段分镜 Prompt,我的整个工作流如下:

最终成片如下:

这个案例做完之后,我也大概理解了 Skill 对于视频创作的价值。

说白了,Skill 就是把别人已经验证过的创作方法保存下来。我不需要先学会怎么当喜剧编剧,也不需要从空白 Prompt 开始试,它会先问清楚我的偏好,再给出剧本和分镜 Prompt。

对于广告、短剧、MV 和自媒体视频这种经常重复出现的创作需求,这个方式还是挺省事的。


除了选用已有的 skill hub 中的 skill 之外,你也可以自己创建 skill ,这才是 LibTV 生态如此繁荣的原因,自己创建自己的 skill 来成片,我感觉很有意思,所以我也创建了一下自己的 skill 。

image-20260713174036238

点击创建 skill 按钮来创建自己的 skill 。

我创建了一条自己的 skill ,主题大概是: 把一句日常经历、心情或温暖想法,创作成一条具有完整起承转合的治愈系微缩城市横屏短片。让小精灵、拟人动物或生活物件承担情绪表达,用轻奇幻方式呈现普通生活中的善意、陪伴和小惊喜。

(突然我这个老登顿时也有了一颗软萌的心)

image-20260713180000220

由于这个 skill 还没有封面,于是我就直接用这个 skill 来做了一个封面视频预览。

下面是成片:

我把这个成片上传之后,就把这个 skill 提交审核了。

image-20260713183236697

下面我就用这个 skill 来做一个完整的 1min 的视频,看看效果如何。

image-20260713190327396

我做了一个机器人小短片,名字叫《家有 ROLO》,想象一下,你的家里有一个叫做 ROLO 的机器人,它能够帮你做许多事情,帮你打扫卫生,帮你关灯,给你做早餐,甚至你淋雨回家之后,它都会等着你,为你送上毛巾和换洗的衣物,一直陪伴着你,你是不是会感觉到这个机器人,仿佛有了人的温度?

这是我这个片子想要传达出来的内涵。

给大家看下我的制作过程。

最终的成片效果如下。

从创建 Skill、制作封面、提交审核,到最后调用自己的 Skill 做出一条完整的一分钟视频,这条线我算是完整跑通了。

以前我们讲 Prompt,更多时候是在保存一段文字。但是 Skill 保存的是一套做事的方法。下次我再想做治愈系微缩城市短片,不用重新解释一遍角色、美术、节奏和故事结构,直接调用自己的 Skill 就行了。

这是 skill 对于内容创作最好的诠释,LibTV 在这块做的很到位。


三个案例做完,我对 LibTV 了解的也比较清楚了。

世界杯预告片让我体验了全能 Agent、工作流和故事板;《最强面试官》让我直接复用了别人沉淀好的 Skill;《家有 ROLO》则是我自己创建 Skill,再用它完成成片。

这三个案例刚好对应了三种完全不同的创作方式。

你可以把自己的想法直接交给 Agent,让它拆剧本、准备资产、生成分镜,再合成视频。

你也可以从 Skill Hub 里找一个成熟方法,跟着它一步一步做。

如果你已经有自己的创作习惯,还可以把这套习惯做成 Skill,下一次直接复用。

在我看来,LibTV 最有价值的地方,就是把 Agent、工作流、故事板和 Skill 放在一起,让一个想法能够落地成片。

当然,输入一句话并不能保证所有镜头一次成功。角色一致性、镜头衔接和最后的审美判断,还是需要人来把关。

但是对于我这种视频创作小白来说,以前看到写剧本、做分镜、准备素材、选模型和剪成片这一大串流程,基本就已经想放弃了。现在我至少可以先做起来,遇到问题再回到具体资产和镜头修改。

工具把门槛降下来,最后成片好不好,依然取决于你想表达什么。

如果你平时会做广告、短剧、MV、电商视频或者自媒体内容,可以自己去体验一下:https://www.liblib.tv/