有想法就能出片,LibTV 把导演经验做成了100多个可调用的Agent Skill

体验 LibTV 的全能视频 Agent Skill:从皮克斯动画到毛毡定格动画,选一个 Skill、讲清需求,Agent 就能自主拆解分镜、生成素材并合成成片,还能把自己摸索出的创作方法沉淀成可复用的个人 Skill。

艾康2026-07-142,579 字 · 7 分钟AI应用Skills

挪威被淘汰那天晚上,我朋友圈一半在心疼哈兰德,一半在发他偷水的表情包 🤣

这个 1 米 95、每天生吃牛心牛肝的男人,比赛打到一半溜到对面球门旁边,拿起门将的水瓶喝了一大口,喝完还一脸正经地问人家:「你喝不喝?」

门将:??

进完球也不狂奔庆祝,盘腿往草皮上一坐,闭眼打坐。

整个世界杯期间,哈兰德贡献的表情包比进球还多。

所以当我想做一条皮克斯风格的动画短片时,脑子里第一个冒出来的就是这位金发大个子。

一句话描述需求,中间只做了几个决策,最后拿到一条完整的成片👇

用的是 LibTV 最近上线的全能视频 Agent 功能。

案例一:3D 皮克斯动画

想要使用 LibTV 的 Agent Skill 功能非常简单,只需要先打开 LibTV。

链接直达:https://www.liblib.tv/

然后点击 LibTV 的 Skill Hub,在这里有一百多个 Skill,我选了「皮克斯动画故事」这个。

选完之后,我又输入了一些基础的创作要求:

Agent 收到需求之后,不是直接开始跑图。

而是先问了我四个问题:画面比例、目标时长、故事方向、要不要台词。

这一点就很棒,这几个问题确实是我没有提前考虑到的,在这样的交互过程中,就自动补齐了。

我选了 16:9 横屏、1 分钟 4 段、搞笑喜剧路线、纯视觉叙事不要台词。

参数确认完,Agent 开始生成角色立绘。

第一步是生成主角立绘,也就是全片的「角色锚点」,后面所有镜头里的哈兰德,都以这两张图为准。

然后 Agent 生成一份锚点清单,其中包含这个视频的一些关键点。

表情锚点、足球道具锚点、风格锚定、叙事大纲等等。

确认无误后,接下来的流程就是一路往后推了。

全程下来,我做了几个决定:确定故事方向及细节。其余全部是 LibTV 的全能视频 Agent 在推进。

最后拿到的成片是一条 45 秒的初剪成片,包含各个片段是如何生成出来的、各个节点是如何串联起来的。

节点的查看方式偏网状,还可以通过故事板以线性的方式进行查看。

点击顶部的「工作流」和「故事板」可以自由切换。

故事版看整体镜头节奏和叙事,节点工作流画布,则可以对任意镜头、素材、模型参数进行精细调整。

就比如说我发现在这个视频里,第三段 30 秒的画面这里,出现的是两个队伍的国旗竟然是一样的,这显然是不合理的。

以及还发现了一些其他的穿帮问题。

所以这里就可以针对相应的片段,用自然语言描述清楚具体问题,在故事版引用对应节点,让 Agent 帮我们去做精修。

完成之后,在工作流面板,可以看到对应的不同的版本。

可以点击视频合成下的「打开视频合成」按钮,在这里就能看到完整视频的合成素材。

类似剪映一样的剪辑面板,可以对其做一些基础的剪辑动作:添加字幕或添加转场。

如果没有其他问题,就可以选择导出下载到本地。

案例二:毛毡定格动画

做完哈兰德,我想换个完全不同的风格试试。

《小王子》是我很喜欢的书,小王子和狐狸「驯养」那一段,我一直觉得是全书最温柔的部分。这次我想把它做成毛毡定格动画。

这次用的 Skill 叫「手办动画」,同样也是在 LibTV 的 Skill Hub 里找到的。

输入完基础的需求之后,它只问了我两个参数(比例和清晰度),然后直接甩出完整方案:剧本、9 个镜头的分镜脚本、BGM 方向。

我直接一路「确认」,让 LibTV 自行去发挥。

前面都挺顺利,到了视频生成环节,出了个插曲。

5 个片段第一次全部生成失败。

原因是 prompt 里缺少场景锚点占位符。但我什么都没做,Agent 自己发现了问题,自己补上占位符,分两批重发,全部成功。

最后合成出来一条 40 秒的毛毡定格动画,配乐是钢片琴加木吉他,全程克制,结尾淡出。

虽然是初版,但很惊喜,因为质量挺高的,无论是画面质量还是背景音乐,整体都是非常契合这个视频。

整体很满意,但细节上还是有些瑕疵,比如我觉得第一个镜头里的 7-8 秒的小狐狸眼睛镜头太久了,看得有些瘆人。以及第二个镜头里的旁白缺少字幕。

虽然这些都是剪辑层面的问题,但都能交由 LibTV 的 Agent 去修复搞定。

LibTV 这次还更新了一个非常实用的功能,全球化制作。

也就是只需要生成一次,即可完成多语言字幕生成,双语字幕排布、字幕精修。

就比如上面这条视频,我想要同时生成一版英文旁白,双语字幕,就只需要跟 Agent 表达我的需求即可。

最后完成之后,确认没有问题,就可以导出成片了👇

换一个 Skill 等于换一位导演

回看前面两个案例,核心操作就是换了一个 Skill。

「皮克斯动画故事」出来的是 3D 卡通质感、夸张搞笑;「手办动画」出来的是毛毡温柔、安静克制。

同样的 Agent,挂不同的 Skill,调性完全不同。

LibTV Skill Hub 目前有 100 多个这样的 Skill:韦斯安德森电影美学、是枝裕和电影美学、古典武侠美学、高奢感 TVC、苏联粗野主义、宝岛浪潮电影美学……

可以通过这个链接直达:https://www.liblib.tv/skill

每一个 Skill 对应一类视频的创作方法论,包含了对应不同领域的审美、经验。

所以在我看来,LibTV 的 Skill Hub 更像一个「导演经验的开源社区」。

或者用我们更熟悉的话说:视频界的 GitHub。

案例三:创建一个自己的 Skill

前两个案例都是从 Skill Hub 挑现成的。

但如果你想做的风格,库里没有呢?

比如我想做一条黏土定格动画。视觉上是 Tim Burton 那种忧郁的精度,加上手作的温柔。

翻了翻,没有完全匹配的。

那就不用 Skill 了,直接跟 Agent 对话。把我想要的效果丢给它:实体黏土的指纹和塑形刀痕、蒙尘老工坊的低饱和配色。

它反问我:短片讲什么故事?

给了几个选项给我,我选择了其中一个:「一个小男孩与仙人掌的故事」

就这一句话,Agent 输出了完整的制作方案:三级锚点架构(全局风格锚 + 主角锚 + 场景锚),镜头的分镜表。

然后它分两批并行生成了全部视频片段,同步跑配乐,最后合成出了一条 30 秒的短片《一盆小仙人掌》。

到这里成片就算做完了👇 已经非常棒了

但更棒的是,我可以将上述过程(对话)提炼成一个 Skill,这样后面如果我需要再次创建同样的视频,就可以直接调用这个 Skill,而不用额外描述很多需求。

只需要在当前对话里,点击 Skill 按钮,然后点击创建里的「将本文对话转化为 Skill」即可。

它直接生成了一个属于我的个人 Skill:「黏土定格动画短片创作」。

点开一看,这次创作里摸索出来的东西全在里面:三级锚点架构、三幕叙事结构附情绪曲线与配乐映射、5 镜一批的并行调度策略、视觉约束标准、失败诊断清单、配乐情绪峰值对齐。

一次对话里摸索出来的创作方法,变成了一个可以反复调用的 Skill。

下次再想做黏土定格,不用从头跟 Agent 解释风格、不用重新描述流程。选这个 Skill,直接开始。

非常顺利,一句话就完成了一条 40 秒的初剪视频。

对了,在 LibTV 里,创建 Skill 还有另一种方式:直接写 markdown 文件上传。

如果你对自己的创作方法已经有清晰的认知,这条路更会直接。

如果你也沉淀出了自己的 Skill,可以发布到 Skill Hub。官方同步启动了一个创作激励计划,投了 1000 万。

核心就是「作品让人看见你,Skill 让人跟随你」。

写在最后

在这一次通过 LibTV Agent Skill 创作这几个视频的过程中,整体体验相对来说还是非常好的。

因为只需要讲清楚需求,Agent 就能够自主创建计划并推进整个过程,无论是出图、出视频、BGM、音效等等,基本上不需要人的额外参与。

不过目前生成时间不短,一条一分钟的成片,从开始对话到最终合成,整个过程大概需要 20 分钟到 40 分钟不等,取决于你改了多少次、失败重试了几轮。

抽卡也没有消失。只是从「人肉抽卡,失败了自己改 prompt 重来」变成了「Agent 帮你抽,失败了它自己诊断问题重试」。翻车的情况依然存在,但你不用盯着了。

但真正的变化是什么呢?

我不会写分镜脚本,不懂镜头语言,不知道什么叫三幕式结构。这些之前是门槛。

现在这些经验被写进了 Skill 里。我只需要有一个想法,选一个 Skill,剩下的 Agent 来推。

有想法就能出片,这件事在以前是做不到的。