文章摘要
近期上线的LibTV针对AI视频创作中原片直接生成复刻动作运镜偏差大的痛点,推出深度动作捕捉功能,可一键提取原片深度视频,精准复刻动作与运镜,提取结果可复用;同时新增智能口播剪辑功能,可一键完成口播全流程剪辑,提升创作效率。

在AI视频创作中,想要复刻经典镜头的动作与运镜一直是个难题。直接投喂原片给AI模型,往往会得到偏差严重的结果,要么站位错误,要么动作节奏完全走样,甚至出现穿帮问题。而近期上线的 LibTV,推出了「深度动作捕捉」功能,能轻松解决这个痛点。

我们可以通过两组生成效果直观看到差异:使用同一角色、同一提示词和同一 Seedance 2.5 模型,一组直接参考原片生成,另一组先将原片转换为深度视频再生成。前者开头角色站在原地不动,后仰动作的角度和节奏都和原片不符,还出现了明显穿帮;后者则完美复刻了原片的动作细节,连镜头环绕的节奏都丝毫不差,比如经典的“奥特曼躲子弹”镜头,生成效果完全符合预期。

所谓深度视频,也叫灰模,就是将原视频剥离掉多余的视觉元素,只保留角色的白色剪影和按远近区分灰阶的背景——每个像素的亮度代表距离镜头的远近,近的更亮,远的更暗,相当于给角色换了一个只负责走位和动作的“替身”。

以往想要生成这类深度视频,需要自行编写脚本、搭建复杂的工作流,步骤繁琐耗时。而这款工具将这个功能集成在了画布工具栏中,只需选中一段视频,点击一次按钮,就能一键提取深度视频,让普通用户也能轻松获得大师级的动作捕捉效果。


使用起来非常简单:将参考视频上传到画布后选中它,在顶部工具栏的「逐帧拉片」下拉菜单中选择最后一项「深度动作捕捉」。该节点只有一个清晰度参数,480P适合快速预览,720P则能获得更好的效果。选择720P后点击确认提取,工具就会自动生成对应的深度视频。

生成的深度视频效果精准,不仅能完整捕捉角色的后仰动作、飘动的风衣下摆,连镜头环绕时背景的旋转效果都能完美还原,甚至远处的人物位置也能准确保留。之后就可以用这个深度视频作为参考,输入角色提示词一键生成AI视频。

提取出的深度视频还可以反复复用,同一段动作和运镜,可以替换任意角色,实现快速创作不同内容的需求,无需重新捕捉动作。


除了深度动作捕捉,这款工具还同步上线了智能口播剪辑功能,直击自媒体创作者的痛点。当下“怼脸口播加插入画面”是主流内容形式,但口播视频的剪辑流程繁琐:需要对照逐字稿删减卡壳和口水词,再手动插入对应画面、添加字幕和音效,想要日更难度极大。

智能口播剪辑功能可以一键完成所有流程:在画布中添加「智能剪辑」节点并选择「口播视频」,将素材拖入后,AI剪辑Agent会自动理解内容,自动删减冗余部分,根据口播内容自动切换对应的画面素材,十几段素材只需要几分钟就能完成剪辑出片,大幅提升创作效率。


到2026年,AI视频赛道的竞争早已不再局限于画面质量,而是转向了创作的可控性。从逐帧拉片学习镜头语言,到局部片段重拍,再到导演台控制3D空间,加上这次的深度动作捕捉功能,LibTV 将动作、运镜和空间关系的创作控制权完全交到了用户手中,只需选中视频、提取深度视频、生成AI内容三步,就能轻松完成高质量的AI视频创作。

以上内容不代表本平台立场,仅供读者参考