
AI小白也能复刻?《你不卖有的是人卖》 AI视频拆解教程
用 LIBTV 复刻一支写实职场 AI 短片
《你不卖有的是人卖》人物一致性、镜头语言、分镜拆解与零基础复刻教程

图 1|影片开场先交代同一办公室、固定工位和四位核心角色。原字幕区域已裁除。
先说结论:能不能复刻?
能复刻出同类的“写实办公室群像+多角色对话+超现实反转”短片,但不能承诺一键得到与原片完全相同的人脸、动作和镜头。原因很明确:从成片可以确认平台、人物、场景、镜头组织和叙事结构,却看不到原作者使用的具体模型、Seed、提示词、角色参考图和返工次数。
本片适合用 LIBTV 做,核心不是让模型一次生成 3 分多钟,而是把它拆成角色资产、场景资产、分镜关键帧、短视频镜头、对白音频和最终剪辑。人物一致性靠资产复用,镜头连贯靠分镜设计,问题镜头靠“片段重拍”局部返工。
整体流程可复刻性:高。 LIBTV 当前公开入口具备图片生成、视频生成、音频生成、智能剪辑、导演台、片段重拍和口播视频。
人物一致性:中上。 四名角色的服装与配饰清晰,只要先建角色资产并反复引用,稳定性较高。
多人对话:中等。 同一画面让两个人同时说话容易错口型;原片主要依靠单人近景、反打和反应镜头规避。
巨大化高潮:中等。 外形可以锁定,但比例、接触关系和手部最容易崩,需要单独生成并预留重拍。
完全照搬原片:不可验证。 成片没有公开原模型和参数。本文给出的数值均标为“复刻建议”,不冒充作者原设置。
一、真实依据:哪些能确认,哪些不能确认
能够直接确认的内容:作者主页显示“LibTV 认证作者”;画面左上角持续出现 LibTV 标识;视频为 16:9 横屏、约 3 分 35 秒;主体发生在同一间黄昏办公室;主要角色是女职员、男性主管、灰色外星同事和幼童体型外星同事;后半段用角色巨大化完成反转。
LIBTV 官方当前页面可以确认:首页有“新建画布创作”“LibTV Agent”“视频生成”“图片生成”“音频生成”“智能剪辑”等入口,并公开展示“深度动作捕捉”“逐帧拉片”“导演台”“片段重拍”“口播视频”。官方公开项目的只读画布还展示了“角色”“场景”、编号分镜、图像节点、视频节点,以及“工作流 / 故事板”两种查看方式。
无法从成片确认的内容:原作者具体用了哪个视频模型、是否使用导演台、是否直接在 LIBTV 配音、各镜头时长参数、参考强度、Seed、首尾帧设置以及生成次数。因此,下文会用当前功能设计一条可执行路线,同时把模型名和时长写成建议值。
二、剧情和节奏拆解:3 分多钟为什么不拖
影片采用单场景职场讽刺结构,戏剧推进可以分为六段:
00:00—00:12,建立世界。 群像中景交代办公室、四个角色和人物关系,随后切女职员近景,让观众快速找到主要冲突对象。
00:12—00:40,抛出问题。 主管质疑业绩,手机等道具承担“展示数字、证明事实”的功能。
00:40—01:36,第一次争论。 群像、主管近景、幼童外星人近景与计算器特写交替,抽象的工资问题被转化成可见的数字和道具。
01:36—02:24,立场升级。 对白密度增加,人物从坐着讨论逐渐变成站立、靠近和手势对抗。
02:24—02:56,情绪顶点前的压迫。 更多面部近景和带前景的反打,主管与外星角色的体型反差被强化。
02:56—03:28,视觉高潮。 幼童外星人巨大化,镜头由常规中近景改成低机位与大全景,直接改写力量关系。
03:28—03:35,收尾。 回到人物反应和简短结论,不再加入新信息。
这类片子不是平均用力。前两分钟靠对白和反应镜头积累矛盾,最后半分钟才使用最昂贵、最不稳定的巨大化镜头。复刻时也应先完成对白主体,再单独攻克高潮。
三、人物一致性分析:原片是怎样把四个角色锁住的
1. 女职员:靠眼镜、发型和领口形成识别

图 2|透明浅粉眼镜、黑色高马尾、露肩米色针织衫和深色项链,是贯穿全片的四个身份锚点。
她在近景、侧面和群像中都保留相同的高马尾、刘海、透明浅粉镜框、米色露肩针织衫和深色粗项链。眼镜与领口在小画面中也清楚可见,所以比只写“年轻女职员”更容易保持一致。
2. 幼童外星人:配饰比脸更能稳定身份

图 3|大头比例、头顶墨镜、蓝色格纹衬衫、背带、棕色领巾和绿色挂件共同构成角色识别。
幼童外星人的固定信息最多:浅米色大头、巨大深色眼睛、头顶墨镜、蓝色格纹衬衫、棕色领巾、背带裤和绿色小挂件。高潮时体型改变,但服装、墨镜与挂件不变,因此观众会把巨大角色识别为同一个人,而不是新角色。
3. 男性主管和灰色外星人:用轮廓与职业服装区分
男性主管保持黑色西装、白衬衫、松开的深色领带、略显凌乱的黑发与浅胡茬;经常拿透明玻璃杯。灰色外星同事则保持细长体型、灰色皮肤、大型黑眼、白衬衫和深色领带。两者都穿职场服装,但头部轮廓完全不同,不会互相混淆。

图 4|群像镜头定期重新交代主管站立、三位员工位于工位一侧的空间关系。
人物一致性的真实优点:主要服装、眼镜、领带、墨镜和挂件没有明显跳变;人物年龄、体型和职业身份稳定;巨大化是有剧情目的的比例变化。
可见风险:多角色同框、手拿手机或计算器、人物互相接触时,都是生成最容易变形的区域。复刻时不要用一条长提示词同时控制四个人说话和做复杂动作。
四、场景、光线和道具连续性
整支片基本停留在同一现代开放式办公室。玻璃隔断、黑色工位、显示器、窗外城市天际线和黄昏阳光不断重复出现,形成稳定的场景锚点。色彩以暖橙色逆光为主,人物正面保留柔和补光,背景景深较浅。

图 5|手机插入镜头把抽象的工资、通勤或数字信息变成可见证据,同时给连续对白换气。
道具不是装饰,而是分镜节点:手机用于展示数字,计算器用于计算,奶盒用于动作停顿,玻璃杯固定主管身份。它们既推进剧情,也在对白太密时提供 2—3 秒的插入镜头。

图 6|计算器镜头属于插入特写:不需要复杂口型,生成成本低,却能加强节奏和讽刺感。
复刻时必须建立道具清单,并记录道具属于谁、在哪只手、何时出现。若上一镜手机在女职员右手,下一镜突然出现在左手或消失,就会破坏连续性。
五、镜头语言:这不是把同一张图反复动起来
1. 群像镜头负责空间,近景负责观点
开场和争论节点会回到群像中景或大全景,重新告诉观众四个人的位置;一旦某个人开始表达观点,就切到单人近景。这样既降低多人口型难度,又能让每句台词拥有明确的说话者。

图 7|主管近景用窗外夕阳和玻璃办公室作背景,景深较浅,保持与群像相同的光线方向。
2. 反打依靠视线方向,而不是频繁换场
多数对话镜头保持相对稳定的视线:主管向工位和下方看,员工与幼童外星人向相反方向回望。中间穿插双人镜头和群像镜头重新建立位置,因此即使连续反打,观众也不容易迷路。

图 8|双人镜头用于共享反应和关系变化,背景中的主管继续承担空间参照。
3. 动作升级后,镜头距离才升级
前半段主要是坐姿、近景和中景;冲突增强后,主管俯身、手指接近角色,画面出现更强的前后景关系。到了巨大化,镜头改为低机位广角和大全景,视觉尺度突然改变,构成真正的高潮。

图 9|主管靠近并指向角色,女职员在中间反应,幼童外星人位于画面另一侧,形成三层关系。

图 10|高潮用低机位、广角和强烈体型对比改变权力关系;服装和绿色挂件仍保持一致。
4. 可直接复用的分镜语法
一轮对白可以按“说话者近景 → 听者反应 → 双人关系镜头 → 道具插入 → 群像重建空间”循环。不要连续十几个单人正脸,也不要每句台词都换新场景。原片的丰富感来自同一场景中的景别和站位变化。
第 1 步|先写可生成的剧本,不要直接复制原片台词
先写一个同结构、但台词原创的练习项目。建议第一次做 60—90 秒,验证角色和口型后再扩到 3 分钟。剧本只保留一个场景、四个角色、一个核心冲突和一个视觉反转。
可直接发送给 LIBTV Agent 的项目需求:
制作一支 16:9、写实电影质感的职场讽刺短片,时长先控制在 60—90 秒。全部剧情发生在同一间现代玻璃办公室的黄昏。固定四个角色:年轻女职员、男性主管、灰色外星同事、幼童体型外星同事。剧情围绕“不合理的绩效要求”展开,前半段通过对话和手机、计算器等道具推进,结尾让幼童外星人突然巨大化,形成荒诞反转。先输出角色设定、场景设定、道具表和逐镜分镜,不要直接生成整片。
这一条指令符合 LIBTV 官方所述的自然语言 Agent 工作方式,但它是复刻练习方案,不是原作者提示词。先要求输出资产和分镜,可以在生成视频前发现角色描述或剧情逻辑问题。
第 2 步|新建画布,按“资产—分镜—视频—故事板”组织
当前首页操作路径:进入 LIBTV → 点击“新建画布创作”。也可以从首页进入“LibTV Agent”,用自然语言建立项目。进入画布后,为四个角色、办公室场景、手机、计算器、奶盒和玻璃杯分别建立或上传资产。
官方公开项目的只读画布显示,角色和场景素材放在画布一侧,编号分镜横向排列,参考图通过连线进入视频节点;“工作流”用于查看节点关系,“故事板”用于查看音频、文本、图片和视频素材。自己的项目可以照这个结构整理,而不必把所有文件堆在一个节点里。
建议命名:C01_女职员、C02_主管、C03_灰色外星人、C04_幼童外星人、S01_黄昏办公室、P01_手机。镜头使用 SH01_群像建立、SH02_女职员近景 这样的编号。
第 3 步|先生成角色和场景资产,锁住可见特征
全片公共风格锚点:
写实电影级职场讽刺短片,现代开放式玻璃办公室,黄昏金色逆光,窗外城市天际线,黑色工位与显示器,浅景深,真实材质与肤质,暖橙色主调,克制表演,16:9。
角色设定可以直接使用下面四段,再按生成结果微调:
C01 女职员:年轻东亚女性,黑色高马尾与自然刘海,透明浅粉大框眼镜,米色露肩针织上衣,深色粗项链,身形纤细,表情从克制到坚定。
C02 男性主管:30 多岁东亚男性,略凌乱的黑发,浅胡茬,黑色西装、白衬衫、松开的深色领带,经常拿透明玻璃杯,神态强势疲惫。
C03 灰色外星同事:细长成年体型,灰色皮肤,巨大黑色杏仁眼,白衬衫与深色领带,安静坐在工位。
C04 幼童外星同事:幼童体型,浅米色大头和巨大深色眼睛,头顶圆形墨镜,蓝色格纹衬衫、棕色领巾、深色背带裤,腰侧绿色小挂件。
场景资产提示词:
同一间现代开放式办公室,整面落地玻璃窗,窗外城市天际线,黄昏金色阳光从画面左后方进入;黑色办公桌、显示器、键盘、文件和笔筒位置固定,玻璃会议隔断在后方,写实电影布光,16:9,无人物。
每个角色至少保留正面、左前 30 度、右前 30 度和全身参考。选图标准不是单张最漂亮,而是服装结构清楚、双手正常、配饰完整、多个角度仍像同一个人。
第 4 步|把 3 分钟故事拆成短镜头,而不是一次生成
复刻完整版可以规划约 40—55 个镜头;这是依据成片频繁的 2—5 秒切换得出的工作量级,并非原作者公开镜头数。零基础先完成下面 12 个核心镜头:
SH01 群像中景,4—5 秒:交代四人和工位。
SH02 女职员近景,3—4 秒:第一句回应。
SH03 主管过肩中近景,4 秒:提出要求。
SH04 手机插入特写,2—3 秒:显示数字。
SH05 幼童外星人反应近景,3 秒:不说话或一句短台词。
SH06 群像中景,5 秒:重新建立站位。
SH07 主管近景,4 秒:立场升级。
SH08 计算器插入特写,2—3 秒:给对白换气。
SH09 女职员与幼童外星人双人镜头,4—5 秒:共享反应。
SH10 三人对抗中景,4 秒:主管俯身靠近。
SH11 低机位巨大化镜头,5—6 秒:只做一个主要动作。
SH12 大全景揭示,5—6 秒:巨人、主管和女职员同框。
完整版本不是把单镜头拉长,而是在 SH02—SH10 之间增加更多反打、反应、道具和群像镜头。每新增一句台词,都要先决定由哪个景别承担。
第 5 步|先生成关键帧,再用图生视频逐镜头运动
首页可进入“图片生成”制作关键帧,再进入“视频生成”或当前可用的视频模型。当前页面展示 Seedance 2.5,但原片具体模型无法确认;如果你的账号显示不同模型,以当前列表为准。
女职员近景关键帧:
引用 C01 女职员与 S01 黄昏办公室。中近景,女职员坐在工位,转头看向画面左侧的主管,透明浅粉眼镜与米色露肩针织衫完整可见,窗外夕阳逆光,背景显示器轻微虚化,克制但不服气的表情,16:9。
视频运动提示词:
镜头非常缓慢地推近,人物先看向左侧,停顿后说一句短台词,眼神稳定,头部只有轻微转动,手不入镜,背景和光线保持不变。
主管近景关键帧:
引用 C02 男性主管与 S01 黄昏办公室。中近景,主管站在工位旁,黑色西装和松开的领带清楚,右手拿透明玻璃杯,微微低头看向坐着的员工,夕阳从背后勾边,16:9。
幼童外星人反应镜头:
引用 C04 幼童外星同事与 S01 黄昏办公室。近景,幼童外星人站在桌面文件旁,头顶墨镜、蓝格衬衫、背带和绿色挂件完整,抬头看向画面右侧,先沉默再轻微皱眉,16:9。
每个镜头先生成静态关键帧并验收,再做视频。静态图里已经出现错脸、错手或错道具,视频只会把问题放大。
第 6 步|对白镜头用“单人说话”,多人画面只做反应
LIBTV 当前首页提供“口播视频”和“音频生成”。对话镜头建议一条音频对应一个说话者近景;双人或群像镜头只让一个人说话,其他人做轻微反应。这样比让四个人在同一画面轮流开口稳定得多。
操作顺序:先为四个角色确定不同声线;按分镜导出每句 2—6 秒的音频;在口播或支持音频驱动的视频功能中上传对应角色图和该句音频;生成后检查爆破音、闭口音和停顿。如果口型正确但手部崩坏,保留脸部版本,在剪辑中用更短的入点和出点避开手部。
音频没有公开原参数,所以不要声称某一种音色就是原声。复刻目标是四名角色可分辨:女职员清晰克制,主管偏低沉强势,灰色外星人平静,幼童外星人音色较轻但语气坚定。
第 7 步|巨大化镜头单独制作,先锁身份再做比例

图 11|巨大角色仍保留墨镜、格纹衬衫、背带、领巾和绿色挂件;办公室与城市背景继续承担尺度参照。
巨大化最容易失败的不是“变大”,而是变大后不像同一个角色。先使用 C04 角色资产生成一张巨大版本关键帧,要求服装和配饰完全不变,再做 5—6 秒视频。
关键帧提示词:
引用 C04 幼童外星同事与 S01 黄昏办公室。同一个幼童外星人突然变成数米高,头顶墨镜、蓝色格纹衬衫、棕色领巾、背带裤和绿色挂件全部保持不变;低机位广角,巨大的身体俯视主管,女职员在后方震惊,玻璃办公室和城市天际线提供尺度参照,黄昏逆光,16:9。
运动提示词:
低机位镜头轻微后退,巨大外星人缓慢俯身靠近主管,只做一次俯身动作;主管向后退半步,女职员保持震惊,所有角色位置和服装稳定,不新增人物。
若身体比例或接触关系崩坏,使用“片段重拍”只重做这一镜,不要重新生成前面两分钟。必要时打开“导演台”先固定人物站位和机位,再回到视频生成;这是当前官方公开的可用功能,但是否为原片所用无法确认。
第 8 步|用智能剪辑完成声音、字幕和最终验收
进入“智能剪辑”,按镜头编号依次排列。先放完整对白和环境底噪,再对齐画面;最后添加字幕、转场和音乐。对白镜头之间优先直接切,插入手机、计算器等道具镜头时可以保留上一句声音延续,让剪辑更自然。
同一场景不要套多个颜色滤镜。统一曝光、色温和对比度,保持黄昏暖光;如果某镜头背景偏蓝或主光方向相反,优先重生成而不是靠重度调色硬救。
最终检查分四遍:第一遍只看人物脸、服装和配饰;第二遍只看视线方向、站位和道具左右手;第三遍只听对白、口型和环境声;第四遍检查 16:9 画幅、字幕安全区和高潮镜头是否真的比前面更有尺度。
六、常见失败与针对性修复
同一角色每镜换脸:没有重复引用角色资产,或角色描述被简写。固定使用同一角色节点;提示词里重复不可替换的眼镜、发型、服装和配饰。
多人口型错位:一个镜头安排多人轮流说话。拆成单人近景和反应镜头,每镜只驱动一个说话者。
办公室像换了地方:每镜重新描述场景。引用同一场景资产,并固定窗户方向、工位位置、夕阳方向和主要色温。
反打方向混乱:没有先画平面站位。规定主管位于员工一侧,角色视线相对;每隔数个近景插入群像镜头重新建立空间。
手机、杯子突然换手:没有道具连续表。给每个道具写“所属角色、左右手、出现镜头”,错误镜头优先重拍。
动作夸张、手部崩坏:单镜头动作过多。保留一个主要动作,例如“俯身”或“抬头”,删掉同步挥手、转身和走动。
巨大化后不像原角色:只写了“巨人”,没有继续引用 C04。把全部配饰写回提示词,并用原角色图作为参考。
片子很长但没有高潮:所有镜头景别相同。前半段控制在中近景,高潮才使用低机位广角和大全景。
七、复刻评测:真实能做到什么程度
可以较稳定做到:同一办公室的暖色电影感、四个固定角色、单人对话近景、道具插入镜头、群像与反打交替,以及结尾巨大化的叙事结构。
需要多轮生成:四人同框时的手部与遮挡、角色互相接触、拿手机和计算器、巨大角色与真人的尺度关系、长对白口型。实际项目应为重点镜头保留 2—4 个候选版本。
不应承诺:与原片完全相同的人脸、镜头运动、台词节奏或模型质感。没有原作者的角色源图、提示词、Seed 和模型记录,就只能复刻方法与视觉逻辑。
最稳的学习路线:先做 SH01、SH02、SH05、SH06 和 SH11 五个镜头。它们分别验证场景、真人角色、非人角色、多角色一致性和巨大化。五镜都通过,再扩写完整对白;如果这五镜不稳定,继续增加镜头只会放大返工量。
来源与版本说明
功能与工作流核对:LIBTV 官方首页、LIBTV 官方产品介绍、LIBTV 官方 Agent Skill。产品入口、模型列表、积分和分辨率会更新,以实际页面为准。
本文使用的影片截图仅用于分析镜头、人物和制作方法;转载、改编或商业使用原视频及其中素材前,应另行确认权利。
原片地址:https://www.douyin.com/video/7684162687378831717
关于作者:亦恬(抖音号 Blue_blue666)
24岁 LibTV认证作者/Seko超级创作者 欢迎来到亦恬、清风(
作者主页:https://www.douyin.com/user/MS4wLjABAAAAUFCN6uH0NQFLAnf1-Y2Su3wgUUQ653z0WdAsE409i1M
物界前沿