之前写过很多次了,我把Lovart作为我的一人公司品牌部,基本上公众号、B站、小红书大部分封面图的设计都交给了它。
但是在AI视频的制作上,我尝试了不少工具,遇到的最大难题之一是,虽然视频生成模型一直在迭代,但是因为我的想法我的需求一直在变,所以没有特别固定的工作流沉淀下来。每次都会根据产品项目的需求差异,做出风格迥异的内容来。
今天,看到LibTV 更新到 1.5之后,有很多新特性似乎可以让这件事变得不一样了,最最核心的,它可以让我的一人公司品牌部多两个固定员工了:一个演员,一个导演。
尤其是,它似乎能让我的品牌部雇佣一个长期固定的「演员」了。
你可以看下我让这个演员拍的Huashu品牌的可乐、咖啡,以及小猫补光灯的TVC广告👇通过这个短片你大概就能理解我在说什么了。
接下来,我来一步步介绍下,我具体是怎么做出来的,以及...更重要的,为什么要这么做。
一、演员:怎么让AI记住一张脸?
入口在画布左侧的「人像造型室」,点进去是一具线框白模,底下一个输入框,让你描述她长什么样。我写了这么一段:
青年女性,东亚面孔,二十五六岁。鹅蛋脸,皮肤白净通透,眼型细长微微下垂,眉形柔和平直,唇色很淡。气质安静清透,像从中国工笔画里走出来的人,不施浓妆。黑色长直发及肩下,右侧鬓边有一缕亚麻色挑染。左眼下方有一颗小泪痣。鼻梁和颧骨上有一层很淡的雀斑。上身米白色棉麻衬衫,质地柔软。
这里有个我特意埋的心眼:泪痣、雀斑、挑染,这三个细节算是我给她留的签名吧。一张过于标准的脸,换个场景就认不出是不是同一个人,因为它本来就没有记忆点。泪痣在不在、位置对不对,肉眼就能验。这跟我以前测AI编程工具读没读全文件,往一千九百多行的字幕里随机塞几句「花生最喜欢的运动是网球」大概是一个道理,先埋一个它糊弄不过去的东西,后面的测试才好判断它做得怎么样。
生成花了两三分钟,扣了14积分。三样全中,挑染在右鬓,泪痣在左眼下方,雀斑淡铺在鼻梁和颧骨上。
出图后直接进精修界面,脸部、身材、服装都能调,还有一项「音色音调」,这演员连声音都能给。⚠️ 皮肤那组底下有个「祛斑祛痘」开关,千万别开,一开雀斑就没了,费劲埋的特征当场作废。
起名叫小满,存进「我的角色库」,随即派生出头像、全身图、九宫格表情、九视角转面板。你雇个真人模特,拿到手的大概也就是这些,这套花了58积分,不到十分钟。
当然,纯好看的维度也意义不大,关键还是这套功能和工作模式到底有没有用,怎么体现效果。我特意做了两组对照。
第一组,变量只有一个:挂不挂这张角色卡。同一句提示词、同一个模型,各跑四张。
上排不挂卡,四张图四个人,长得全都不一样。同一句话跑四次,它给了我四个演员,这基本上就是我过去一年做AI视频的常态。下排挂上卡,四张里三张是她,放大看泪痣位置和挑染方向都对得上。
第二张翻车了,短发波波头,面部也不对。我留着没删,四张中三就是它现在真实的水平,有瑕疵,但稳定性算是非常不错了。
第二组,角色卡不动,把她换成深灰西装、浓妆红唇、头发扎起来。
右边那张保住了,左边那张挑染丢了。我发现规律大概是:你改哪个部位,就最容易把那个部位的特征改没。扎发吃掉了鬓边的挑染,泪痣发型动不到,基本都在。所以设计签名的时候,挑造型覆盖不到的地方放,痣比发色稳,疤比服装稳。
二、四支广告,哪种场景最容易翻车?
演员有了,我让她连拍了四支不同品类的广告:可乐、咖啡、手机壳,再加上小猫补光灯。前三个是我自己的虚构品牌,罐身杯身壳背上印的是那个戴渔夫帽的卡通小人。
每支先出四张定妆图,我算了算命中率的差异:
背景越干净、打光越接近角色卡原本的拍摄条件,命中率越高;侧脸、仰头、逆光越多,越容易掉。所以别一上来就在强逆光加大仰角下碰运气,先用可控的光把片子立住,复杂镜头多跑几轮挑。
定妆图挑好,再生成15秒的视频。写提示词有个经验,别写「广告感」这类形容词,把它写成分镜,每个镜头标清时间段、景别、速度、画面里发生什么:
镜头一(0-3秒,极近特写、慢动作):拇指按住拉环,「啪」地弹开,细密气泡和白雾从罐口涌出,水珠顺着罐身滚落……镜头四(12-15秒,产品定格):镜头推近到她手中的罐子,罐身标识定格在画面中央。
开头那条片子的前十五秒就是这么写出来的,四个镜头全部落位。
补光灯那支我没按广告拍,拍成了一个小故事:她在店里拿到新手机,回家展开,下载小猫补光灯 Pro,然后举起来自拍。拍这支时我犯过一个错,第一版让她举着手机,同时要求屏幕内容和她的脸都正对镜头,这在物理上根本不成立。 她自拍时内屏对着自己,外部机位只能看到手机背面,屏幕内容要露出来只能走过肩或者主观视角,所以才有了下载页那个过肩镜头。那个下载页上,AI画出来的图标和字都是乱的,我后期换成了真的。
三、片头:选一帧,写个名字
三条都拍完,我把它们接成一条合集传回画布,想给它加个开场片名。选中视频节点,顶部工具栏里就有「创意片头」。
先选一帧当底图,我挑了可乐那段她仰头张嘴的正脸特写,片名写「Huashu」。
风格用默认的智能匹配,它给了一个手写体,放在她脸左边虚化的树影上,没挡脸,右下角还自己加了个「2026」,这一步30积分。
再切到文字动效,选「手写笔画」,150积分。
出来一段5秒的动态片头,我把它接在合集最前面,就是开头那条片子的头几秒。
四、3D虚拟影棚:开拍之前,先把这场戏走一遍
还记得补光灯那支的物理错误吗?屏幕和她的脸同时正对镜头。说到底是空间关系没想清楚,人坐哪、手机朝哪、镜头从哪绕过来,光靠一段文字,模型会糊涂,其实我自己也糊涂。
1.5里另一个独家功能LibTV 3D-BOX,也就是3D虚拟影棚,管的就是这件事。它不在画布里,是左侧栏单独的一个入口。我把那场自拍戏原样描述了一遍:
一个年轻女生坐在夜晚卧室的书桌前,桌上有台灯和一杯咖啡。她双手举起一部展开的折叠屏手机自拍,屏幕朝向她自己。镜头先从她身后过肩,拍到手机屏幕;再慢慢绕到她正面,推近到她的笑脸。
模型选3D-BOX Model Pro,16:9,时长交给它自己定。
之后就是Agent自己干活了,搭人物、搭卧室、架机位、编动作。有意思的是它会自己回放检查:第一轮预览它说「结尾手机挡住了部分下巴」,就把收尾机位抬高了一点;导出检查又发现开场背后那面墙没了,自己补上。前后二十来分钟,交出一段12秒的3D预演。
切到俯视图,整条运镜一目了然:摄影机沿一条弧线从她身后绕到正面,蓝色的菱形是关键帧,灯的位置也标在上面。选中摄影机还会出现坐标轴手柄,想手动挪也行。这张图比我写过的任何一段运镜提示词都说得清楚。
场景里每样东西都能单独选中改。我选中她的脸和头发,跟它说「把头发改成黑色长直发,右侧鬓边加一缕亚麻色挑染,左眼下方加一颗小泪痣」,也就是小满的那三个签名。它回我说挑染和泪痣「会按女生自身的左右侧放置」,还顺手把手机屏幕里的自拍形象也同步改了,镜头一帧没动。
运镜也不一定要用嘴说。对话框旁边有个「标注」,点开是画笔、箭头、圆圈,直接在场景上画。我在俯视图上从床那一侧往她右边拉了一根黄色箭头,跟它说:新加一个镜头,沿我画的箭头走,停在她侧脸和手机的近景,原来那个镜头别动。
它读懂了这根线,新加了一个8秒的镜头二,从床边沿箭头方向推过去,停在侧脸和手机上,原来那条12秒的一点没动。下面这张,黄色箭头是我画的,红框里那台摄影机就是它照着箭头架上去的镜头二:
然后是最关键的一步。右上角导出,可以直接下载MP4,也可以点「去画布生成」。
我点了后者,画布上自动建好一个视频节点,预演已经挂成参考,提示词都预填好了:白模只用来参考镜头、动作和空间关系,按真实人体比例重建角色。
我在这个节点上再挂两张图:小满的一张定妆照,和iPhone Duo的产品图。模型Seedance 2.5,时长12秒,跟预演一样长。
左边是预演,右边是照着它生成的成片:
过肩看到屏幕里的自拍,绕到侧面,转到正面时镜头里是手机背面的双摄,最后推近到笑脸,四个节点一一对上,挑染也还在。这回屏幕的朝向没出错,因为在3D里它本来就没法朝错。

顺带一提积分:3D虚拟影棚这几轮,搭景、改签名、手绘加镜头,测试下来这个功能好像都不扣积分,真正花钱的是最后生成真人视频那一步,12秒扣了552。
我的代码全是AI写的,但代码有版本、有回滚、有能复用的模块,抽卡没有。人站哪、镜头架哪、怎么绕,以前只能写成一段形容词,然后祈祷模型理解对。现在它先是一个能看、能改、能导出的3D场景,再变成视频。到这一步,AI视频才有点像工程,而不是运气。
最后
这是测完之后画布的全貌。所有连线都从同一个点扇出去,小满的头像节点,四支广告、两组对照全挂在那张卡上。
说回开头那个问题。我做AI视频一直沉淀不下来一套工作流,后来想想,大概是因为每次做完,能留下来的东西太少。这次留下来的是一张角色卡,一个能反复改、能照着生成的3D场景,下次再拍不用从头来一遍。我的卡通小人是资产,产品名是资产,现在代言人也是了。
最后简单捋一下。LibTV 1.5这次一共更新了五个功能,上面我实际跑过的是三个:角色造型,小满就是这么捏出来的;3D-BOX(3D虚拟影棚),一句话搭出3D预演,再照着它生成成片;还有成片精修里的创意片头,开头那条片子的片名就是它做的。另外两个这次没来得及试:原创编剧,可以按题材和人设一起写剧本,改一句台词它会提示对前后伏笔的影响;导演分身,可以选一个预设导演,或者把自己的提示词模板喂给它,让它帮你拆分镜、批量改提示词。
我自己的感觉是,这次升级终于让AI视频有了一点剧组的样子,有人管演员,有人管镜头,有人管片头。以前每条片子都是从零开始抽卡,现在第二条可以接着第一条往下做。我这个一人公司的品牌部,这回算是真的多了几个固定员工。
每次写视频生成的产品,大家最关心的都是积分和价格,所以我也特意算了算。我开的是高级版连续包月,469元一个月,给11700积分。
这一天测下来,连带返工一共出了84张图、10条视频(合计107秒),外加一个5秒片头,烧掉6180积分,一个月额度的一半多一点,两百五左右。大头都在视频上,一条15秒带音轨的视频大约746积分,三十块左右;图就便宜多了,一张五毛多。(仅供参考,如果用量大,买更高级别会员的话,积分单价会更低一些)
它当然还不完美,四张里偶尔会有一张翻车的,复杂光线下也会有调整。但你要是也一个人做产品做内容,需要一个「团队」帮你做好营销这件事,我觉得值得花一天试试。
体验地址:https://www.liblib.tv/