必须使用liblibai的controlnet+静态帧锚定双保险路径:选择flux-video-v2或kontext-motion-3.1底模,上传png白底图并设keyframe interval=1,启用canny_edge controlnet,关闭motion guidance与temporal smoothness,选slow zoom in运镜、24fps,导出mp4并保留alpha通道。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用LiblibAI把一张产品图生成10秒带运镜的短视频,同时确保瓶身弧度、LOGO位置、标签文字、金属反光等外形细节全程零偏移,必须绕过默认视频工作流的结构重绘机制,启用ControlNet+静态帧锚定双保险路径。
确认视频入口与模型兼容性
打开 https://www.liblib.tv/ → 登录账号 → 点击顶部「视频生成」→ 在「MODEL」下拉菜单中【必须选择支持ControlNet的视频底模】,当前稳定可用的是「Flux-Video-V2」或「Kontext-Motion-3.1」;若列表为空,先点击右上角「刷新模型库」再重试。
注意:libtv.org 仅支持图片生成,无法执行此流程——域名错一步,全部操作无效。
上传并锁定静态关键帧
在视频工作流界面,找到标有“Reference Image”或中文“参考图”的上传框 → 拖入一张【边缘像素级干净、无压缩伪影的PNG白底产品图】(JPG会触发自动降噪导致轮廓软化)。
上传后立即点击右侧参数区的「帧锁定」开关 → 将「Keyframe Interval」设为1 → 这表示每1帧都强制比对原始图结构,而非仅首尾帧锚定。不设此项,第3秒开始商品就可能轻微膨胀或缩颈。
启用ControlNet结构约束(不可跳过)
方法一:自动加载(推荐)
在参数区找到「Enable ControlNet」复选框 → 勾选 → 系统自动匹配「canny_edge」预处理器 → 无需手动调整阈值,该组合对玻璃瓶、金属壳、印刷字体的轮廓抓取准确率最高。
方法二:手动校准(高阶)
若产品含大量镂空或半透明区域(如蕾丝包装、亚克力支架),点击「Preprocessor」下拉菜单 → 改选「tile」模式 → 将「Control Weight」滑块拖至0.65~0.72区间 → 数值低于0.6,运镜时标签易位移;高于0.75,画面会泛灰失去材质感。
【务必关闭“Motion Guidance”和“Temporal Smoothness”两项】——它们会主动柔化帧间差异,直接抹除产品棱线、压平浮雕文字、模糊接缝高光。
设置运镜参数与导出校验
第一步:在「Camera Motion」栏中选择运镜类型 → 推荐「Slow Zoom In」或「Static Shot + Subtle Pan」;禁用「Orbital Rotate」和「Dolly Zoom」——前者必然导致瓶盖旋转错位,后者会放大透视畸变,使圆柱体变椭圆。
第二步:将「Frame Rate」固定为24fps → 高于30fps时部分显卡驱动会跳帧,造成第7秒左右突然形变;低于20fps则运镜卡顿,AI被迫插值补帧,引发边缘撕裂。
第三步:点击「生成」→ 等待约3分20秒 → 完成后进入预览页 → 拖动时间轴到第0:08.40(即第204帧)→ 放大至400% → 逐像素检查产品LOGO边缘是否出现锯齿、瓶口螺纹是否连续、标签折角是否保持锐利——任一异常即说明ControlNet未生效,需重传原图并重启流程。
第四步:点击右上角「导出」→ 选择格式为 MP4(H.264)→ 勾选「保留Alpha通道」→ 点击「下载」。











