必须提前准备角色图、场景图和音视频素材:角色需高清正面图作锚点并补充多角度图,场景用文字设定或实景图,音频需高信噪比且配时间戳分镜脚本。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想在PixTV里把一段古装悬疑短剧剪出来,光有想法不行,得先备齐几类关键素材——角色图不稳定、场景不统一、声音没对齐,后面剪辑再快也白搭。
必须提前准备的角色参考素材
第一步:上传至少1张高清正面角色图,要求脸部清晰、无遮挡、光照均匀。这张图将作为后续所有镜头中该角色的“锚点”,【PixTV会自动提取面部特征并锁定,若首图模糊或侧脸,后续生成的脸会频繁漂移】。
第二步:补充1~2张不同角度或带标志性道具的参考图,比如镖师手持长刀的侧面照、掌柜低头拨算盘的半身图。这些图不参与生成,但能显著提升AI对人物结构和姿态的理解精度。
第三步:给每个主要角色单独建一个文件夹,命名直接用角色名(如“镖师_陈默”),里面只放该角色的图。PixTV不识别子文件夹层级,但命名规范能避免你在画布上拖错节点时手忙脚乱。
场景与分镜所需的视觉依据
方法一:用PixTV内置“场景设定”功能。点击画布左上角「+新建项目」→选择「AI漫剧」→在弹出面板中粘贴一段描述,例如:“清代北方客栈内景,榆木柜台、青砖地、油灯昏黄、墙上挂铜铃”。系统会据此生成基础场景图,并自动保存为默认背景模板。
方法二:自己上传实景参考图。拍一张真实木桌+旧木匣的照片,或找一张符合年代感的客栈室内图,上传后点击右键→「设为当前场景背景」。这比纯文字提示更可靠,尤其对材质(木纹、铜锈、灯油反光)控制更强。
注意:不要上传多张风格差异巨大的场景图混在一个项目里,PixTV不会智能融合,反而容易触发模型混淆,导致生成画面出现“一半清宫一半赛博”的错乱。
声音与节奏配套材料
上传原始对白音频文件(WAV或MP3格式),确保人声干净、无背景音乐。PixTV支持自动语音转文字并匹配口型,但前提是音频信噪比高于65dB——手机外放录音、隔着门录、带空调噪音的都不行。
准备一份带时间戳的分镜脚本,格式为:[00:00-00:03] 镖师推门→[00:04-00:07] 木匣落桌特写→[00:08-00:11] 掌柜抬头。不用精确到帧,但每段时长不能超过5秒,否则视频生成时易出现动作卡顿或口型脱节。
这一步做完,所有素材已就位,可以直接进入PixTV画布开始搭建节点。











