必须提前确认四项准备:①设定时长≤60秒、主角≤2人、主场景≤1个、镜头数6–12个;②用固定参数图锚定角色与场景视觉一致性;③将脚本拆为含动作/景别/道具/光线的明确镜头指令;④确认账号支持minimax h3或seedance 2.5等可用模型。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用PixTV做一条能连贯播放的AI短片,不需要会写代码或懂影视工业标准,但必须提前确认几项不可跳过的准备事项——缺任何一项,后续生成的画面都会在角色、场景或镜头衔接上失控。
第一步:明确故事节奏与体量边界
打开PixTV官网(https://www.pixtv.ai),点击“新建画布”前,请先写下这句话:“本片时长≤60秒,主角≤2人,主场景≤1个,镜头数6–12个”。【这是唯一能防止你中途崩溃的硬约束】。超过这个范围,角色一致性、分镜连贯性、素材管理成本会指数级上升。很多用户卡在第3个镜头就放弃,不是模型不行,而是从一开始就没给AI设定可执行的边界。
题材选“一句话能说完”的冲突型结构:比如“她撕掉辞职信,手机弹出升职通知”;避免“他想起童年海边的风”这类依赖心理描写的表达——AI不理解“想起”,但能准确生成“手指停在碎纸机上方→手机屏幕亮起→瞳孔收缩”这一组动作链。
第二步:准备好角色与场景的视觉锚点
不要直接输入“一个穿黑西装的男人走进办公室”就开始生成视频。先在画布左侧新建“角色资产”区,用GPT Image 2.5生成四张图:正面半身照、侧面站姿、带标志性动作(如推眼镜)、一种情绪特写(如皱眉)。每张图下方用文字标注固定参数:“黑发、方脸、金丝眼镜、藏青西装、左手无名指有戒指”。
场景同理:用Nano Banana Pro生成一张“标准场景图”,注明“现代开放式办公室、午后斜射光、玻璃隔断、绿植在右后方、桌面有笔记本和咖啡杯”。【没有这张图,后面所有镜头里的窗框方向、光影角度、道具位置都会随机漂移】。PixTV的无限画布允许你把这五张图钉在项目角落,后续每个镜头生成时都能拖入提示词框作为参考。
第三步:把脚本拆成可执行的镜头指令
方法一:用文本模型自动拆解
在画布中新建文本节点,输入原始剧情→选择GPT 6模型→提示词写:“将以下内容拆为6个镜头,每个镜头包含:角色+场景+动作+景别+关键道具+光线,输出纯列表,不加解释”。
方法二:手动填写分镜表(推荐新手)
在画布空白处拉出表格区域,按顺序填:① 镜头编号 → ② 画面描述(例:中景,女主背对镜头站在落地窗前,手指捏着一张纸,窗外天色渐暗)→ ③ 对白/音效(例:纸张窸窣声)→ ④ 时长预估(例:2.4秒)。这一步做完,你才真正拥有了PixTV能读懂的“拍摄清单”,而不是文学稿。
注意:所有镜头描述里禁止出现“似乎”“好像”“隐约”等模糊词。AI只认具体动作、可见道具和确定空间关系。
第四步:确认账号权限与模型可用性
登录后检查右上角账户状态,确保当前套餐支持MiniMax H3或Seedance 2.5——这两个是PixTV目前生成人物动作最稳定的视频模型。Starter套餐虽支持MiniMax H3 768P,但单次生成上限为8秒;若你的镜头平均需10秒动态,必须升级至Pro或更高档位。
进入画布后,点击“+添加视频节点”,观察模型列表是否显示Gemini Omni Flash(适合快速剪辑粗切)、Seedream 5.0 Pro(适合风格化静帧延展)。如果列表为空,说明当前订阅未开通该能力,需返回账户页面调整套餐。











