pixtv视频提示词需包含五大核心要素:明确主体与基础设定、绑定视觉锚点、指定景别与运镜、嵌入时间窗动作指令、限定光影与材质响应;可选增强项包括facs微表情控制、音素-表情耦合声明和lut色彩预设引用;须规避情绪化、跨风格及心理活动等无效表达。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在PixTV里输入一条视频提示词,不是把想法堆成句子就行——它得同时告诉模型“画什么”“怎么动”“在哪动”“谁在动”和“为什么这么动”,缺一环就可能生成角色漂移、动作断裂或镜头失焦的片段。
必须包含的五大核心要素
第一步:明确主体与基础设定
写清人物/物体的年龄、性别、服饰、发型、体型、关键道具及所处空间类型。例如:“穿靛蓝工装夹克的短发女技工,左手戴机械义肢,站在半开放式汽车维修车间中央,头顶LED冷光灯阵列”。不能只写“一个修车的人”,否则模型会自由发挥脸型、袖口磨损程度甚至背景墙颜色。
第二步:绑定视觉锚点
在提示词开头或第二句插入【严格继承Image 2.5锚点图风格】——这是强制模型调用你已保存的风格向量的唯一有效指令。不加这句,哪怕图是同一张,Seedance 2.5也会按新文本语义重采样,导致线条粗细、阴影硬度、肤色饱和度全部偏移。
第三步:指定景别与运镜
用影视术语直接定义镜头语言。例如:“低角度仰拍→镜头缓慢前推→聚焦于她义肢关节处液压管随呼吸微胀缩”。避免模糊表述如“看起来很酷的镜头”,PixTV不识别主观评价,只解析可执行的空间动词(推/拉/摇/移/升/降)和构图参数(大特写/过肩/全景/鱼眼畸变)。
第四步:嵌入时间窗动作指令
所有动态必须标注发生时段,格式为“0–0.6秒:右手抬起至胸口高度,小臂保持15°外旋;0.6–1.1秒:指尖轻触义肢腕部接口盖板,无按压动作”。总时长不可超过1.2秒,否则Seedance 2.5将自动插值过渡帧,引发手指抽搐或关节反向弯曲。
第五步:限定光影与材质响应
补一句“主光源来自左前方45°,金属表面保留哑光质感,无镜面高光;地面油渍反光率控制在12%以内”。PixTV默认启用全局光照计算,不加约束时,同一段视频里工具箱可能前镜泛蓝光、后镜泛黄光,原因是模型对“车间”一词做了多义联想。
可选但强烈建议加入的增强项
方法一:FACS微表情控制
若角色需传递情绪,紧接动作描述后加一句“【AU4+AU7】:眉间轻微下压+眼轮匝肌柔和收缩,持续0.4秒”。AU4(皱眉肌)与AU7(眼轮匝肌)组合是表现专注凝视最稳定的FACS单元,PixTV对这两个动作的帧级还原准确率超89%。
方法二:音素-表情耦合声明
在提示词末尾添加“expression_coupling_factor=0.72”。这个数值是CogVideo底层模型在中文语音节奏下的黄金平衡点:低于0.65则眨眼、瞳孔收缩等生理反射几乎不触发;高于0.78会在句尾升调处强加挑眉,破坏微表情自然性。
方法三:LUT色彩预设引用
如果已用LUT调整过锚点图,可在提示词最后写“应用LUT#S03-TealAmber_V2”,PixTV会自动加载该图层映射表,确保视频输出的色相偏移量与锚图完全一致。注意:LUT编号必须与画布中已存档的完全匹配,大小写和连字符都不能错。
必须规避的三类无效表达
“温柔地笑”“紧张地搓手”“帅气地转身”——这些是情绪结果,不是动作指令。PixTV无法将抽象情绪映射到肌肉运动路径,只会调用内置模板库中的标准笑/搓手/转身动画,导致每段视频都出现相同嘴型、相同手部轨迹、相同旋转轴心。
“类似宫崎骏风格”“参考《攻壳机动队》色调”——跨作品风格绑定在PixTV当前版本中不可靠。模型会提取关键词“宫崎骏”去匹配训练集中最接近的12张图,而这些图未必是你想要的吉卜力水彩质感,更可能是某张被误标为“宫崎骏”的网络同人图。
“她想起很多年前的事”“画面变得朦胧”——PixTV不理解心理活动与光学效果的因果关系。这类描述会触发随机模糊滤镜或淡入淡出转场,且每次生成的模糊半径、渐变曲线都不一致,造成前后镜头景深断裂。











