纳逗pro已接入奇智、即梦、可灵、vidu、海螺、wan等主流大模型,通过语义对齐与任务调度实现四模态协同生成,支持“一句指令,全链响应”,已在《天问》《迷雾镇》等项目落地应用。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

纳逗Pro最新已接入奇智大模型,以及即梦、可灵、Vidu、海螺、Wan等主流大模型的最新版本,全面覆盖文本、图像、视频、音频四模态生成能力。它不是简单叠加多个模型,而是通过底层语义对齐与任务调度机制,让不同模型在影视工作流中各司其职。
多模型协同不是“堆功能”,而是按环节自动分配
系统会根据创作指令类型,动态调用最适配的模型:
- 剧本逻辑推演、人物关系构建由奇智大模型处理,保障叙事连贯性与角色弧光合理性;
- 分镜图绘制、美术设定图生成优先调用即梦或Vidu,强于构图控制与风格一致性;
- 动态镜头生成、角色微表情与运镜节奏依赖海螺与Vidu联合输出;
- 背景音乐匹配、台词情绪配音、环境音效合成由Wan与可灵协同完成。
四模态生成真正实现“一句指令,全链响应”
输入自然语言描述后,纳逗Pro可同步输出对应结果:
Vidu视频生成插件(viduq3-pro、viduq3-turbo、viduq2、viduq1)。支持文字转视频、图片转视频、参考转视频以及起始编辑。
- 文字层面:生成符合戏剧结构的分场剧本与人物小传;
- 图像层面:输出带景别标注、光影提示、色彩倾向的分镜草图;
- 视频层面:生成10–30秒高质量动态分镜片段,支持首尾帧衔接;
- 音频层面:自动生成贴合画面情绪的BGM、角色语音(含语气、停顿、呼吸感)及环境音轨。
跨模态联动靠的是“语义锚点”,不是拼接
比如输入“暴雨夜,穿灰风衣的男人推开老式木门,门轴吱呀作响,他抬头望向二楼窗内暖光”,系统会:
- 在美术设定中锁定“冷蓝主调+高对比度雨丝+木质纹理特写”;
- 在分镜中指定“低角度仰拍门缝光、中景跟拍手部动作、窗内虚焦暖光作为视觉落点”;
- 在音频中生成带混响的“吱呀”声+远处雷声铺底+轻柔钢琴单音呼应窗内暖光情绪;
- 所有模态输出共享同一套时间码与空间坐标,确保后期可直接进入剪辑轨道。
这种能力已在《天问》《迷雾镇》等首批商用项目中验证落地,不是概念演示,而是可交付的工业级输出标准。










