midjourney无法可靠生成专业分镜——它不理解分镜的结构语义,不分日漫/美漫差异,仅将“分镜”视为普通插画关键词;--style raw或--s 750等参数只影响风格强度,不改变其缺乏镜头编号、轴线逻辑、对白框等序列化输出能力的本质。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

Midjourney 无法可靠生成符合专业分镜规范的日漫或美漫脚本可视化结果——它不理解「分镜」(storyboard)的结构语义,也不区分日漫/美漫在构图、镜头标注、时序逻辑上的根本差异。
为什么 –style raw 或 --s 750 对分镜无效
这些参数只影响画面风格强度与渲染倾向,不改变 Midjourney 的底层理解机制:它把「分镜」当作普通插画关键词处理,而非按格编号、带镜头号(如 CU、LS)、含动作轴线与对白框的序列化输出。即使输入「第1格:特写,主角握拳,台词框:“不能再逃了!”」,模型仍大概率返回单张高质感图,且台词文字常扭曲或缺失。
- 日漫分镜依赖「格子密度」「留白节奏」和「拟声词位置」,MJ 无对应训练数据
- 美漫分镜强调「镜头编号」「角度缩写(如
LOW ANGLE)」和「页边注释」,MJ 从不生成这类文本锚点 -
--tile模式仅拼接相似纹理,不能生成逻辑连贯的 4–6 格叙事序列
真正能跑通的最小可行方案:人工拆解 + 图生图接力
把脚本逐句转为独立提示词,用 MJ 的 /imagine 生成单格草图,再导入专业工具排版。这不是“自动分镜”,而是“AI 辅助绘图”:
- 每格提示必须包含明确镜头类型:
medium shot、over-the-shoulder view、extreme close-up on eyes - 禁用模糊动词(如“思考”“犹豫”),改用可视动作:
clenched jaw、glancing left with shadow over eye - 用
--no text, signature, watermark避免干扰后期加字;关键帧建议加--v 6.3提升手绘感适配日漫
测试中暴露的硬伤:跨格一致性完全失控
同一角色在连续格中发色、衣褶朝向、背景窗格数量频繁变动——MJ 不维护跨提示的视觉状态。实测 12 格日漫脚本,仅 3 格保持基础角色识别度(靠强限定如 black hair, red hoodie, visible scar on right cheek),其余需手动重绘或换图。
- 没有
seed锁定也无法保证一致性;--sref在 v6 后对多格场景支持极弱 - 美漫常用粗黑轮廓线(
inked line art)会被 MJ 自动柔化,需额外用 ControlNet 在 Stable Diffusion 中补线 - 所有生成图默认 1:1 或 4:3,而日漫分镜常用 16:9 横幅+竖排格,需裁切后手动重排
分镜不是风格切换问题,是结构化视觉叙事问题。MJ 当前定位仍是图像生成器,不是分镜编排引擎。真要落地,得接受“一格一调参、一格一手修”的工作流,别信“一键生成分镜”的宣传话术。











