要实现通义万相漫画分镜连贯生成,须依次执行五步:一、文生图构建角色设定图确保形象统一;二、图生图复用设定图生成分镜;三、局部重绘修正细节;四、批量提示词一次生成多格草图;五、画布扩展延展场景空间。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您希望使用通义万相将漫画脚本或分镜文字转化为连续性画面,但尚未掌握其多图连贯生成逻辑与构图控制技巧,则可能是由于未合理利用角色一致性锚点、分镜提示词结构或图生图衔接机制。以下是实现故事板图像生成的具体操作路径:
一、使用文生图构建统一角色设定图
该步骤旨在为后续所有分镜提供稳定的角色视觉基准,确保人物造型、服饰细节与比例关系在多格画面中保持一致,避免AI因提示词微小差异导致形象漂移。
1、访问通义万相官网(https://tongyi.aliyun.com/wanxiang/),使用已实名认证的阿里云账号登录。
2、点击左侧功能栏中的「文本生成图像」,确认模型版本为wan2.5-t2i-preview。
3、在提示词框中输入结构化描述,格式为:“主角名称+核心外貌特征+标志性服装+固定姿态+高清赛璐璐风格+正面半身构图+纯色背景”,例如:“阿哲,黑发短发,戴圆框眼镜,穿红白条纹衬衫与牛仔背带裤,双手插兜站立,8K细节,赛璐璐动画风格,纯灰背景”。
4、设置尺寸为1:1(1024×1024),风格选择「二次元」,相关性调至85,生成4张候选图。
5、选定最符合设定的一张,点击「下载原图」并保存为“角色设定图.png”。
二、基于设定图执行分镜图生图生成
此方法通过上传角色设定图作为视觉锚点,在构图保护开启状态下注入分镜动作与场景指令,使每格画面在保留角色主体的前提下,精准响应镜头语言变化。
1、返回首页,点击左侧「相似图像生成」,进入图生图工作区。
2、点击中央上传区域,拖入刚保存的“角色设定图.png”;系统自动识别主体边界并显示分辨率信息。
3、在提示词框中输入首格分镜指令,例如:“阿哲低头看手表,表情惊讶,背景为地铁站月台,冷色调灯光,广角镜头,动态模糊效果,保持原人物朝向与比例”。
4、勾选「保持构图一致性」选项,确保角色位置与大小不发生偏移。
5、风格下拉菜单中选择「新海诚动画风」,尺寸设为9:16(适配竖版分镜展示),点击「生成创意画作」。
6、生成后下载第一格图,重复步骤1–5,仅更换提示词内容(如“阿哲奔跑穿过玻璃门,背包甩向身后,阳光刺入,慢动作定格”),每次均复用同一张设定图。
三、利用局部重绘补充场景与动作细节
当某格分镜中角色姿态或背景元素生成偏差时,可跳过重新上传与构图重置流程,直接对已有结果图进行指定区域修正,提升多图协同效率。
1、在任意已生成的分镜图下方点击「编辑」按钮,进入局部重绘模式。
魔搭GPT(ModelScopeGPT)是一款AI视频创作工具,阿里达摩院推出的大小模型协同的智能助手,具备作诗、绘画、视频生成、语音播放等多模态能力。
2、使用画笔圈选需修改区域,例如圈选角色腿部区域以调整奔跑姿态。
3、在弹出的提示词框中输入精准指令:“右腿前跨呈冲刺姿态,左膝弯曲抬高,运动鞋鞋带飘起,保留上半身与背景不变”。
4、关闭「全局重绘」开关,仅启用「局部重绘」,点击生成。
5、若背景需增强叙事感,可圈选天空区域,输入“添加乌云与一道闪电,明暗对比强烈,电影级打光”。
四、通过批量提示词生成多格连贯草图
该方式适用于快速产出分镜逻辑验证稿,利用通义万相V2版支持单次提交多组提示词的能力,在一次请求中输出完整故事板序列,减少人工切换成本。
1、进入「文本生成图像」页面,确保模型为wan2.5-t2i-preview。
2、在提示词框中按行输入四组独立分镜指令,每行以数字编号开头并用分号隔开,例如:“1、阿哲站在教室门口犹豫,手扶门框,窗外阳光明媚;2、阿哲坐在课桌前低头写笔记,铅笔尖特写,纸面有涂改痕迹;3、阿哲举手提问,老师侧身微笑回应,黑板上有数学公式;4、阿哲与同学击掌,走廊光影交错,书本散落于地面”。
3、设置生成数量为4,尺寸统一为16:9(适配横向分镜排布),风格选择「厚涂插画」。
4、点击「生成创意画作」,系统将依序解析四组提示词并输出对应四张图。
5、下载全部结果后,在本地图像软件中按编号排列,检查角色特征、色彩倾向与镜头节奏是否具备基本连贯性。
五、应用画布扩展功能延展单格画面空间
当某一格分镜需呈现更广阔环境(如全景街道、长廊追逐)但原始生成画面裁切受限时,可通过画布扩展在不破坏主体的前提下智能补全边缘区域,强化叙事纵深感。
1、在已生成的某格分镜图下方点击「编辑」,选择「画布扩展」功能。
2、在扩展方向中勾选「左右两侧」,设定扩展宽度为原图宽幅的30%。
3、在提示词框中输入环境延展指令:“延续当前街道场景,增加两侧梧桐树与复古路灯,远处有模糊行人剪影,保持地面砖纹与光影方向一致”。
4、关闭「重绘主体」选项,仅启用「边缘智能填充」,防止角色被误修改。
5、点击生成,系统将依据原图边缘像素分布与语义理解,向左右延伸出自然匹配的新画面区域。










