通义万相图生图功能可基于参考图像生成新风格变体并保持原构图:依次进入相似图像生成界面、上传配置参考图、撰写提示词并启用构图保护、选择风格与尺寸、局部重绘优化。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您已有一张参考图像,希望在保留其核心构图、主体位置或视觉节奏的前提下生成新风格、新细节或新变体的图像,则可使用通义万相的图生图功能。以下是实现该目标的具体操作路径:
一、进入相似图像生成界面
该步骤旨在定位图生图功能入口,确保系统加载正确的模型与交互模块,为后续图像上传与参数设定提供基础环境。
1、访问通义万相官网(https://wanxiang.aliyun.com),使用阿里云账号登录。
2、在首页左侧功能栏中,点击「相似图像生成」选项。
3、页面跳转后,确认当前界面顶部显示“相似图像生成”标题,并出现中央上传区域与右侧参数设置区。
二、上传并配置参考图像
此步骤通过导入原始图像建立生成锚点,系统将基于像素结构、边缘分布与语义区域识别原始构图特征,为风格迁移或细节延展提供空间约束依据。
1、点击上传区域内的「点击上传」按钮或直接将图片文件拖入指定框内。
2、支持格式为PNG或JPG,单张文件大小需≤10MB;若图像含透明通道(如PNG带Alpha),系统将保留该信息用于精细重绘。
3、上传成功后,预览图下方自动显示图像分辨率、宽高比及文件名;若图像模糊或主体占比过小,建议提前裁剪以提升生成稳定性。
三、撰写提示词并启用构图保护
提示词在此流程中承担风格指令与语义增强作用,而构图保护机制则防止AI对主体位置、比例关系进行无约束重构,保障视觉逻辑延续性。
1、在提示词输入框中,明确写出目标风格与关键修改要求,例如:“转换为吉卜力手绘风格,人物表情更生动,背景增加飘落樱花,保持原构图与人物朝向”。
2、勾选「保持构图一致性」选项(若界面可见);该选项启用后,模型将锁定主体边界框,仅在局部纹理、色彩与装饰元素层面进行生成。
3、避免在提示词中使用否定式描述(如“不要改变脸型”),应采用正向引导(如“维持原有面部比例与五官间距”)。
四、选择风格与尺寸并启动生成
风格选项决定底层渲染模型调用路径,尺寸设定影响输出图像的像素密度与适用场景,二者协同影响最终视觉表现精度。
1、从风格下拉菜单中选择目标类别,如「厚涂插画」、「赛璐璐插画」、「水彩质感」或「新海诚动画风」等具体子类。
2、点击「尺寸」下拉菜单,根据用途选取对应宽高比:公众号封面选9:16、网页横幅选16:9、头像选1:1。
3、确认「提示词相关性」滑块处于85–95区间,以强化对提示词中构图与风格关键词的响应强度。
五、局部重绘优化特定区域
该方法适用于生成结果中局部失真、风格不统一或细节缺失的情况,允许用户在保留其余画面不变的前提下,仅对选定区域重新生成内容。
1、在生成结果图上点击「局部重绘」按钮,进入蒙版编辑模式。
2、使用画笔工具涂抹需重绘的区域,注意边缘过渡自然,避免覆盖关键结构线。
3、在局部重绘提示词框中输入针对性指令,例如:“增强手部细节,添加丝绸袖口褶皱,保持肤色与光照方向一致”。
4、关闭「全局风格迁移」开关,确保仅该区域响应新提示词,其余画面保持原始生成状态。











