hermes agent可调度flux或midjourney生成高质量ai图像,支持自然语言输入、局部/全局重绘、参数微调及多图角色一致性控制,需启用persistent session以保留历史上下文与图像id。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要用Hermes Agent调度Flux或Midjourney生成高质量AI图像,同时保留可控性、风格一致性与多轮迭代能力,避免手动反复粘贴提示词、切换平台、丢失历史上下文。
配置Hermes Agent接入绘图模型
打开Hermes Agent Web UI → 左侧导航栏点击「Settings」→ 在「Model Providers」区域找到「Image Generation」模块。
选择「Flux Dev」或「Midjourney v6」(若使用Midjourney,需提前在Discord绑定Bot并获取API代理地址)→ 粘贴对应API Key或Webhook URL → 点击「Test Connection」确认绿色对勾出现。
【必须启用「Persistent Session」开关】 否则每次新对话都会丢失上一轮生成的图像ID和参数,无法做refine、upscale或局部重绘。
用自然语言发起首张构图指令
在主聊天框输入:“画一张赛博朋克风格的东京雨夜街景,霓虹广告牌泛着蓝紫光,主角穿长风衣站在便利店门口,镜头带浅景深。”
按回车后,Hermes会自动解析关键词、补全负向提示(如“lowres, blurry, deformed hands”)、选择Flux的schnell模式快速出初稿。
这一步不需要写英文提示词,也不用加任何格式符号——Hermes内置了多语言提示工程模块,中文描述越具体,构图逻辑越准。
对已生成图像执行三类深度编辑
方法一:局部重绘(Inpainting)
点击某张输出图右下角「✏️ Edit」→ 用鼠标圈出便利店玻璃门区域 → 输入“替换成全息投影菜单界面,带浮动日文字符”。
方法二:全局重绘(Vary Region)
长按图像缩略图 → 选择「Vary (Subtle)」→ Hermes会保持原构图与光影,仅优化人物面部细节和雨丝质感,耗时比重绘少60%。
方法三:参数微调后再生(Prompt + Settings Override)
点击图像下方「⋯」→「Regenerate with Settings」→ 将CFG Scale从7调至12 → 勾选「Preserve Composition」→ 提交。此时画面线条更锐利,但不会改变主体位置。
注意:Midjourney不支持局部重绘,该操作在选择Midjourney为后端时会被自动禁用并灰显按钮。
批量生成同一角色的多姿态设定图
第一步:先让Hermes记住角色特征。
输入:“请记住这个角色设定:女性,25岁左右,银白短发,左眼是机械义眼,常穿哑光黑夹克配橙色战术腰带。”
第二步:触发角色锚定。
输入:“基于以上角色,生成4张不同动作的全身像:①靠墙抱臂 ②跃起踢腿 ③半跪卸弹匣 ④仰头看天空。”
第三步:强制统一画风。
在指令末尾追加:“所有图使用Flux + AnimeRealism_LoRA,禁止添加背景文字和UI元素。”
Hermes会为每张图生成独立seed值并缓存角色CLIP嵌入向量,确保四张图中发色、义眼反光逻辑、腰带纹理完全一致——这是纯手工调Midjourney做不到的跨图一致性控制。











