CellCog驱动的AI图像生成与编辑,支持文字转图像、图像转图像、角色一致性、产品摄影及基于参考的生成。
图像生成 - 由 CellCog. 创建的 AI 图像生成是一项面向实际任务的技能,主要用于用 AI 创建专业图像 - 从单一图像到一致的字符集到产品摄影;对于您的首个 Ce。
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;
若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
借助 AI 创建专业级图像——涵盖单张图像、角色一致性系列、产品摄影等多种场景。
在会话中首次执行 CellCog 任务前,请查阅 cellcog 技能以获取完整的 SDK 参考文档,包括文件处理、对话模式、超时设置等详细说明。
OpenClaw(即发即弃模式):
result = client.create_chat(
prompt="[您的任务提示]",
notify_session_key="agent:main:main",
task_label="my-task",
chat_mode="agent",
)
除 OpenClaw 外的所有智能体(阻塞式,等待任务完成):
from cellcog import CellCogClient
client = CellCogClient(agent_provider="openclaw|cursor|claude-code|codex|...")
result = client.create_chat(
prompt="[您的任务提示]",
task_label="my-task",
chat_mode="agent",
)
print(result["message"])
| 模型 | 提供商 | 主要用途 |
|---|---|---|
| Nano Banana 2(Gemini 3.1 Flash Image) | 默认图像生成模型——适用于写实场景、复杂构图、文字渲染及多轮角色一致性生成 | |
| GPT Image 1.5 | OpenAI | 透明背景图像——如 Logo、贴纸、产品抠图、叠加图形等 |
| Recraft | Recraft AI | 可扩展矢量插画(SVG)与图标生成 |
Nano Banana 2 是所有图像生成任务的默认模型。CellCog 的智能体可根据任务需求智能调度其他模型——例如,透明 PNG 图像将自动交由 GPT Image 1.5 处理,而矢量图或图标请求则路由至 Recraft。若您希望指定某模型,只需在 prompt 中明确说明(例如:"使用 ChatGPT/OpenAI 图像生成")。
根据文本描述生成任意图像:
对已有图像进行变换处理:
在不同场景中生成同一角色的多张图像:
该能力特别适用于:
专业级产品视觉呈现:
为营销活动或素材库生成多张协调统一的图像:
利用已有图像作为风格、角色或构图参考:
| 维度 | 可选项 |
|---|---|
| 宽高比 | 1:1(正方形)、16:9、9:16、4:3、3:4、3:2、2:3、21:9 |
| 分辨率 | 1K(约 1024px)、2K(约 2048px)、4K(约 4096px) |
| 风格 | 写实风格、插画、水彩、油画、动漫、数字艺术、矢量图 |
| 格式 | PNG(默认) |
分辨率推荐:
在图像生成任务中,建议对以下场景使用 chat_mode="agent team":
对于简单单图生成任务,chat_mode="agent" 通常响应更快。
职业人像:
“生成一张职业人像:一位面带亲和力的三十多岁亚裔女性,身着深蓝色西装外套,柔和影棚灯光,中性灰色背景,神情自信且平易近人。1:1 正方形比例,2K 分辨率,写实风格。”
产品摄影:
“高端无线耳机充电盒产品图,哑光黑色表面,置于反光深色台面,辅以微妙蓝色氛围光。风格极简,体现高端科技感。4:3 横向构图,4K 分辨率用于主视觉图。”
角色一致性图集:
“创建一位角色:年轻黑人男性软件工程师,戴眼镜、着装休闲、神态友善。随后生成 4 张图像:
- 在升降办公桌前工作,配备多块显示器
- 参与视频会议,正在讲解某项内容
- 在咖啡馆内使用笔记本电脑思考问题
- 与团队共同庆祝,击掌相庆
确保该角色在全部图像中完全一致。”
社交媒体图集:
“为一家植物基餐食配送服务生成 5 张 Instagram 帖子配图:
- 俯拍缤纷素食碗(Buddha bowl)
- 开心拆开配送包裹的人物特写
- 整齐排列的餐食预制容器
- 新鲜食材特写
- 从食材到成品菜肴的‘前后对比’图
风格要求:明亮、清新、诱人食欲,整体采用统一暖色调分级。1:1 正方形格式。”
风格迁移:
“将上传的这张城市街道照片,转换为吉卜力工作室(Studio Ghibli)动画风格插画。保留原始构图与元素,但加入吉卜力标志性的温暖氛围、柔和云朵与奇趣细节。”
描述需具体:“办公室里的女性”过于模糊;“一位四十多岁、身穿银灰色西装外套、身处现代玻璃幕墙办公室、沐浴在温暖午后阳光中的自信女性”则更佳。
明确风格:“写实风格”、“数字插画”、“水彩”、“极简矢量图”等。
说明光照条件:“柔和自然光”、“强烈侧光”、“黄金时刻暖光”、“影棚布光”等。
传达画面情绪:“专业且自信”、“温暖且亲切”、“活力四射且明快”等。
注明构图方式:“三分法构图”、“中心对称构图”、“特写镜头”、“广角定场镜头”等。
保证一致性:在生成角色系列时,应先详尽描述角色特征,后续 prompt 中统一使用“同一角色”等表述以强化一致性。
运行 /cellcog-setup(或根据所用工具不同,可能为 /cellcog:cellcog-setup)完成安装与认证。
OpenClaw 用户:请改用 clawhub install cellcog。
手动安装:执行 pip install -U cellcog 并配置环境变量 CELLCOG_API_KEY。更多 SDK 使用说明请参阅 cellcog 技能文档。