tokenrouter-image-generator

Polar Sponsor
爱发电 赞助
.NET 9.0

通过 Palebluedot AI(PBD)-TokenRouter 的多模态图像生成端点(`/v1/chat/completions`)使用 TokenRouter 兼容的方式生成或编辑图像...

Token Router 图像生成和编辑

功能概述

Token Router 图像生成和编辑是一项面向实际任务的技能,主要用于使用 Chat 补全 API 编辑新的图像或编辑现有的图像;使用绝对路径运行脚本( 切勿)。

核心要点

  • 它将相关步骤、工具调用和结果整理方式集中到统一流程中,帮助使用者更快完成目标并减少重复操作。
  • 使用时应结合输入条件选择合适的执行方式,核对必要参数、依赖环境与输出内容,并按原始要求处理异常情况。
  • 该技能适合需要稳定复用相关能力的场景,可作为自动化工作流的一部分,也便于后续检查、调整和扩展。

使用与执行

从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;

结果检查与注意事项

若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。

TokenRouter 图像生成与编辑

通过 Chat Completions API,使用 TokenRouter 支持图像能力的模型,生成新图像或编辑已有图像。

使用方法

请使用绝对路径运行脚本(切勿先执行 cd 进入 skill 目录):

生成新图像:

# 确保输出目录已存在
mkdir -p ~/.openclaw/media/outbound

uv run ~/.openclaw/workspace/skills/pbd-tokenrouter-image-generator/scripts/generate_image.py 
  --prompt "你的图像描述" 
  --filename "~/.openclaw/media/outbound/output-name.png" 
  --model google/gemini-2.5-flash-image 
  [--aspect-ratio 16:9] 
  [--image-size 2K]

编辑已有图像(图生图):

mkdir -p ~/.openclaw/media/outbound

uv run ~/.openclaw/workspace/skills/pbd-tokenrouter-image-generator/scripts/generate_image.py 
  --prompt "编辑指令" 
  --filename "~/.openclaw/media/outbound/output-name.png" 
  --input-image "path/to/input.png" 
  --model google/gemini-2.5-flash-image

重要提示: OpenClaw 默认交付路径为 ~/.openclaw/media/outbound/。请将生成的图像保存至此路径,以便其他 OpenClaw 流程可自动识别并调用。

API 密钥

该脚本需要 TokenRouter API 密钥。密钥查找顺序如下:

  1. --api-key 参数
  2. PBD_TOKENROUTER_API_KEY 环境变量
  3. 自动检测:从当前 agent 在 ~/.openclaw/openclaw.json 中配置的 tokenrouter provider 部分读取

若未找到 API 密钥

运行脚本前,请先检查密钥是否可用:

test -n "$PBD_TOKENROUTER_API_KEY" && echo "密钥已找到" || echo "未找到密钥"

若以上任一来源均未提供有效密钥,请勿运行脚本。应引导用户完成密钥获取流程:

  1. 告知用户需要一个 TokenRouter API 密钥。
  2. 指引其访问:https://www.tokenrouter.com
  3. 逐步说明操作步骤:
    • 在网站注册或登录
    • 登录后,进入 API Keys 页面
    • 在侧边栏 / 导航栏中找到 API Keys 菜单项
    • 点击 API Keys 进入密钥管理页面
    • 创建一个新的 API 密钥并复制
  4. 用户获得密钥后,提供以下两种配置方式:
    • 选项 A — 直接向 agent 提供密钥: 用户可在聊天窗口中粘贴密钥,agent 将通过 --api-key 参数传入脚本。这是最快启动方式,无需环境配置。
    • 选项 B — 配置为环境变量(持久化):
      • 仅限当前终端会话: export PBD_TOKENROUTER_API_KEY="sk-xxx..."(在终端中粘贴执行)
      • 持久化(zsh): 将 export 行添加至 ~/.zshrc,然后执行 source ~/.zshrc
      • 持久化(bash): 将 export 行添加至 ~/.bashrc,然后执行 source ~/.bashrc
  5. 密钥就绪后,继续执行图像生成命令。

重要提示: 此检查不可跳过。若无有效密钥运行,将报错 Error: No API key provided 或 HTTP 401/403。

可选归属头信息(可选)

  • --site-url 或 PBD_TOKENROUTER_SITE_URL
  • --app-name 或 PBD_TOKENROUTER_APP_NAME

模型与图像配置

  • --model 为必填项(脚本无默认值)
  • 默认 / 推荐模型: google/gemini-2.5-flash-image
  • 其他支持的图像模型(用户可请求切换):
    • openai/gpt-5-image
    • openai/gpt-5-image-mini
    • google/gemini-3-pro-image-preview
    • google/gemini-3.1-flash-image-preview
  • 使用 --aspect-ratio 设置 image_config.aspect_ratio(例如 1:1、16:9)
  • 使用 --image-size 设置 image_config.image_size(1K、2K、4K)

注:TokenRouter 文档中,aspect_ratio 和 image_size 是图像生成通用的配置字段。特定 provider / 模型可能支持额外字段(如 Sourceful 特性)。若请求失败,请移除不支持的选项或更换模型。

注:脚本始终发送 modalities: ["image", "text"]。部分纯图像模型(如某些 FLUX 变体)可能拒绝该配置 — 若使用非 Gemini 模型时出现意外错误,此即可能原因。当前 CLI 参数未暴露绕过方案。

默认工作流(草稿 → 迭代 → 定稿)

目标:在投入更高画质设置前,快速完成多轮迭代。

  • 草稿阶段:采用更小尺寸 / 更快模型
    • --image-size 1K
  • 迭代阶段:小幅调整 prompt,并每次使用新文件名保存结果
  • 定稿阶段:若所选模型支持,可启用更大尺寸或更高画质
    • 示例:--image-size 4K --aspect-ratio 16:9

预检 + 常见失败

  • 预检步骤:

    • command -v uv
    • API 密钥检查(关键): 脚本将依次尝试 --api-key、PBD_TOKENROUTER_API_KEY、以及从 ~/.openclaw/openclaw.json(tokenrouter provider 配置)自动读取。若全部失败,立即中止,并引导用户前往 https://www.tokenrouter.com 注册并获取 TokenRouter API 密钥(详见上文“若未找到 API 密钥”章节)
    • test -d ~/.openclaw/media/outbound || mkdir -p ~/.openclaw/media/outbound
    • 若为图像编辑任务:test -f "path/to/input.png"
  • 常见失败类型:

    • Error: No API key provided. → 脚本未能从 --api-key、PBD_TOKENROUTER_API_KEY 或 ~/.openclaw/openclaw.json 中读取到密钥。请引导用户前往 https://www.tokenrouter.com 注册并免费获取 TokenRouter API 密钥,随后设置 PBD_TOKENROUTER_API_KEY 或传入 --api-key
    • Error loading input image: → 输入路径错误或文件不可读
    • HTTP 400(含模型 / 图像配置错误)→ 不支持的模型,或 image_config.aspect_ratio / image_config.image_size 值无效
    • HTTP 401/403 → 密钥无效、无模型访问权限,或配额 / 余额不足
    • No image found in response → 模型可能不支持图像输出,或请求格式被拒绝

文件名生成规则

按如下模式生成文件名:~/.openclaw/media/outbound/yyyy-mm-dd-hh-mm-ss-name.png

示例:

  • ~/.openclaw/media/outbound/2026-03-21-10-00-00-example.png

Prompt 处理规范

  • 图像生成:直接使用用户提供的描述文本,除非其过于模糊、无法执行。
  • 图像编辑:明确指出需变更内容,其余部分严格保持不变。

精准编辑用 Prompt 模板:

  • 仅修改:<变更内容>。其余全部保持一致:主体、构图/裁剪、姿态、光照、配色方案、背景、文字及整体风格。不得添加新对象。

输出行为

  • 默认将响应中第一个图像保存至 ~/.openclaw/media/outbound/output-name.png(请在 --filename 中传入完整路径)
  • 支持 TokenRouter 的 base64 data URL 图像响应格式(message.images[0].image_url.url)
  • 打印已保存的文件路径
  • 除非用户明确要求,否则不主动读取图像内容

使用示例

生成新图像:

mkdir -p ~/.openclaw/media/outbound

uv run ~/.openclaw/workspace/skills/pbd-tokenrouter-image-generator/scripts/generate_image.py 
  --prompt "一张具有日系治愈系动漫美学风格的田野照片。" 
  --filename "~/.openclaw/media/outbound/2026-03-21-10-00-00-healing.png" 
  --model google/gemini-2.5-flash-image 
  --aspect-ratio 16:9 
  --image-size 2K

编辑已有图像:

mkdir -p ~/.openclaw/media/outbound

uv run ~/.openclaw/workspace/skills/pbd-tokenrouter-image-generator/scripts/generate_image.py 
  --prompt "使用美白滤镜美化该照片。" 
  --filename "~/.openclaw/media/outbound/2026-02-26-14-25-30-sunset-sky-edit.png" 
  --model google/gemini-2.5-flash-image 
  --input-image "self-photo.jpg"

参考文档

相关专题

更多
token什么意思
token什么意思

token是一种用于表示用户权限、记录交易信息、支付虚拟货币的数字货币。可以用来在特定的网络上进行交易,用来购买或出售特定的虚拟货币,也可以用来支付特定的服务费用。想了解更多token什么意思的相关内容可以访问本专题下面的文章。

2024.03.01

4721

5

token怎么获取
token怎么获取

获取token值的方法:1、小程序调用“wx.login()”获取 临时登录凭证code,并回传到开发者服务器;2、开发者服务器以code换取,用户唯一标识openid和会话密钥“session_key”。想了解更详细的内容,可以阅读本专题下面的文章。

2023.12.21

2597

3

登录token无效怎么办
登录token无效怎么办

登录token无效的解决办法有检查Token是否过期、检查Token是否正确、检查Token是否被篡改、检查Token是否与用户匹配、清除缓存或Cookie、检查网络连接和服务器状态、重新登录或请求新的Token、联系技术支持或开发人员等。本专题为大家提供token相关的文章、下载、课程内容,供大家免费下载体验。

2023.09.14

1245

5

登录token无效
登录token无效

登录token无效解决方法:1、检查token的有效期限,如果token已经过期,需要重新获取一个新的token;2、检查token的签名,如果签名不正确,需要重新获取一个新的token;3、检查密钥的正确性,如果密钥不正确,需要重新获取一个新的token;4、使用HTTPS协议传输token,建议使用HTTPS协议进行传输 ;5、使用双因素认证,双因素认证可以提高账户的安全性。

2023.09.14

9906

6

LLVM自定义Pass怎么写
LLVM自定义Pass怎么写

本专题聚焦LLVM自定义Pass开发,整理Pass类结构、run()方法、PreservedAnalyses、CMake构建、插件注册、-load-pass-plugin加载和测试用例编写流程。

2026.09.30

0

10

LLVM RISC-V参数配置教程
LLVM RISC-V参数配置教程

本专题介绍LLVM对RISC-V基础ISA和扩展的支持方式,涵盖RV32、RV64、标准扩展、实验性扩展、厂商扩展、-menable-experimental-extensions和版本差异。

2026.09.30

0

14

LLVM IR中间表示入门指南
LLVM IR中间表示入门指南

本专题整理LLVM IR的核心概念,包括中间表示作用、模块结构、函数、基本块、SSA形式、类型系统和常见语法,帮助新手理解LLVM编译流程中的关键层。

2026.09.30

0

12

PDF转图片方法
PDF转图片方法

需要把 PDF 页面用于上传、预览、分享或图片归档时,PDF 转图片方法专题整理 JPG/PNG 格式选择、逐页导出、清晰度设置、批量下载和结果检查等流程,帮助用户稳定完成 PDF 图片化处理。

2026.09.30

0

26

PixTV AI视频生成与无限画布创作
PixTV AI视频生成与无限画布创作

PixTV专题整理AI视频与视觉内容创作相关功能使用教程,涵盖AI生图、视频生成、无限画布、多模型创作、素材管理、声音音乐及视频剪辑等功能,帮助用户快速掌握PixTV从创意到成片的完整制作方法。

2026.09.29

0

15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Minimax手册
Minimax手册

共0课时 | 0人学习

前端Vue3实战【手写vue项目】
前端Vue3实战【手写vue项目】

共9课时 | 1.2万人学习