火山引擎数字人视频生成技能。用户上传照片并提供对白或配音文案后,系统自动完成形象创建、TTS配音(性别检测与多音色匹配)及视频合成,并将结果返回。触发词:数字人、视频合成、口播视频、数字人视频。
Volcengine Digital Human Video Generator QQ 第一次设置需要是一项面向实际任务的技能,主要用于这种技能需要Volcengine Access Key(AK)和Sk(SK).;Get AK/SK.;
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。
执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。该技能适合用于一次性任务,也可以接入自动化工作流,与其他技能或上层代理配合完成更完整的业务链路;在组合使用时,应明确每一步的输入输出关系,并避免不同步骤之间出现参数冲突。
本技能需要 Volcengine 的 Access Key(AK)和 Secret Key(SK)。
选项 1:配置文件(推荐)
在技能目录下创建 config.json 文件:
{
"ak": "your_access_key_here",
"sk": "your_secret_key_here"
}
选项 2:环境变量
export VOLC_AK="your_access_key_here"
export VOLC_SK="your_secret_key_here"
⚠️ 安全提示:切勿在脚本中硬编码 AK/SK,也请勿将其提交至公开代码仓库!
本技能会将用户提供的图像及生成的音频/视频上传至第三方图床服务(catbox.moe、0x0.st),以生成 Volcengine API 所需的公开可访问 URL。
/root/.openclaw/media/inbound/ 目录读取realman_avatar_picture_create_role APIrealman_avatar_picture_v2 API,并轮询获取结果message 工具发送缩略图与视频cd /root/.openclaw/workspace-employee-xiaozhua
python3 skills/volc-digital-human/scripts/volc_digital_human.py "$image_path" "$dialog_text" [gender]
参数说明:
image_path:图像路径;若为 None,则自动获取 inbound 目录下最新图像dialog_text:台词/对话文本内容gender:可选,male|female|None(自动识别)| 识别出的性别 | 拟真语音 | 卡通语音 |
|---|---|---|
| female | zh-CN-XiaoxiaoNeural(自然女声) |
zh-CN-XiaoyiNeural(活泼女声) |
| male | zh-CN-YunxiNeural(阳光男声) |
zh-CN-YunxiaNeural(可爱男声) |
| unknown | zh-CN-XiaoxiaoNeural(默认女声) |
zh-CN-XiaoyiNeural |
手动覆盖规则:
参见 references/volc_api.md
| 参数 | 说明 |
|---|---|
image_url |
图像公开 URL(必填),需已上传至图床 |
audio_url |
音频 MP3 的公开 URL(必填) |
resource_id |
创建数字人后返回的 Avatar ID,可重复使用 |
req_key |
create=realman_avatar_picture_create_role,synthesize=realman_avatar_picture_v2 |
zh-CN-XiaoyiNeural| 错误码 | 含义 | 解决方案 |
|---|---|---|
50430 |
请求频率超限 | 等待 1–5 分钟后重试 |
50207 |
图像解码失败 | 请使用 JPG 或 PNG 格式图像 |
401 |
AK/SK 认证失败 | 检查凭证是否正确 |