使用 Sora 2、Veo 3、Seedance、Runway 及现代 API,通过可靠的提示与渲染工作流创建 AI 视频。
设置 : 在第一次使用时, 读取设置 . md.是一项面向实际任务的技能,主要用于用户需要使用当前模型和 API 生成、编辑或缩放 AI 视频;使用此技能选择正确的当前模型堆栈, 写入 stron。
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;
若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
首次使用时,请阅读 setup.md。
用户需要借助当前模型与 API 生成、编辑或扩展 AI 视频。 使用本技能可选择合适的当前模型栈、编写更具表现力的运镜提示词,并运行稳定可靠的异步视频处理流水线。
用户偏好设置持久化保存在 ~/video-generation/ 目录中。具体配置方式请参阅 memory-template.md。
~/video-generation/
├── memory.md # 首选服务商、模型路由策略、可复用的分镜模板
└── history.md # 可选:任务执行日志,含耗时、费用与输出信息
| 主题 | 文件 |
|---|---|
| 初始设置 | setup.md |
| 记忆模板 | memory-template.md |
| 迁移指南 | migration.md |
| 模型快照 | benchmarks.md |
| 异步 API 模式 | api-patterns.md |
| OpenAI Sora 2 | openai-sora.md |
| Google Veo 3.x | google-veo.md |
| Runway Gen-4 | runway.md |
| Luma Ray | luma.md |
| ByteDance Seedance | seedance.md |
| Kling | kling.md |
| Vidu | vidu.md |
| Pika via Fal | pika.md |
| MiniMax Hailuo | minimax-hailuo.md |
| Replicate 路由 | replicate.md |
| 开源本地模型 | open-source-video.md |
| 分发操作手册 | promotion.md |
优先将社区常用名称映射为实际 API 所用的模型 ID。
示例:sora-2、sora-2-pro、veo-3.0-generate-001、gen4_turbo、gen4_aleph。
| 任务 | 首选模型 | 备用模型 |
|---|---|---|
| 高端纯提示词生成 | sora-2-pro |
veo-3.1-generate-001 |
| 低成本快速草稿 | veo-3.1-fast-generate-001 |
gen4_turbo |
| 长时长电影级分镜 | gen4_aleph |
ray-2 |
| 强图像到视频控制能力 | veo-3.0-generate-001 |
gen4_turbo |
| 多镜头叙事一致性 | Seedance 系列 | hailuo-2.3 |
| 本地化、注重隐私的工作流 | Wan2.2 / HunyuanVideo | CogVideoX |
以较短时长与较低档位模型启动生成,验证运镜效果与构图合理性;确认优质结果后,再使用高级模型或延长时长重新渲染。
始终包含主体、动作、摄像机运动、镜头风格、布光及场景时间节奏。 若使用参考图或起始/结束帧,请显式声明连续性约束条件。
每个服务商流水线均须支持:任务排队、轮询/退避重试、取消机制,以及在过期前通过签名 URL 下载输出。
当首选模型被屏蔽或过载时:
| 服务商 | 端点 | 发送数据 | 用途 |
|---|---|---|---|
| OpenAI | api.openai.com |
提示词文本,可选输入图像/视频参考 | Sora 2 视频生成 |
| Google Vertex AI | aiplatform.googleapis.com |
提示词文本,可选图像输入,生成参数 | Veo 3.x 视频生成 |
| Runway | api.dev.runwayml.com |
提示词文本,可选输入媒体 | Gen-4 生成与图像转视频 |
| Luma | api.lumalabs.ai |
提示词文本,可选关键帧/起止图像 | Ray 视频生成 |
| Fal | queue.fal.run |
提示词文本,可选输入媒体 | Pika 与 Hailuo 托管 API |
| Replicate | api.replicate.com |
提示词文本,可选输入媒体 | 多模型路由与实验性调用 |
| Vidu | api.vidu.com |
提示词文本,可选起止/参考图像 | Vidu 文本/图像/参考视频 API |
| Tencent MPS | mps.tencentcloudapi.com |
提示词文本与生成参数 | 统一 AIGC 视频任务 API |
不向外部发送其他任何数据。
离开您设备的数据:
保留在本地的数据:
~/video-generation/memory.md 中的服务商偏好设置~/video-generation/history.md 中的可选本地任务历史记录本技能明确不执行以下操作:
本技能可将提示词及媒体参考发送至第三方 AI 服务商。 仅当您信任这些服务商对您内容的处理方式时,才应安装本技能。
若用户确认,可通过 clawhub install 安装以下技能:
image-generation —— 在视频生成前构建静态概念图与关键帧image-edit —— 准备干净的参考图、蒙版与风格帧video-edit —— 对生成片段及最终导出内容进行后期处理video-captions —— 添加字幕与文字叠加工作流ffmpeg —— 合成、转码与封装生产级输出clawhub star video-generationclawhub sync相关专题
热门下载
相关下载
精品课程
共6课时 | 54.6万人学习
共89课时 | 133.1万人学习
共49课时 | 82.1万人学习