通过 fal.ai 使用 40 多种 AI 模型生成视频、图像、音频和音乐。用于视频生成 (Kling v3、Sora 2、Veo 3.1、LTX 2.3、Pixverse v5) 和图像生成
Corespy Art — 多模 AI Media 透過 fal.ai.是一项面向实际任务的技能,主要用于Auth: 以您的 fal.ai API 键设置 FA是一项面向实际任务的技能,主要用于Workflow.;Pick a model from the 下表.;
实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;
涉及批量任务时,还应保存进度,避免中断后重复操作。该技能适合用于一次性任务,也可以接入自动化工作流,与其他技能或上层代理配合完成更完整的业务链路;在组合使用时,应明确每一步的输入输出关系,并避免不同步骤之间出现参数冲突。
认证:将您的 fal.ai API 密钥设为环境变量 FAL_KEY(可在 https://fal.ai/dashboard/keys 获取)。
uv run {baseDir}/scripts/fal.py ENDPOINT --json '{"param":"value"}' -f output.ext [-i input.ext]
ENDPOINT — 来自参考文件的 fal.ai 模型路径(例如:fal-ai/nano-banana-2)--json — 以 JSON 对象形式传入的模型参数-f — 输出文件名-i — 待上传的输入文件(支持多次指定以上传多个文件),将自动注入为 image_url / image_urls / start_image_url / video_url--audio — 音频输入文件(用于唇形同步)| 模型 | 最适合场景 | 参考文档 |
|---|---|---|
| Nano Banana 2 | 专业级质量、支持网页搜索、具备推理能力 | 阅读 nanobanana.md |
| FLUX 2 Pro | 照片级写实效果、零配置启动 | 阅读 flux.md |
| FLUX Schnell | ⚡ 迭代速度最快 | 阅读 flux.md |
| FLUX Pro v1.1 | 加速推理、支持商用 | 阅读 flux.md |
| FLUX.1 Dev | 120 亿参数、支持微调 | 阅读 flux.md |
| GPT Image 1.5 | 透明背景、强指令遵循能力 | 阅读 gpt.md |
| Qwen Image 2 Pro | 中英文双语支持、排版优化、原生 2K 分辨率 | 阅读 qwen.md |
| Recraft V4 Pro | 设计/营销场景、色彩控制精准 | 阅读 recraft.md |
| Seedream 5 Lite | 多图编辑、具备推理能力 | 阅读 seedream.md |
| 模型 | 最适合场景 | 参考文档 |
|---|---|---|
| Kling v3 Pro I2V | 最佳图像转视频(I2V)、支持多镜头、音频驱动、时长 3–15 秒 | 阅读 kling.md |
| Sora 2 T2V | 长视频生成(最长 20 秒)、角色一致性好 | 阅读 sora.md |
| Sora 2 I2V | 基于 Sora 的图像转视频(I2V) | 阅读 sora.md |
| Veo 3.1 T2V | 电影级质感 + 原生音频/对白支持 | 阅读 veo.md |
| Veo 3.1 I2V | 支持音频驱动的图像转视频(I2V) | 阅读 veo.md |
| LTX 2.3 T2V Fast | ⚡ 快速生成、最高支持 2160p/20 秒、开源模型 | 阅读 ltx.md |
| LTX 2.3 I2V | 图像转视频(I2V),支持指定起始帧与结束帧 | 阅读 ltx.md |
| Pixverse v5 I2V | 动漫、3D、黏土、赛博朋克等风格 | 阅读 pixverse.md |
| 模型 | 最适合场景 | 参考文档 |
|---|---|---|
| MiniMax Speech-02 HD | 支持 30+ 种语言、具备响度归一化能力 | 阅读 minimax-speech.md |
| 模型 | 最适合场景 | 参考文档 |
|---|---|---|
| Beatoven Music | AI 音乐生成,最长支持 90 秒 | 阅读 beatoven-music.md |
| 工具 | 最适合场景 | 参考文档 |
|---|---|---|
| Topaz Upscale | AI 图像/视频超分(2×–4×) | 阅读 topaz.md |
| BRIA RMBG | 专业级背景移除 | 阅读 bria-rmbg.md |
| Sync Lipsync | 基于音频驱动的视频唇形同步 | 阅读 sync-lipsync.md |
uv run 将在首次运行时自动创建隔离虚拟环境,并安装 fal-client 依赖。yyyy-mm-dd-hh-mm-ss-name.ext。MEDIA: 开头的行,供 OpenClaw 自动挂载使用。相关专题
热门下载
相关下载
精品课程
共6课时 | 54.6万人学习
共89课时 | 133.1万人学习
共49课时 | 82.1万人学习