端到端AI视频生成 - 通过文本提示创建视频,支持图像生成、视频合成、配音和编辑。支持OpenAI DALL-E、Replicate模型、LumaAI、Runway和FFmpeg编辑。
AI Video Center Skill.是一项面向实际任务的技能,主要用于General 完整视频,使用 AI. 能力.;Image Center - DALL-E 3, Stable Difusion, Flux.;
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。
执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。该技能适合用于一次性任务,也可以接入自动化工作流,与其他技能或上层代理配合完成更完整的业务链路;在组合使用时,应明确每一步的输入输出关系,并避免不同步骤之间出现参数冲突。
使用 AI,根据文本描述生成完整视频。
# 生成完整视频
python skills/ai-video-gen/generate_video.py --prompt "山巅日落" --output sunset.mp4
# 仅将图像序列合成为视频
python skills/ai-video-gen/images_to_video.py --images img1.png img2.png --output result.mp4
# 添加配音
python skills/ai-video-gen/add_voiceover.py --video input.mp4 --text "您的旁白内容" --output final.mp4
请添加至您的环境变量或 .env 文件中:
# 图像生成(任选其一)
OPENAI_API_KEY=sk-... # DALL-E 3
REPLICATE_API_TOKEN=r8_... # Stable Diffusion、Flux
# 视频生成(任选其一)
LUMAAI_API_KEY=luma_... # LumaAI Dream Machine
RUNWAY_API_KEY=... # Runway ML
REPLICATE_API_TOKEN=r8_... # 多种模型
# 配音(可选)
OPENAI_API_KEY=sk-... # OpenAI TTS
ELEVENLABS_API_KEY=... # ElevenLabs
# 或使用免费本地方案(无需 API)
pip install openai requests pillow replicate python-dotenv
已通过 winget 自动安装。
python skills/ai-video-gen/generate_video.py
--prompt "一座拥有飞行汽车的未来主义城市夜景"
--duration 5
--voiceover "欢迎来到未来"
--output future_city.mp4
python skills/ai-video-gen/multi_scene.py
--scenes "清晨日出" "繁忙的城市街道" "宁静的夜晚"
--duration 3
--output day_in_life.mp4
python skills/ai-video-gen/images_to_video.py
--images frame1.png frame2.png frame3.png
--fps 24
--output animation.mp4
generate_video.py — 主要的端到端视频生成器images_to_video.py — 将图像序列转换为视频add_voiceover.py — 为已有视频添加旁白multi_scene.py — 创建多场景视频edit_video.py — 应用特效、转场与叠加图层参见 examples/ 目录,内含样例输出及提示词(prompts)。
相关专题
热门下载
相关下载
精品课程
共6课时 | 54.6万人学习
共89课时 | 133.1万人学习
共49课时 | 82.1万人学习