lovart制作ai视频是让ai智能体理解创意意图、拆解步骤并自动调用多模态模型生成可发布成片的过程,实测最快2分47秒完成从文案到mp4的全流程。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

用Lovart制作AI视频不是把文字扔进去等结果,而是让AI设计智能体理解你的创意意图、拆解执行步骤、自动调用视觉与语音模型、输出可直接发布的成片——整个过程从输入原始文案到导出MP4,实测最快2分47秒。
用一句话直接生成带配音的完整视频
打开星流Agent中文版(https://www.xingliu.art)→ 登录后点击「新建视频」→ 在对话框中输入一句完整需求,例如:“一只橘猫蹲在窗台看雨,尾巴轻轻摆动,窗外闪电划过,配音用慵懒男声说‘这雨,下得比我的计划还乱’”。
系统会自动解析语义:识别主体动作(蹲、摆尾)、环境变化(闪电)、情绪锚点(慵懒、调侃),并同步调度图生图、口型驱动、TTS语音合成、节奏匹配模块。生成的视频已含画面、配音、基础音效与合理时长,无需额外剪辑。
【必须用中文完整句描述,不能只写关键词;否则AI无法触发多模态协同流程】
用已有图片生成动态视频(图生视频)
方法一:官网画布内直接操作
进入 https://www.lovart.ai → 点击「画布」→ 拖入一张高清静态图(建议分辨率≥1024×1024,主体清晰、边缘无遮挡)→ 点击右上角「生成视频」按钮 → 选择时长(3s/5s/10s)和运动强度(轻微晃动/自然呼吸感/中等运镜)→ 点击生成。
方法二:精准控制镜头语言
上传图片后,在提示词框中输入结构化指令,例如:“保持原场景构图不变;仅让左侧窗帘缓慢飘动,窗台上的绿植叶片微微摇晃;镜头以极缓慢速度向右平移2°;全程使用柔光,色温保持在4800K”。
这一步的关键在于“锁定不变量”——AI会严格遵循“保持…不变”类表述,避免主体变形或背景错位。若未加此限定,生成结果可能出现人物肢体扭曲或背景元素漂移。
制作双角色对口型对话视频
第一步:生成两个角色首帧图像
在Lovart中分别输入两组提示词,确保核心特征一致:服装颜色、发型、光照方向、背景元素完全相同,仅表情与朝向不同。例如:
角色A:“金渐层英短猫,戴黑色监听耳机,直视镜头,嘴角微扬”;
角色B:“银渐层英短猫,同款耳机,略侧脸看向A,眉头轻皱”。
第二步:上传至即梦(https://jimeng.jianying.com)进行口型驱动
选择「数字人」模块 → 分别上传两张首帧图 → 为每张图绑定独立音色(建议用同一音色库中的相近声线)→ 输入对应台词,如A说“你昨晚又偷吃我的罐头”,B说“我那是帮你试毒”。
第三步:下载两段视频,导入剪映做声画同步
在剪映中将两段视频轨道对齐,手动拖动使嘴型动作与音频波形峰值重合;启用「自动踩点」功能辅助节奏对齐;导出前关闭剪映自带的AI配音,保留即梦生成的原始语音。
【两段视频必须使用相同分辨率与帧率,否则剪映时间轴会出现错帧】











