数字人模式是唯一官方支持单次直出60秒视频的功能,上传角色图+280–320字文案或严格60秒音频,选高品质模式即可生成口型同步的完整mp4;文字生成视频需手动设60秒并保持高表现画质;图生视频可通过双首尾帧或时间戳锚点分段逼近60秒。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你正在用可灵AI制作产品讲解、课程口播或电商推广视频,但发现默认输出只有5秒,无法完整表达信息,需要稳定生成1分钟(60秒)的连贯视频,且不依赖剪辑拼接或多次续写。
数字人模式一键生成1分钟视频
这是目前唯一官方明确支持单次直出60秒视频的功能,专为口播类内容设计,无需分镜、不依赖提示词长度,操作路径最短。
打开可灵AI官网或App→点击【数字人】入口→上传一张清晰正面的角色图(支持真人、动漫、动物等类型)→在文字输入框中粘贴60秒内能说完的文案(建议控制在280–320字,语速适中)。
选择“高品质”模式(1080p/48FPS),系统自动匹配TTS音色与情绪动作;若使用音频输入,则直接上传MP3/WAV文件,时长需【严格等于60秒】,超时会被截断,不足则静音补足。
点击“生成视频”,约2–4分钟完成,输出即为完整60秒MP4文件,口型、眼神、微动作全程同步。
文字生成视频:手动设为60秒并避开兼容陷阱
该方式适用于无真人出镜的场景化视频,比如品牌故事、产品功能演示,但必须主动干预参数,否则默认仍为5秒。
进入“文字生成视频”模式→输入完整描述性文案(如:“晨光中的智能咖啡机自动研磨、萃取、倾倒,最后杯沿浮起一层细腻奶泡”)→在右侧参数栏找到“视频时长”下拉菜单。
选择“60秒”档位→系统会自动将画质模式从“超清锐化”切换为“高表现”,【此切换不可逆,且若手动改回“超清锐化”,生成将失败并退回5秒】。
确认“运动校准”已开启,再点击生成。60秒视频将在7–9分钟内产出,首尾画面连贯,中间无跳帧。
图生视频:用首尾帧+分段锚点逼近60秒
当你已有关键画面,又希望保留镜头语言和运镜逻辑时,可用此法结构化生成接近60秒的内容,实际输出为两段各30秒视频,需手动合并。
方法一:双首尾帧分段控制
① 第一段:上传起始图A与过渡图B→设时长为30秒→提示词强调“缓慢平移推进”;
② 第二段:上传过渡图B与结束图C→同样设30秒→提示词加入“镜头拉升收尾”;
③ 两张过渡图B必须完全一致,像素级对齐,否则第二段首帧会出现穿模或抖动。
方法二:锚点嵌入强制节奏
在提示词末尾添加时间戳锚点:“[00:00]镜头从左向右扫过展台→[00:15]特写按钮亮起→[00:30]机械臂伸出抓取样品→[00:45]产品旋转360°展示细节”。
总时长按锚点累加计算,系统会据此分配画面密度,实测误差不超过±0.8秒。











