必须选用“超拟人数字人”模板并搭配带「超拟人」标签的音色,才能实现语音驱动口唇自然开合;旧版数字人或普通tts音色会导致嘴部静止。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

让讯飞智作生成的数字人嘴巴自然动起来,核心在于驱动口唇动作与语音内容精准同步——这一步不依赖手动关键帧,而是由讯飞自研的超拟人TTS模型自动完成口型生成。
确保口唇动作生成的前提条件
打开讯飞智作小程序或网页端,进入「数字人视频」创作页→点击「新建项目」→选择「超拟人数字人」模板(非基础数字人或旧版形象)。
【必须选“超拟人数字人”模板,旧版数字人无口唇-表情-动作联合生成能力】
该模板自2024年10月首发,仅支持上传照片定制的形象或平台预置的超拟人形象,基础数字人库中的老形象即使上传照片也无法激活口唇驱动。
上传文案并触发语音合成
在编辑区粘贴或输入你要播报的文本(建议单次不超过800字,避免长句堆叠导致口型断续)。
点击「选择配音」→在语音列表中任选一个音色(推荐带「超拟人」标签的音色,如“晓晓-超拟人”“启明-超拟人”)→确认后系统自动启动语音合成+口唇建模双流程。
这一步操作起来很简单,直接点选即可;但注意:若误选未标注「超拟人」的普通TTS音色(如“小宇”“小燕”),则仅输出音频,【数字人嘴部将完全静止,不会张合】。
检查并导出带口型动作的视频
合成完成后,播放预览画面,重点观察人物口部是否随语音节奏开合——正常情况下,元音(如a、o、e)对应大开口,辅音(如b、m、p)对应闭唇或轻触,过渡自然无卡顿。
若发现口型滞后或错位:返回修改文案,删减口语化冗余词(例如“呃”“啊”“那个”等填充词),重新合成。
确认无误后,点击「导出视频」→选择分辨率(720P/1080P)→等待渲染完成→下载MP4文件。











