seko支持用正面照片生成会说话的视频,需符合人脸占比、光线、背景等入库要求,上传后生成“主角_01”并绑定项目,插入@主角_01标记调用,配音时开启强制绑定口型驱动确保同步。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要用自己的一张正面照片生成会说话的视频,但不确定Seko是否支持、上传后角色会不会变形、口型是否能对上——这些问题在Seko里有明确解法。
确认照片是否符合主体入库要求
进入SEKO官网 https://seko.sensetime.com/ 登录账号→点击右上角头像→选择「主体库」→点击「新增主体」。
上传前必须检查:照片需为正面、无遮挡、纯色或浅色背景,人脸占画面60%以上,光线均匀无反光;戴眼镜需镜片不反光,刘海不能遮眉眼。
不满足上述条件的照片,AI将无法准确提取面部特征向量,后续所有分镜中人物会出现五官错位、嘴角歪斜或眨眼不同步等不可逆问题。
上传并绑定个人形象到项目
方法一:直接上传证件照生成标准主体
在「新增主体」页面点击「上传照片」→选择本地文件→等待3秒完成解析→系统自动生成“主角_01”资产卡片,并显示面部关键点定位图(共68个)。
方法二:用文字描述补全细节(仅限无照片时)
点击「输入描述词」→填写“28岁亚洲男性,寸头,左眉有痣,穿深灰连帽衫”,AI据此生成初始形象;但此方式生成的角色在口型驱动下稳定性低于实拍照片,【务必在生成首帧后立即点击“设为全局锚点”】,否则第二帧开始脸部结构可能漂移。
在视频生成中调用你的照片主体
第一步:新建项目→选择「数字人视频」模式
第二步:在脚本输入框粘贴台词,例如:“大家好,我是小李,今天带你们看看我的新工作室。”
第三步:在台词开头插入主体标记→输入“@主角_01”,系统即锁定该形象参与全部画面生成与口型驱动。
第四步:点击「生成分镜」→等待AI完成首帧渲染→预览区出现你本人形象开口说话的画面。
若首帧未出现你上传的照片特征,请立即返回主体库检查“主角_01”状态是否为“已激活”,未激活则无法被项目调用。
对口型环节的关键操作
生成分镜后,点击右上角「配音与对口型」→上传一段MP3格式人声录音(建议手机备忘录直录,采样率44.1kHz)→系统自动切分音节并映射至面部骨骼。
此时注意:必须点击画布中人物→右侧栏开启「强制绑定口型驱动」开关,否则AI会按通用模型模拟嘴型,导致“啊”音做“哦”形、“嗯”音闭嘴不动。
生成完成后逐帧拖动预览,重点检查0.5秒内嘴部开合节奏是否与音频波形峰值同步;不同步则返回重传音频,不要强行导出。











