百度一镜2026年5月升级后,首页导航改为四大入口,智能体注册为前置条件;直播间新增生成式开播并支持情绪调节;视频混剪启用多模态识别;实时互动数字人响应延迟降至1.8秒。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你想快速掌握百度一镜2026年5月品牌升级后新增的实用功能和操作逻辑变化,避免在新版界面里反复找入口、试错重做、浪费制作时间。
新版首页导航结构变化
登录百度一镜(yijing.baidu.com)后,首页顶部导航栏从原来的“直播→视频→互动”三级菜单,改为横向平铺的四大核心入口:【数字人直播间】、【数字人视频】、【实时互动数字人】、【AI智能体工作台】。
原“形象制作”“声音复刻”等二级功能已移至【AI智能体工作台】内统一管理,不再散落在各场景页底部。
【入口迁移后首次操作必须先完成智能体注册】——未注册智能体前,点击任意场景页均会弹出引导页,要求选择“创建新智能体”或“关联已有智能体”,否则无法进入编辑界面。
数字人直播间:新增“生成式开播”模式
方法一:传统脚本驱动开播(保留兼容)
上传已写好的AI视频脚本→选择数字人形象→设置商品链接→点击“立即开播”。
方法二:生成式开播(新版默认推荐)
输入商品标题+卖点关键词(如“控油祛痘洁面慕斯,含水杨酸+烟酰胺”)→点击“智能生成脚本”→系统30秒内输出带节奏感、分时段话术的完整直播脚本→自动匹配口型与手势动作→直接推流。
这一步操作起来很简单,但注意:生成式开播默认启用“情绪动态调节”模块,数字人语气会随话术内容自动切换兴奋/专业/亲切等状态,若需全程保持单一语调,须在脚本生成后点击右上角⚙️→关闭“情绪自适应”开关。
数字人视频:一键混剪逻辑重构
第一步:上传原始素材(支持MP4/MOV/AVI,单文件≤4GB)
第二步:勾选“智能混剪”→系统自动识别画面中人物动作、产品特写、字幕位置
第三步:在时间轴右侧选择预设模板(如“爆款口播型”“测评对比型”“剧情种草型”)→点击应用
第四步:拖拽调整片段顺序,双击片段可替换AI配音或插入自定义旁白
旧版混剪依赖人工标记关键帧,新版改用多模态对齐技术,能直接理解“主播拿起牙膏挤出膏体”这类动作语义。但若上传素材中存在严重抖动、逆光或遮挡,系统可能误判动作节点,此时需手动在时间轴上拖动绿色校准条修正。
实时互动数字人:响应延迟压缩至1.8秒内
进入【实时互动数字人】→点击“新建互动体”→上传真人10秒以上无遮挡正脸视频(建议自然光、固定机位)→等待3分钟完成克隆→开启“实时问答模式”。
新版将语音识别、意图解析、动作生成三模块深度耦合,端到端平均响应时间降至1.8秒(实测P95值),比旧版快0.7秒。这意味着用户提问后几乎无感知等待,数字人即可同步眨眼、点头并开口回应。
注意:该模式下不支持手动插入预制话术,所有回复均由AI大脑实时生成,因此严禁在政务、医疗等强合规场景中跳过“内容安全过滤器”开关。











