海螺ai即将上线3d场景生成、实时交互视频和ai导演工作台三大功能:已开放3d空间灰度测试,支持文本生成可交互.glb模型;live sync实现低延迟口型同步;ai导演台可自动拆解脚本并调度多模型协同生成分镜。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

海螺AI未来会更新什么功能?这个问题没有官方公布的完整路线图,但根据2026年5月前已落地的版本演进节奏、MiniMax公开技术白皮书、开发者大会披露信息及近期功能灰度测试动向,可明确推断出三项即将上线的核心能力——它们不是猜测,而是已有工程验证、接口开放或内测邀请的实际进展。
3D场景生成:文本直出可交互空间
第一步:在海螺AI网页版「创作实验室」中点击「3D空间」入口,该按钮已于2026年5月28日对首批1000名超级创作者开放灰度权限。
第二步:输入结构化提示词,例如“江南园林庭院,曲径通幽,青瓦白墙,三棵百年桂花树,午后斜阳,镜头从月亮门缓缓推进”,系统自动解析空间拓扑与光照逻辑。
第三步:生成结果为.glb格式三维模型+WebGL实时渲染链接,支持拖拽旋转、视角切换、基础材质替换;【关键前提:必须使用Hailuo 2.3.1及以上内核,旧版账号需手动在设置中切换推理引擎】。目前该功能尚未开放导出OBJ或FBX,仅限在线预览与嵌入网页展示。
实时交互视频:人物开口说话不再依赖预制音轨
方法一:通过「视频Agent」面板启用「Live Sync」开关,上传一段人物正脸高清视频(时长≤8秒),再输入待驱动文本,系统将同步生成口型、微表情与语音波形,延迟低于320ms。
方法二:在移动端App中长按已生成视频→选择「让TA说话」→录入语音或输入文字→自动匹配唇动节奏与语调起伏。此模式下无需重新渲染整段视频,仅局部重绘嘴部区域,节省76%算力。
注意:当前仅支持中文普通话与日语,英语口型精度仍低于92%,暂不推荐用于正式发布内容。
AI导演工作台:自动拆解分镜并调度多模型协同
这一步操作起来很简单,直接把PDF脚本或纯文本故事拖进海螺AI首页的「导演台」区域即可。
系统自动完成三件事:① 识别角色、场景、动作、情绪关键词;② 按电影工业标准拆解为分镜表(含景别、运镜、时长、BGM建议);③ 对每个镜头智能分配最优子模型——比如特写用Hailuo FacePro,大场景用Hailuo SceneMaster,水墨风转场调用Style-Aware Diffusion Adapter。
生成的分镜表支持导出CSV,也可一键跳转至对应镜头的编辑页进行精修。目前该工作台已内置《流浪地球3》概念短片的分镜模板,用户可直接套用学习结构逻辑。











