说话即成片,全程不用键盘:打开https://bot.n.cn→登录→点麦克风图标(chrome/edge可用,safari禁用)→确认“语音输入已就绪”→清晰说出主体、动作、时长→检查并修正转写文字→点击“生成视频”。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要用语音输入一句话,让纳米AI直接生成完整视频,跳过打字、改提示词、反复调试的环节——说话即成片,全程不用碰键盘,尤其适合开车通勤、手头正忙或打字慢的用户。
确认语音功能可用环境
打开 https://bot.n.cn/ → 登录账号 → 点击首页左下角搜索框右侧的麦克风图标。若图标呈灰色不可点,说明当前浏览器不支持Web Speech API,需换用Chrome或Edge最新版;【Safari在iOS和macOS上默认禁用该功能,切勿在此浏览器尝试】。
页面右上角显示“语音输入已就绪”且麦克风图标变蓝,即可开始说话。
说清楚这三件事,视频才不会跑偏
语音内容必须包含:① 视频主体(谁/什么在画面里)、② 核心动作或状态(正在做什么/呈现什么氛围)、③ 明确时长或用途(如“15秒抖音口播”“30秒儿童科普”)。
错误示范:“做个好看的视频”——系统无法识别“好看”指什么风格、节奏、对象,大概率生成通用风景空镜。
纳米AI是一款基于人工智能大模型技术开发的智能应用工具,主要用于提供AI问答、内容生成、信息整理与智能搜索辅助等功能。用户可通过自然语言交互方式获取结构化信息与文本内容,用于学习、办公及内容创作等多种场景。
正确示例:“生成一个20秒小红书种草视频,主角是穿白裙子的女生在咖啡馆窗边翻手账,阳光洒在纸页上,配轻快钢琴BGM。”
语音输入后的关键操作
说完后等2秒,页面自动显示转写文字。务必立刻检查:人名/地名/专有名词是否识别准确(如“洱海”误为“耳海”,“PPT”识别成“P P T”),错字会直接带入视频生成逻辑。
发现识别错误→点击文字区域手动修改→点击右侧“重新生成”按钮;未修改直接点击“生成视频”,系统将按错误文本执行全流程。
点击“生成视频”后,页面跳转至任务队列页,显示“正在规划分镜→生成画面→合成音画…”实时进度条。此时可关闭页面,系统后台全自动运行,通常90秒内生成完毕。










