纳米ai知识库自2025年3月11日起支持mp3、m4a、wav、mp4、mov等音视频格式上传,单文件上限200mb,支持拖拽或手动上传,视频需1.2~3倍时长解析,完成后提供转写文本、关键截图和时间轴,网页导入需页面公开且无drm保护。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

纳米AI知识库能导入音频和视频,2025年3月11日起已正式支持mp3、m4a、wav、mp4、mov等常见音视频格式,单文件上限200 MB,无需转码可直接上传解析。
导入本地音频文件
方法一:点击左侧【知识库】→右侧选择【上传文件】→在弹出窗口中选取本地mp3/m4a/wav文件→确认上传。
方法二:直接将音频文件拖入知识库上传区域,松手即开始上传。这一步操作起来很简单,直接把文件拖进去就行。
【单个音频文件不能超过200 MB】,超限会提示“文件过大”,此时需用剪辑工具提前截取关键片段再上传。
导入本地视频文件
点击【知识库】→【上传文件】→勾选mp4/mov/avi等视频格式文件→等待上传完成→系统自动启动多模态解析(含画面关键帧提取+语音转文字+语义摘要)。
视频上传后不会立刻生成可用内容,需等待后台完成解析,时长为视频实际时长的1.2~3倍。例如一段10分钟的会议录像,通常需12~30分钟处理完毕。
纳米AI是一款基于人工智能大模型技术开发的智能应用工具,主要用于提供AI问答、内容生成、信息整理与智能搜索辅助等功能。用户可通过自然语言交互方式获取结构化信息与文本内容,用于学习、办公及内容创作等多种场景。
解析完成后,你可在知识库条目详情页看到“语音转写文本”“关键画面截图”“事件时间轴”三栏内容,全部支持划词提问。
从网页链接导入音视频
第一步:确保目标网页公开可访问,且音视频为嵌入式播放(如B站、小红书、微信公众号内嵌视频)或直链可下载(如云盘分享页中的mp4链接)。
第二步:在知识库右上角点击【+添加】→选择【网页链接】→粘贴URL→点击【导入】。
第三步:系统识别到页面含音视频资源后,会弹出格式选择框,勾选“提取音频”或“提取视频”或“全部提取”→确认。
注意:YouTube、Netflix等受DRM保护的平台链接无法提取,会返回“不支持的媒体源”提示。










