音述ai支持mp3、wav、flac、m4a、aiff、ogg、wma音频及mp4、mov、mkv、avi、mpeg、webm视频,不支持drm加密或损坏文件;无损格式(wav/flac)分离效果最优,mp3需≥128kbps,手机录屏mp4易致伴奏残留。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想用音述AI工具快速提取歌曲伴奏或人声,却卡在第一步:不确定自己的MP4视频或FLAC高保真音频能不能直接上传处理?
音述AI支持的输入格式清单
音述AI接受以下全部音视频格式,无需提前转换:
✅ 音频类:MP3、WAV、FLAC、M4A(AAC)、AIFF、OGG、WMA
✅ 视频类:MP4、MOV、MKV、AVI、MPEG、WEBM
⚠️ 注意:不支持加密文件(如DRM保护的Apple Music下载文件)或损坏/不完整文件,上传前请确认能正常播放。
哪些格式处理效果更优?
本地处理时,WAV和FLAC这类无损格式分离质量最高——AI模型能捕捉更多原始频谱细节,人声边缘更干净,伴奏低频更扎实。
MP3虽广泛兼容,但若码率低于128kbps,可能出现高频模糊或鼓点衰减;MP4视频文件会自动提取内嵌音频轨道再分离,画面信息不影响结果。
【关键提醒】不要用手机录屏生成的MP4上传,其音频常含严重压缩失真和环境噪音,AI易误判人声边界,导致伴奏残留明显。
输出格式与设置
分离完成后,默认输出为WAV格式,保留最高保真度。
方法一:点击“导出设置”→下拉选择“MP3(320kbps)”→确认后生成压缩版,适合微信发送或手机播放。
方法二:勾选“保持原始采样率”→输出文件将继承源文件参数(如44.1kHz/16bit),避免二次采样失真。
方法三:需要多轨工程使用?点击“高级导出”→启用“分轨打包ZIP”,一次性获得人声.wav + 伴奏.wav + 鼓组.wav + 贝斯.wav 四个独立文件。











