海螺ai文件上传有明确容量限制:pdf单次≤100mb且≤200页;语音克隆音频单个≤50mb、时长10–60秒;图生视频参考图建议≤1920×1080、体积
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您尝试使用海螺AI上传文件进行解析、问答或生成任务,但遇到上传失败、提示“文件过大”或系统无响应等问题,则可能是由于所选文件超出当前通道的尺寸限制。以下是针对不同文件类型与上传路径的具体容量边界说明:
一、PDF文档上传上限
海螺AI通过Minimax文档解析服务处理PDF时,单次Web界面上传最大支持100MB,且页面数不得超过200页。该限制适用于启用结构化提取与页码索引的完整解析流程,超限将直接拒绝接收并返回“文件过大”错误。
1、进入Minimax文档解析控制台,点击“新建解析任务”。
2、点击“选择文件”,系统自动校验扩展名与大小,若PDF超过100MB,按钮呈灰色不可点状态。
3、如遇超限,需使用pdfseparate或PyPDF2等工具预先切分为多个≤100MB的子文件,再逐个上传。
二、语音克隆音频样本限制
海螺AI海外版语音克隆功能对原始音频样本设定了明确的单次上传约束:每段音频时长须在10至60秒之间,单个文件体积不可超过50MB。该限制保障声纹建模精度,避免因过长静音段或高码率冗余数据干扰特征提取。
1、在Audio → Voices → Create your Voice Clone界面中点击“导入语音”。
2、选择本地音频文件,若文件大于50MB,页面将弹出红色提示框:“文件大小超出50MB限制,请压缩或截取有效语音片段”。
3、支持同时上传最多10个符合要求的音频样本,总时长建议控制在300秒以内以提升克隆稳定性。
三、图生视频与主体参考图像规格
用于图生视频起始帧或主体参考功能的人脸图像,虽无严格文件体积上限,但系统对分辨率与清晰度执行隐式拦截:当图像宽高乘积超过800万像素(例如3200×2500),或JPEG压缩质量低于60%,上传后将无法触发人脸检测框,导致功能失效。
1、使用手机原相机拍摄正面人脸照,保存为JPG或PNG格式。
2、上传后观察预览区域是否自动出现绿色人脸框;若未出现,请立即检查图像是否模糊、侧脸、强反光或存在帽子/眼镜遮挡。
3、建议图像尺寸控制在1920×1080以内,文件体积保持在1MB以下,以确保检测成功率与后续生成一致性。








