需开通千问api服务并配置环境变量,用dashscope sdk上传pdf调用qwen-long模型生成四要素摘要,批量处理需限频重试,结果保存为指定格式docx并清理file_id。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要用千问AI的API自动处理一批PDF报告并生成结构化摘要,而不是手动上传或粘贴文本。
准备API调用环境
前往阿里云百炼平台开通千问大模型服务,获取API Key与Endpoint地址。这一步必须完成,否则后续所有请求都会返回401错误。
安装Python SDK:执行pip install dashscope,确保版本不低于4.25.0——旧版本不支持qwen-long模型的文件上传接口。
【API Key必须保存在环境变量DASHSCOPE_API_KEY中,不能硬编码在脚本里】。直接写死密钥会导致代码泄露风险,且一旦被轮换就需全量修改。
上传文档并触发摘要任务
方法一:单文件同步摘要
调用dashscope.File.upload()上传PDF文件,返回file_id;该ID有效期为24小时,超时后需重新上传。
构造prompt参数,内容为:“请通读以下文档,按‘背景-核心问题-关键数据-结论建议’四要素生成300字以内中文摘要”,并将file_id填入input.files字段。
发送HTTP POST请求至/v1/chat/completions,模型名指定为qwen-long。注意:qwen-long是唯一支持128k上下文且能直读上传文件的模型,qwen-max或qwen-plus无法解析file_id。
方法二:批量异步处理
对文件夹内全部PDF循环执行上传→获取file_id→发起摘要请求,但必须控制QPM≤100。可在每次请求后插入time.sleep(0.6)强制限频,避免触发429 Too Many Requests错误。
若某次响应含error.code == 'ResponseTimeout',需实现重试逻辑:最多重试3次,每次间隔2秒递增(2s→4s→6s),并在重试前检查file_id是否仍有效。
解析并保存摘要结果
第一步:从API响应的response.output.choices[0].message.content中提取纯文本摘要内容。
第二步:检查返回JSON是否含output.usage.total_tokens字段——若缺失,说明模型未完成推理,应丢弃该结果并记录error日志。
第三步:将摘要内容写入同名.docx文件,使用python-docx库创建文档,标题设为加粗16号字,正文为10.5号仿宋_GB2312字体,段间距固定28磅。这一步必须用指定字体,否则交付物会被客户退回。
第四步:调用dashscope.File.delete(file_id)清理已处理文件。不删除会导致账户文件数达上限(1万个)后无法继续上传。
大量免费API接口:立即使用
涵盖生活服务API、金融科技API、企业工商API、等相关的API接口服务。免费API接口可安全、合规地连接上下游,为数据API应用能力赋能!











