aiohttp 默认 get() 不支持断点续传,因其不发 range 头、不校验 206 状态码、无偏移写入接口;需手动设 headers、验状态码、用 aiofiles seek 写入并处理 cdn 不一致等边界问题。

为什么 aiohttp 的默认 get() 无法直接支持断点续传
因为 aiohttp.ClientSession.get() 默认发起的是完整 GET 请求,服务端不会返回 Content-Range,也不会接受 Range 头——除非你显式带上它。更关键的是,它不暴露底层响应流的原始字节位置,也没提供「跳过已下载部分」的写入接口。所以不能靠“加个参数”就搞定,得自己控制请求头、状态码校验和文件写入偏移。
如何用 aiohttp 发起带 Range 头的异步请求并校验响应
必须手动设置 headers={'Range': 'bytes=1024-'} ,且只对返回 206 Partial Content 的响应做续传处理;如果服务端不支持 Range(比如返回 200),就得回退为全量下载或报错。常见错误是忽略状态码检查,导致把整个文件当片段写进中间位置,破坏数据。
- 始终检查
response.status == 206,否则中断流程 - 读取
response.headers.get('Content-Range')解析出当前段起始/结束字节,验证是否匹配预期(如bytes 1024-2047/10000) - 用
response.content.iter_chunked(8192)流式读取,避免内存暴涨
如何安全地将异步响应流写入文件指定偏移位置
Python 标准库的 open(..., 'r+b') 支持 seek(),但异步协程里不能直接用同步文件 IO——会阻塞事件循环。正确做法是:先用同步方式创建空文件并预分配大小(可选),再用 aiofiles 打开,并在每次写入前调用 file.seek(offset)。注意 aiofiles 的 seek() 是协程,必须 await。
- 首次下载前用
os.path.getsize()获取已存在文件大小,作为续传起点offset - 写入前必须
await file.seek(offset),否则内容会从开头覆盖 - 写完一段后更新
offset += len(chunk),别依赖文件指针自动移动 - 避免用
'ab'模式——它无视seek,永远追加
实际代码中容易漏掉的三个边界条件
一是服务端返回的 Content-Range 可能不带总长度(如 bytes 1024-*/*),此时无法预知文件总大小,得靠后续响应补全或靠 Content-Length 推算;二是网络中断后重试时,需重新获取当前本地文件大小,不能复用旧的 offset;三是多个并发请求写同一文件时,seek + write 不是原子操作,必须加锁或串行化写入。
最麻烦的其实是服务端行为不一致:有些 CDN 对 Range 请求返回 200 而非 206,有些则直接拒绝带 Range 的 HEAD 请求——这些都得在重试逻辑里单独识别和降级处理。
Python免费学习笔记(深入):立即使用
在学习笔记中,你将探索 Python 的核心概念和高级技巧!











