必应壁纸接口唯一可靠入口是www.bing.com/hpimagearchive.aspx,返回json含壁纸元数据;需拼接https://www.bing.com前缀及\_1920x1080后缀获取高清图,加user-agent头、校验状态码、规范文件名(用startdate)、异常重试并日志记录。

必应壁纸接口已变更,www.bing.com/HPImageArchive.aspx 仍是唯一可靠入口
必应官方未提供公开API文档,但长期稳定维护 HPImageArchive.aspx 这个查询端点。它返回 JSON,包含当天及历史若干天的壁纸元数据(URL、分辨率、版权信息等)。注意:该接口默认返回 1366x768 尺寸图,需手动拼接 URL 获取高清原图;且 idx=0 表示“今天”,idx=1 是昨天,不能传负数或过大值(最大支持 idx=7)。
常见错误是直接请求返回的 url 字段——它带的是相对路径(如 /th?id=OHR.XXX_1366x768.jpg),必须拼上 https://www.bing.com 才能下载。
- 推荐加
format=json&n=1&cc=us&pid=hp参数,确保返回结构一致 -
cc参数影响地区专属图(如cc=cn可能返回中国主题图,但稳定性略低) - 不要依赖
copyrightlink或title字段做文件名——含特殊字符或为空,易导致写入失败
用 requests + urllib.parse 安全拼接高清图地址
必应返回的 url 是带查询参数的缩略图地址,真正高清原图需将路径中的 _1366x768(或类似后缀)替换为 _1920x1080,再补全协议和域名。但更稳妥的方式是提取 urlbase 字段(如 /th?id=OHR.XXX),再手动追加尺寸与格式:
base_url = "https://www.bing.com" + data["images"][0]["urlbase"]
full_url = f"{base_url}_1920x1080.jpg"
这样做避免因 CDN 路径变动或重定向导致的 404。如果下载时返回 404,大概率是尺寸后缀不匹配——可尝试 _UHD、_1920x1200 等变体,但 _1920x1080 覆盖率最高。
- 务必加
headers={"User-Agent": "Mozilla/5.0..."},否则部分请求会被 403 拒绝 - 用
requests.get(..., stream=True)下载大文件,防止内存爆掉 - 检查响应状态码,
r.status_code != 200时别直接写文件
保存文件前必须规范化文件名,否则 Windows/macOS 会报错
直接用 title 或 copyright 当文件名极危险:Windows 禁止 :"/\|?*,macOS 对 Unicode 处理也敏感。正确做法是提取 date 字段(如 20240520)+ 固定前缀,例如 bing_20240520.jpg。
data["images"][0]["startdate"] 是最可靠的日期源,格式为 YYYYMMDD,无需解析。若想保留原始分辨率信息,可追加后缀如 bing_20240520_1920x1080.jpg。
- 避免使用
os.path.join()拼路径时漏掉目录分隔符——建议统一用pathlib.Path - 下载前先
mkdir -p目标目录,否则FileNotFoundError会中断脚本 - 写文件用
with open(..., "wb") as f:,别用文本模式
定时运行要处理网络失败和重复下载
这个脚本本质是 HTTP 依赖型任务,本地网络抖动、必应临时限流、DNS 解析失败都可能导致中断。不要假设每次都能成功——得有重试、跳过、缓存记录机制。
最轻量的做法:每次运行前读取一个本地标记文件(如 last_downloaded.txt),存上次成功的 startdate;本次请求接口后,若 startdate 相同就跳过。这样即使断网一天,恢复后也不会重复下载。
- 用
time.sleep(1)避免高频请求(虽然必应对此并不严格,但礼貌一点) - 把
requests包裹进try/except requests.RequestException,别让异常崩掉整个流程 - 日志输出到文件比 print 更实用,方便查哪天失败了
高清图 URL 并非永久有效,一般 30 天内可访问,所以不必存历史图集——每天只抓当天的,最稳。
Python免费学习笔记(深入):立即使用
在学习笔记中,你将探索 Python 的核心概念和高级技巧!











