微信公众号文章爬虫 - 将微信公号文章转换为 Markdown + 本地图片
wechat-article-spider是一项面向实际任务的技能,主要用于微信公众号文章爬虫 - 将微信公号文章转换为 Markdown + 本地图片;✅ 输入微信公号文章 URL;
微信文章可能有反爬机制,如遇失败可稍后重试;部分动态加载的图片可能无法获取;图片文件名使用哈。它将相关步骤、工具调用和结果整理方式集中到统一流程中,帮助使用者更快完成目标并减少重复操作。
从功能定位来看,该技能强调把分散的操作要求整理成清晰、可复用的处理流程,使用户能够围绕既定目标快速准备输入、选择执行方式并获得结构化结果。实际使用前应先确认任务范围、数据来源、运行环境、必要权限和关键参数,再依据技能说明逐步执行;若输入条件不完整,应先补齐信息或采用保守配置,避免因错误假设导致结果偏离需求。执行过程中需要关注工具调用是否成功、接口或依赖是否可用、输出格式是否符合预期,并对异常提示、缺失字段和边界情况进行处理;涉及批量任务时,还应保存进度,避免中断后重复操作。
微信公众号文章爬虫 - 将微信公号文章转换为 Markdown + 本地图片
cd scripts && pip install -r requirements.txt && python main.py
images/ 文件夹cd wechat-article-dl/scripts
pip install -r requirements.txt
python main.py <文章 URL> [输出目录]
# 下载到当前目录
python main.py https://mp.weixin.qq.com/s/xxxxx
# 指定输出目录
python main.py https://mp.weixin.qq.com/s/xxxxx ./my-articles
output/
├── 文章标题.md
└── images/
├── img_001_xxx.jpg
├── img_002_xxx.png
└── ...