豆瓣书影音数据需主动备份,官方不支持一键导出,可行方法包括:一、用“豆伴”扩展导出excel;二、通过官方“个人信息导出”获取基础元数据;三、手动构造链接保存html;四、用油猴脚本导出csv/json;五、用firefox+downthemall批量下载资源。

如果您在豆瓣积累了大量书影音标记,但担心账号异常导致数据丢失,则需主动导出这些结构化记录。豆瓣官方未提供一键导出书影音的完整功能,仅支持有限的个人信息导出;书影音数据需依赖第三方工具或半自动方式获取。以下是多种可行的备份方法:
一、使用“豆伴”浏览器扩展导出Excel
“豆伴”是目前兼容性最佳、操作最直观的豆瓣数据备份工具,可完整抓取您标记的“读过/在读/想读”书籍、“听过/在听/想听”音乐、“看过/在看/想看”电影及电视剧,并生成含标题、评分、日期、短评、链接的Excel表格。
1、访问Chrome或Edge浏览器扩展商店,搜索并安装扩展“豆伴:豆瓣账号备份工具”。
2、确保已登录豆瓣网页版,在浏览器地址栏右侧点击“豆伴”图标。
3、选择「新建任务」,勾选「读书」「电影」「电视」「音乐」等目标模块。
4、点击「新建」后等待任务完成,状态显示“已完成”即可。
5、点击「浏览备份」,在列表中找到对应任务,点击右侧「导出为Excel」按钮下载.xlsx文件。
二、通过豆瓣官方「个人信息导出」获取基础元数据
豆瓣APP及网页端均内置官方导出入口,虽不包含详细书影音条目,但可导出账户基础信息、关注关系、豆列、日记标题等辅助数据,作为备份补充。
1、打开豆瓣APP,点击左上角【菜单】(或三横图标)。
2、进入【设置】页面,向下滚动找到并点击【个人信息导出】。
3、输入已验证的邮箱地址,点击【提交】。
4、约数分钟至数小时内,将收到一封含下载链接的邮件,链接有效期为24小时,请务必及时下载。
5、解压ZIP包后,查看其中的JSON与CSV文件,书影音相关字段仅含统计数量(如“读过:127本”),不含明细条目。
三、手动构造永久链接批量抓取(无需插件)
豆瓣每个用户页面均有固定URL结构,可绕过主页直接访问特定分类页。配合浏览器开发者工具或简单脚本,可实现无插件式页面采集,适用于无法安装扩展的环境。
1、确认您的豆瓣ID,例如主页为https://www.douban.com/people/abc123/,则ID为“abc123”。
2、构造以下类型链接,逐个打开并保存网页源码或截图:
读过书籍页:https://book.douban.com/people/abc123/collect
想看电影页:https://movie.douban.com/people/abc123/wish
在听音乐页:https://music.douban.com/people/abc123/do
3、对每页使用浏览器“另存为”HTML文件,保存时选择“网页,完整”格式以保留图片和样式。
4、将所有保存的HTML文件按类型归类,放入同一文件夹便于后续整理或解析。
四、使用油猴脚本一键导出结构化数据
油猴脚本可在豆瓣原页面注入导出功能,直接生成CSV或JSON格式的纯文本数据,无需离开当前页面,适合熟悉前端操作的用户。
1、在浏览器中安装Tampermonkey(油猴)扩展。
2、访问公开可信的脚本仓库,安装脚本“豆瓣读书+电影+音乐导出工具”。
3、登录豆瓣后,访问个人主页或任意分类页(如“我看过的电影”),页面右上角将出现“导出CSV”按钮。
4、点击按钮,浏览器将自动生成并下载一个包含标题、年份、评分、标记时间、短评等内容的CSV文件。
5、该文件可直接用Excel或文本编辑器打开,无需额外解析。
五、结合Firefox与DownThemAll批量下载页面资源
对于需要保留封面图、短评截图及页面布局的用户,可利用Firefox浏览器配合DownThemAll扩展,将整页书影音列表中的所有图片与HTML资源一次性下载归档。
1、在Firefox浏览器中安装扩展DownThemAll!。
2、打开目标页面,例如https://movie.douban.com/people/abc123/collect。
3、右键页面空白处,选择“DownThemAll! → 下载此页面中的所有链接”。
4、在弹出窗口中筛选条件:勾选“仅图片”“仅HTML”,排除广告与外部域名资源。
5、设置保存路径,点击“开始下载”,全部资源将按原始URL层级结构存入本地文件夹。











