4步备份B站数据:用InfoSpider开源工具导出你的全部观看历史
【免费下载链接】InfoSpiderINFO-SPIDER 是一个集众多数据源于一身的爬虫工具箱🧰,旨在安全快捷的帮助用户拿回自己的数据,工具代码开源,流程透明。支持数据源包括GitHub、QQ邮箱、网易邮箱、阿里邮箱、新浪邮箱、Hotmail邮箱、Outlook邮箱、京东、淘宝、支付宝、中国移动、中国联通、中国电信、知乎、哔哩哔哩、网易云音乐、QQ好友、QQ群、生成朋友圈相册、浏览器浏览历史、12306、博客园、CSDN博客、开源中国博客、简书。项目地址: https://gitcode.com/GitHub_Trending/in/InfoSpider
你有没有想过,自己这几年看过的视频,其实随时可能找不回来?在B站App里翻观看历史只能一页页点,想完整导出又毫无入口。InfoSpider 是一个完全开源的个人数据拿回工具箱,它的B站数据备份功能,能把你的观看历史与账号信息完整导出成本地 JSON 文件。
为什么用InfoSpider做B站数据备份
观看历史这类数据没有完整的官方导出入口,而不少商用工具需要你把账号凭证交给对方服务器,心里总不踏实。InfoSpider 代码全部开源可查,从登录、爬取到落盘都在你自己的电脑上完成,数据不出本地,这也是它和“黑盒工具”最大的区别。
| 备份方式 | 操作成本 | 数据完整性 | 隐私安全 | 耗时 |
|---|---|---|---|---|
| 官方入口手动截图记录 | ★★★★★ | ★★☆☆☆ | ★★★★★ | 数小时 |
| 商用第三方工具 | ★★☆☆☆ | ★★★☆☆ | ★☆☆☆☆ | 30分钟 |
| InfoSpider开源工具 | ★☆☆☆☆ | ★★★★★ | ★★★★★ | 5分钟 |
准备工作:两条命令装好依赖
环境要求很简单:
- Python 3.6+ 与 pip3
- Chrome 浏览器,且安装同版本的 ChromeDriver(用于自动弹出登录窗口)
- Windows / macOS / Linux 均可
git clone https://gitcode.com/GitHub_Trending/in/InfoSpider cd InfoSpider pip3 install -r requirements.txt验证点:安装完成后运行python3 -V能看到版本号,依赖才算就绪。
4步完成B站观看历史导出
第1步:启动工具箱并选择哔哩哔哩数据源
运行python3 tools/main.py,会弹出“拿回你的个人信息”窗口。点击第三行的“哔哩哔哩”图标。
预期结果:自动弹出新浏览器窗口,并跳转到B站登录页。
第2步:扫码登录B站账号
用B站App扫描页面左侧的二维码,比账号密码登录更安全,也不用担心密码泄露。
验证点:扫码成功后页面自动跳转、浏览器窗口关闭,工具箱底部状态栏显示“爬取中...”。
第3步:选择数据保存的文件夹
程序会弹出“选择信息保存文件夹”对话框。新建一个如bili_backup的目录并确认,方便日后归档。
预期结果:控制台反复打印“爬取中...”,直到出现“爬取完成...”,全程约1分钟。
第4步:打开文件夹查看导出结果
打开你刚选的目录,应看到两个 JSON 文件,且大小均不为 0,说明数据写入成功。
导出的两个文件怎么读
| 文件 | 核心内容 | 能用来做什么 |
|---|---|---|
| bilibili_history.json | 每条观看记录:视频标题、UP主、观看时间、视频链接、分类 | 找回失落的视频、统计观看习惯 |
| user_info.json | 昵称、用户ID、个性签名、会员状态 | 账号状态存档、等级成长记录 |
历史文件里的每条记录都带完整视频链接,想重温老视频直接点开即可。字段含义更详细的说明,可查阅 项目文档中的哔哩哔哩章节。
常见报错:3个高频问题一次解决
现象:浏览器弹不出来,或打开登录页后报错可能原因:ChromeDriver 与 Chrome 版本不一致。 解决办法:下载与当前 Chrome 相同大版本的 ChromeDriver,放入系统 PATH 后重启程序。
现象:导出文件是空的,或只有一页记录可能原因:登录实际未成功,或 Cookie 已过期,接口返回了空数据。 解决办法:重新执行第2步,确认扫码登录后页面已跳转;若仍为空,稍等几分钟再重试。
现象:运行提示缺少 wx 等模块可能原因:依赖没有装全或装到了错误的 Python 环境。 解决办法:在项目根目录重新执行pip3 install -r requirements.txt,并确认用的是 Python 3.6 以上。
安全建议与进阶玩法
InfoSpider 所有数据都在本地处理,爬取逻辑完全透明,不会把你的 Cookie 发给任何第三方。再加一道保险更安心:
- 把备份文件夹权限设为仅当前用户可访问
- 定期将 JSON 文件加密后存到移动硬盘或网盘
- 避免在公共 WiFi 环境下做导出操作
进阶方向:
- 用 pandas 等工具对历史 JSON 做统计,生成观看时段分布、分类偏好图表,看看自己深夜都追什么番
- 用同一套工具箱继续备份邮箱、京东订单、知乎专栏等数据,逐步建起完整的个人数据档案
把主动权握回自己手里
每一次点击、每一集追过的番,都是你的生活痕迹。用 InfoSpider 的4步操作,B站数据从此真正存进你自己的硬盘。
📌 收藏本文,下次备份B站数据时,5分钟就能跑完全流程。
【免费下载链接】InfoSpiderINFO-SPIDER 是一个集众多数据源于一身的爬虫工具箱🧰,旨在安全快捷的帮助用户拿回自己的数据,工具代码开源,流程透明。支持数据源包括GitHub、QQ邮箱、网易邮箱、阿里邮箱、新浪邮箱、Hotmail邮箱、Outlook邮箱、京东、淘宝、支付宝、中国移动、中国联通、中国电信、知乎、哔哩哔哩、网易云音乐、QQ好友、QQ群、生成朋友圈相册、浏览器浏览历史、12306、博客园、CSDN博客、开源中国博客、简书。项目地址: https://gitcode.com/GitHub_Trending/in/InfoSpider
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考