GetQzonehistory 一键快速备份 QQ 空间全部历史说说,Excel、网页、图片全都有
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
GetQzonehistory 是一个免费开源的 QQ 空间说说导出工具:扫码登录一次,它就能抓取你账号下的全部历史说说,并整理成 Excel 表格、网页存档和本地图片文件夹。适合 QQ 空间用了多年、想把数据握在自己手里的人。先看一个具体场景:大学时发过的一条说说、深夜截屏的一段对话,它们躺在平台的数据库里,任何一次改版或账号风险都可能让这些数据消失。备份这件事本身不复杂,十分钟就够。
为什么值得花十分钟备份空间说说
数字足迹并不像你以为的那样永久:
- 产物成套:一次运行同时生成 Excel、网页存档和图片文件夹,之后做统计、做回顾、做归档都不用再跑第二次;
- 不碰密码:全程靠手机扫码完成登录,不需要输入或共享你的 QQ 密码;
- 中断有保护:中途手动停止,已抓取的内容会先落盘再退出,不会前功尽弃。
从克隆代码到第一次运行:QQ 空间说说导出完整步骤
前置条件只有一句:电脑装好Python 3.7 及以上版本、能联网、手机里装着 QQ(用于扫码);macOS 和 Linux 还需要系统级的 zbar 库(启动时程序会检测并提示你安装)。然后按顺序执行四步:
- 把代码拉到本地:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory- 建一个独立的虚拟环境并激活,避免污染系统 Python:
python -m venv myenv # Windows 激活:myenv\Scripts\activate;macOS / Linux 激活:source myenv/bin/activate- 一条命令装齐全部依赖,requirements.txt 里每个库的版本都已锁定:
pip install -r requirements.txt- 启动主程序,用手机 QQ 扫终端里的二维码:
python main.py启动后终端会打印一个字符二维码,手机扫完确认授权,剩下的一切程序都会自动完成。
导出产物清单与验收方式
跑完后程序会直接打开结果文件夹,所有文件都在resource/result/你的QQ号/下:
| 产物 | 内容 |
|---|---|
QQ号_全部列表.xlsx | 抓取内容的汇总,全量检索用它 |
QQ号_说说列表.xlsx | 你本人发布的说说 |
QQ号_转发列表.xlsx | 你转发过的动态 |
QQ号_留言列表.xlsx | 空间留言板互动记录 |
QQ号_好友列表.xlsx | 抓取过程中识别出的好友昵称、QQ、主页 |
QQ号_其他列表.xlsx | 与你相关的他人内容 |
QQ号_说说网页版.html | 还原成时间线的网页版 |
pic/ | 说说中的图片,逐张下载保存 |
验收就三件事:随便打开一个 Excel 看列是否完整,双击 HTML 看浏览器能否正常渲染,对比pic/里的图片数量和说说里出现的图片是否大体一致。三种形态各司其职——表格管数据、网页管翻阅、图片夹管素材,互不重复。
程序启动后按什么顺序工作
扫码登录与登录态复用
程序先从服务器取回登录二维码打印在终端,扫码成功后登录态会存进resource/user/目录。以后再运行,直接出现已登录用户列表:输入序号复用登录态,输入0重新扫码登录。
总量估算与分批抓取
程序先用二分法探测你消息列表的总条数,终端里能看到实时进度条;然后每 10 条一批逐批拉取,每批结束后还会暂停约 8 秒。这是内置的限速设计,慢是刻意的,不是卡死。
补抓消息列表里没有的说说
消息列表并不覆盖全部历史,所以程序还会走空间接口按 30 条一页拉取"未删除说说",连 2014 年之前的早期内容也能取到,再和第一路数据去重合并,把遗漏压到最小。
中断时的数据保护
⏸️ 中途想停,直接按Ctrl+C即可。程序在信号处理里做了保护:先把已抓到的数据完整保存,再退出。
两个入口脚本怎么选:main.py 对比 fetch_all_message.py
仓库里藏着两个入口,一个求全、一个求轻:
| 维度 | python main.py | python fetch_all_message.py |
|---|---|---|
| 数据来源 | 消息列表 + 未删除说说,双通道 | 只走"未删除说说"接口,分页拉取 |
| 输出形态 | Excel 多表 + HTML 网页 + 图片文件夹 | 一份所有可见说说.md+ 同目录图片 |
| 保存位置 | resource/result/QQ号/ | resource/fetch-all/ |
| 适合谁 | 要全套资产:做统计、建相册、发网页 | 习惯纯文本记录,Markdown 方便存档和版本管理 |
怎么定:想统计、想翻阅就选 main.py;想拥有一份能直接丢进笔记软件的 Markdown 时间线,就跑 fetch_all_message.py。两者不冲突,可以先后各来一次。
常见问题与处理方法
扫码时提示"二维码已失效"?
二维码有有效期,扫太慢就会过期。重新运行python main.py拿新码,出来就扫。
macOS / Linux 提示找不到 zbar 库?
pyzbar 依赖系统级解码库,macOS 用brew install zbar即可,程序检测到 Homebrew 时还会引导你自动装;Linux 按终端提示安装对应发行版的包。
抓取速度很慢,是出问题了吗?
每批 10 条加主动暂停是限速保护机制。只要终端进度条在动就属正常,数据量大时耐心等就行。
明明发过的说说为什么没被抓到?
如果那条说说设为"仅自己可见",它本来就不在消息列表里,工具无从获取,这是平台权限决定的,不算故障。
第二次运行时出现用户列表是什么情况?
这是登录态复用:输入序号接着用之前的登录,输入 0 重新扫码。换账号备份时选 0 即可。
涉及合规要注意什么?
工具仅供学习和技术研究,README.MD 开头附有完整免责声明。只备份自己账号的 QQ 空间数据,别去抓别人的内容,也不要用于商业用途。
导出之后的数据后处理建议
- 在 Excel 里按年份筛选,做一份"我的十年大事记";
- 按月份统计发帖数量,找出自己最话痨的那几个月;
- 把
pic/里的照片按主题分类,重新拼一个个人相册; - 把
说说网页版.html发给朋友,浏览器打开就能一起翻旧账。
结尾:把主动权拿回来
回到开头那条大学时的说说——它还在平台的数据库里等你做决定,而不是替你保管。今晚打开终端,完成克隆、装依赖、扫码这三件事,几分钟后全部说说就会安静地躺在本地resource/result/目录里。剩下要做的,就是按下回车。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考