4步批量导出QQ空间全部历史说说:GetQzonehistory 实操指南
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
现状切片:那些再也翻不到的说说
凌晨两点,同学转来一张 2015 年的旧照,你赶紧打开 QQ 空间想翻前情,页面往上翻着翻着就到底了——当年发的那条说说早被自己删掉,再也找不回来。再比如你想做个"十年纪念"回顾,手机屏幕刷到手酸,停在 2019 年,旧照片得靠相册一张张翻。
GetQzonehistory 是一个专门干这件事的 Python 小工具:替你登录 QQ 空间,把你这个 QQ 号发过的"历史说说"完整抓下来,连同图片、评论、互动过的好友,一起存成本地 Excel 和能直接打开的网页。读完这篇,你能从零拿回一份完整的"数字纪念册",也清楚哪些说说拿得到、哪些拿不到。
你带走的是:一套批量导出工具,加一条明确的边界。
前后对照:跑一遍它,差别在哪
翻阅:从"手动刷两小时"到"等一个进度条"。手动翻空间看旧帖,一屏 5~10 秒,回看十年要上千屏,一天都刷不完;工具按每批 10 条、间隔 3 秒的节奏抓,1000 条说说大约 15~30 分钟,你人可以直接走开。
覆盖:从"删了就没了"到"双保险"。说说页只能拿到"可见且未删除"的,你自己删过的全部消失;这个工具同时抓"QQ 空间互动消息列表"(删除的说说在那里还留痕),两路合并去重,已删说说的找回率从 0 到约 100%("仅自己可见"的除外)。
保存:从"截图几张"到"全套归档"。手动最多截几张图;工具产出 6 张 Excel 表(全部/说说/转发/留言/其他/好友)、全部图片的本地目录(自动换高清链接),再加一个双击就能打开的 HTML"网页版",五年后回看照样一条不少。
真正省下来的不是时间,是那份想再要时要不回来的"原件"。
原理走读:它怎么在一晚上读完你十年
打个比方,这像请了个图书管理员帮你整理失物招领箱:你不用自己翻,把"证件"(登录凭证)交出去,他按编号清点,一件件放进柜子。
- 先登录,后干活。运行后终端打印一个二维码,手机 QQ 扫一下,登录态缓存到本地,下次直接跳过,逻辑在 util/LoginUtil.py。
- 先找总数,再按序抓。消息总量它并不知道,于是用"二分查找"在 0~1000 万的区间里探测,约 24 轮就能锁定(见 util/RequestUtil.py)。
- 双路抓取,去重再入库。主程序
main.py每批 10 条、间隔 3 秒拉消息列表,另走fetch_all_message.py的接口每页 30 条拉全部"可见未删除"说说,两路合并去重后分成 6 类输出。
对应关系就三行:
| 数据源 | 抓取方式 | 落盘位置 |
|---|---|---|
| 空间互动消息列表 | 每批 10 条,间隔 3 秒 | 全部列表 / 说说列表.xlsx |
| 可见未删除说说 | 每页 30 条分页 | 转发列表 / 留言列表.xlsx |
| 图片 / 评论 / 好友 | 随消息一并下载 | pic/ 目录、好友列表.xlsx |
不神秘:扫码登录 + 分页抓取 + 双路去重,一句话就能转述给朋友。
最快实践:从零到跑通全套归档
第 1 步:克隆仓库,建好虚拟环境。
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory && python -m venv myenv坑:别把依赖直接装进系统 Python;仓库源码保持只读不动,结果默认全写进 resource/ 目录。
第 2 步:装依赖,跑起来。激活 myenv(Windows 用.\myenv\Scripts\activate,macOS/Linux 用source myenv/bin/activate),然后:
pip install -r requirements.txt python main.pyrequirements.txt 里 10 个依赖版本都钉死了,照装即可。
第 3 步:扫二维码,盯着进度条。Linux 下若提示找不到 zbar 共享库,先装再跑:
sudo dnf install -y zbar第 4 步:按验收标准核对。打开resource/result/你的QQ号/:6 张 Excel 表 +你的QQ号_说说网页版.html+pic/图片目录,终端还打印最早一条说说的时间——齐了就跑通了。保存位置想换,改 resource/config/config.ini 里的三个路径就行。
不想碰 Python 的轻量路线:仓库 Release 页有打包好的单文件,双击直接跑,零编译零环境。
账本:一张表算清成本
| 维度 | 指标 | 改造前(手动) | 改造后 | 变化 |
|---|---|---|---|---|
| 时间 | 1000 条说说 | 3~5 小时 | 15~30 分钟 | 约 1/10 |
| 覆盖 | 已删除说说 | 0(删了即没) | 约 100%(可见范围) | 0→100% |
| 完整度 | 旧照片 | 手动截图,不全 | 自动高清下载 | 100% 原件 |
| 检索 | 找某条旧帖 | 翻上千屏 | Excel 筛选 3 秒 | 小时→秒级 |
成本与环境:纯 Python 脚本、零编译,Python 3.8+ 的普通电脑就能跑,最重开销是网络等待;Linux 多一个 zbar 包。另有一笔账号成本:全程是你本人 QQ 的真实登录,不建议运行时手机端同时操作 QQ 空间,免得登录态互相干扰。
这笔账划不划算,取决于你有多怕"再也找不回"——越怕越划算。
延伸方向:把导出变成习惯
- 增量归档:隔段时间跑一次,只取新增消息,养成月度"数字存档"。
- 多账号:resource/user/ 目录支持存多个登录态,可以分别管理。
- 格式再加工:说说表拿去做博客、年报、家庭相册,都是现成素材。
- 隐私过滤:含他人隐私的条目,分享前先筛一遍。
边界清楚,它才能用得久、用得安全。
接下来 3 件事
- 今天就做:克隆 + 装依赖,先把登录二维码刷出来,确认环境没问题;
- 本周内:完整跑一次导出,对照终端打印的条数核对 6 张表;
- 长期:把
resource/result/放进网盘或移动硬盘,每季度补跑一次增量。
发现解析失败、接口变动,欢迎去项目 issue 区提出来,或者自己改完发回去——这个工具能一直跑下去,靠的就是社区把接口变化一点点修好。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考