4步批量导出QQ空间全部历史说说:GetQzonehistory 实操指南
2026/9/20 21:16:26 网站建设 项目流程

4步批量导出QQ空间全部历史说说:GetQzonehistory 实操指南

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

现状切片:那些再也翻不到的说说

凌晨两点,同学转来一张 2015 年的旧照,你赶紧打开 QQ 空间想翻前情,页面往上翻着翻着就到底了——当年发的那条说说早被自己删掉,再也找不回来。再比如你想做个"十年纪念"回顾,手机屏幕刷到手酸,停在 2019 年,旧照片得靠相册一张张翻。

GetQzonehistory 是一个专门干这件事的 Python 小工具:替你登录 QQ 空间,把你这个 QQ 号发过的"历史说说"完整抓下来,连同图片、评论、互动过的好友,一起存成本地 Excel 和能直接打开的网页。读完这篇,你能从零拿回一份完整的"数字纪念册",也清楚哪些说说拿得到、哪些拿不到。

你带走的是:一套批量导出工具,加一条明确的边界。

前后对照:跑一遍它,差别在哪

翻阅:从"手动刷两小时"到"等一个进度条"。手动翻空间看旧帖,一屏 5~10 秒,回看十年要上千屏,一天都刷不完;工具按每批 10 条、间隔 3 秒的节奏抓,1000 条说说大约 15~30 分钟,你人可以直接走开。

覆盖:从"删了就没了"到"双保险"。说说页只能拿到"可见且未删除"的,你自己删过的全部消失;这个工具同时抓"QQ 空间互动消息列表"(删除的说说在那里还留痕),两路合并去重,已删说说的找回率从 0 到约 100%("仅自己可见"的除外)。

保存:从"截图几张"到"全套归档"。手动最多截几张图;工具产出 6 张 Excel 表(全部/说说/转发/留言/其他/好友)、全部图片的本地目录(自动换高清链接),再加一个双击就能打开的 HTML"网页版",五年后回看照样一条不少。

真正省下来的不是时间,是那份想再要时要不回来的"原件"。

原理走读:它怎么在一晚上读完你十年

打个比方,这像请了个图书管理员帮你整理失物招领箱:你不用自己翻,把"证件"(登录凭证)交出去,他按编号清点,一件件放进柜子。

  1. 先登录,后干活。运行后终端打印一个二维码,手机 QQ 扫一下,登录态缓存到本地,下次直接跳过,逻辑在 util/LoginUtil.py。
  2. 先找总数,再按序抓。消息总量它并不知道,于是用"二分查找"在 0~1000 万的区间里探测,约 24 轮就能锁定(见 util/RequestUtil.py)。
  3. 双路抓取,去重再入库。主程序main.py每批 10 条、间隔 3 秒拉消息列表,另走fetch_all_message.py的接口每页 30 条拉全部"可见未删除"说说,两路合并去重后分成 6 类输出。

对应关系就三行:

数据源抓取方式落盘位置
空间互动消息列表每批 10 条,间隔 3 秒全部列表 / 说说列表.xlsx
可见未删除说说每页 30 条分页转发列表 / 留言列表.xlsx
图片 / 评论 / 好友随消息一并下载pic/ 目录、好友列表.xlsx

不神秘:扫码登录 + 分页抓取 + 双路去重,一句话就能转述给朋友。

最快实践:从零到跑通全套归档

第 1 步:克隆仓库,建好虚拟环境。

git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory && python -m venv myenv

坑:别把依赖直接装进系统 Python;仓库源码保持只读不动,结果默认全写进 resource/ 目录。

第 2 步:装依赖,跑起来。激活 myenv(Windows 用.\myenv\Scripts\activate,macOS/Linux 用source myenv/bin/activate),然后:

pip install -r requirements.txt python main.py

requirements.txt 里 10 个依赖版本都钉死了,照装即可。

第 3 步:扫二维码,盯着进度条。Linux 下若提示找不到 zbar 共享库,先装再跑:

sudo dnf install -y zbar

第 4 步:按验收标准核对。打开resource/result/你的QQ号/:6 张 Excel 表 +你的QQ号_说说网页版.html+pic/图片目录,终端还打印最早一条说说的时间——齐了就跑通了。保存位置想换,改 resource/config/config.ini 里的三个路径就行。

不想碰 Python 的轻量路线:仓库 Release 页有打包好的单文件,双击直接跑,零编译零环境。

账本:一张表算清成本

维度指标改造前(手动)改造后变化
时间1000 条说说3~5 小时15~30 分钟约 1/10
覆盖已删除说说0(删了即没)约 100%(可见范围)0→100%
完整度旧照片手动截图,不全自动高清下载100% 原件
检索找某条旧帖翻上千屏Excel 筛选 3 秒小时→秒级

成本与环境:纯 Python 脚本、零编译,Python 3.8+ 的普通电脑就能跑,最重开销是网络等待;Linux 多一个 zbar 包。另有一笔账号成本:全程是你本人 QQ 的真实登录,不建议运行时手机端同时操作 QQ 空间,免得登录态互相干扰。

这笔账划不划算,取决于你有多怕"再也找不回"——越怕越划算。

延伸方向:把导出变成习惯

  • 增量归档:隔段时间跑一次,只取新增消息,养成月度"数字存档"。
  • 多账号:resource/user/ 目录支持存多个登录态,可以分别管理。
  • 格式再加工:说说表拿去做博客、年报、家庭相册,都是现成素材。
  • 隐私过滤:含他人隐私的条目,分享前先筛一遍。

边界清楚,它才能用得久、用得安全。

接下来 3 件事

  1. 今天就做:克隆 + 装依赖,先把登录二维码刷出来,确认环境没问题;
  2. 本周内:完整跑一次导出,对照终端打印的条数核对 6 张表;
  3. 长期:把resource/result/放进网盘或移动硬盘,每季度补跑一次增量。

发现解析失败、接口变动,欢迎去项目 issue 区提出来,或者自己改完发回去——这个工具能一直跑下去,靠的就是社区把接口变化一点点修好。

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询