如何批量备份QQ空间全部历史说说?GetQzonehistory 完整实操指南
2026/9/20 11:08:15 网站建设 项目流程

如何批量备份QQ空间全部历史说说?GetQzonehistory 完整实操指南

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

翻到十年前那条说说时才发现,页面上"加载更多"点不动了——云端的数据不会陪你永远留着,截图存不全,收藏夹里的链接也会慢慢失效。GetQzonehistory 是一款开源的 QQ 空间历史说说备份工具:扫码登录一次,它就能把账号下能获取到的全部历史消息(说说、转发、留言、好友、配图)抓取下来,整理成 Excel 表格、网页版页面和高清图片目录,全部存进你自己的硬盘。

它到底替你解决哪三个真实问题

问题一:云端的回忆说没就没。空间的消息列表随时可能因平台调整、数据清理而变少,而这份工具把"能拿到的都拿下来",落盘之后就不依赖平台了。

问题二:手动截图存不全、也存不齐。逐条截图不仅累,时间、评论、配图还散落各处。它按每批 10 条的节奏自动推进,跑完后直接产出结构化的表、网页和图片目录,中途就算按Ctrl+C退出,已抓到的数据也会先完整写入本地再结束(中断保护逻辑在 main.py 的signal_handler里)。

问题三:原始网页没法做二次利用。想统计"哪年发得最多"、想迁移数据,对着网页无从下手。它导出的每一列都是独立字段——时间精确到秒、图片链接单列、评论单独拆分,直接喂给 Excel 或 Python 就能用。

适合谁用:在空间写了几年内容、想给数字回忆上一道保险的人;想批量统计、归档、迁移自己动态的人。不适合谁用:只想看最近几天动态的(打开空间更快);以及任何打算拿它去采集他人数据的人——见文末的边界说明。

三分钟拿到第一份备份:从克隆到出结果

整条路径就是一条命令接一条命令,没有任何需要理解的内核:

git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv # 建一个隔离的运行环境,避免污染本机 Python # Windows: .\myenv\Scripts\activate | macOS/Linux: source myenv/bin/activate pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt python main.py

依赖下载慢的话,上面那条pip install已经带了国内镜像源,一般不用额外折腾。如果启动时报"找不到 zbar 共享库"(它是负责识别屏幕二维码的组件),Linux 执行sudo dnf install -y zbar,Debian/Ubuntu 对应apt install libzbar0;macOS 上 util/LoginUtil.py 内置了引导,跟着提示用 Homebrew 装好即可。

运行后屏幕会打印一个二维码,用手机 QQ 扫一下就算登录了——密码全程不出现在任何环节。登录凭据(Cookie)缓存在resource/user/目录,下次运行会先列出已登录的用户让你选,输入 0 可以重新扫码换号,不必反复操作。

跑起来后你会看到进度按每批 10 条推进、批次间固定停 3 秒。这个节奏是刻意放慢的,目的是降低请求频率、保护账号稳定,所以耐心等就好。跑完程序会自动打开导出文件夹,并报出总条数、最早一条说说的时间、各列表数量和图片总数。

落盘之后,这批数据你能拿来做什么

一切结果都在resource/result/你的QQ号/下面,分三块,各有各的用法:

六张 Excel 表——负责"可处理"。分别是:全部列表(所有消息汇总)、说说列表(你自己发的)、转发列表、留言列表(留言板互动)、其他列表(朋友在你空间的动态)、好友列表(昵称、QQ、空间主页地址)。每行含时间内容图片链接评论四列。拿到手就能做统计,比如用几行 Pandas 数出每年发了多少条:

import pandas as pd df = pd.read_excel('你的QQ号_说说列表.xlsx') df['时间'] = pd.to_datetime(df['时间'], format='%Y年%m月%d日 %H:%M:%S') print(df['时间'].dt.year.value_counts().sort_index())

哪年话痨、哪年沉默,一目了然。再往下还能统计高频词、配图数量变化,编译成一份专属的"年度回忆报告"。

你的QQ号_说说网页版.html——负责"可翻阅"。说说与转发按时间倒序渲染成一页:头像、昵称、发布时间、正文、配图、评论一应俱全,QQ 表情还会还原成图片,双击即开、不依赖网络。很适合当一份个人电子档案长期留存。

pic/目录——负责"可留存"。所有配图自动下载,文件名取自说说内容;抓取时还会把缩略图链接替换成高清版本。即便日后原链接失效,本地这张高清图依然完好。

一句话:表给工具用,网页给眼睛看,图片管长久——三件套互不重叠。

想跑得更远?两个进阶入口

入口一:fetch_all_message.py 补抓脚本。主程序走的是"历史消息列表"通道,而这个脚本走"说说列表"通道,专门抓取所有可见且未删除的说说(覆盖 2014 年之前的更早数据),同步下载高清图,并额外输出一份所有可见说说.md。它的请求缓存独立放在resource/fetch-all/目录,重复运行直接复用缓存、不会反复请求,适合和main.py配合把覆盖范围补全。

入口二:定时归档,让档案保持新鲜。一次性备份解决的是"存量",但新动态还在持续产生。把运行命令写进系统计划任务——Linux/macOS 用一行 crontab,Windows 用任务计划程序——每月自动重跑一次,新写下的每条最终都会追加进这份档案。配合网页版一起看,就是一条不断延长的个人时间线。

动手之前,先看清三条诚实边界

哪些内容天生抓不到。抓取依赖空间的历史消息列表,列表之外的东西不在范围内——最典型的就是"仅自己可见"的说说,这类它拿不到。另外网络不稳时可能漏掉个别批次,保持网络通畅、必要时分多次运行即可。

你的数据归你,这条可以核对。抓到的数据只写入本机硬盘,不上传任何第三方服务器;密码不收集、不保存;Cookie 存在本地resource/user/,不放心随时删掉重登。登录、请求、解析逻辑分别在 util/LoginUtil.py、util/RequestUtil.py、util/GetAllMomentsUtil.py 里,全程开源可审查。

使用的边界。项目官方文档自带免责声明:工具仅供学习与技术研究使用,不得用于商业或非法用途。备份的对象应当是"你自己"的空间内容,别拿去采集他人数据——尊重平台规则与个人隐私,是用任何工具的前提。

现在就跑一次,把回忆攥回自己手里

云端是租来的格子间,本地硬盘才是不动产。今晚花三分钟扫一次码,让十年前那条说说带着原文和高清图,安安静静躺进你自己的文件夹里——十年后再翻开,依然一字不差。🛡️

【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询