十年QQ空间回忆还安全吗?GetQzonehistory使用教程:一键导出全部历史说说
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
你有没有想过,过去十年发过的那些QQ空间说说,其实正在悄悄消失?当你翻遍空间主页只看到最近几条动态时,才会意识到:那些记录青春的照片、深夜的心情、朋友的回复,随时可能再也找不回来。GetQzonehistory 就是为QQ空间说说备份而生的免费开源工具——扫码登录一次,就能把账号下的全部历史说说完整导出到本地,从此不再担心回忆丢失。
深夜翻空间时,我意识到一个问题
那是一个普通的周末晚上,我忽然想看看大学时发过的说说。打开空间主页,往下划了不到二十条,就到头了。明明记得写过很多东西:毕业旅行、深夜吐槽、和室友的互相调侃……它们去哪了?
我试着截图、复制、整理,折腾了一晚上,只保存了十几条。那一刻我意识到:平台的动态列表是有上限的,手动搬运是永远搬不完的。我需要一个能把"历史说说"整体搬回家的方案。
如果你也有同样的焦虑,这篇 GetQzonehistory使用教程就是为你准备的。它解决的核心问题只有一个:把QQ空间历史说说导出成你能永久保存的文件。
5分钟装好环境,只差三条命令
你不需要懂编程。项目基于 Python 开发,安装依赖后直接运行即可。先把项目克隆到本地:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory然后创建一个虚拟环境(推荐,避免污染系统环境):
python -m venv myenv激活它:Windows 用.\myenv\Scripts\activate,macOS/Linux 用source myenv/bin/activate。最后安装依赖:
pip install -r requirements.txt依赖里是 requests、pandas、beautifulsoup4、qrcode 这类常见库,几分钟就能装完。如果下载慢,可以换成国内镜像源:
pip install -i https://pypi.tuna.tsinghua.edu.cn/simple -r requirements.txt到这里,环境就绪,下一步是登录。
扫码登录:不输密码,反而更安心
运行主程序:
python main.py终端里会生成一个二维码。掏出手机 QQ 扫一下,确认登录,程序就开始干活了。
这个设计很巧妙:全程不需要输入密码,也就没有密码泄露的风险。登录凭证会以 cookie 形式保存在本地resource/user/目录,下次运行程序时它会自动识别已登录用户,直接选择账号继续备份,省去重复扫码。
温馨提示:登录状态会缓存。如果想换账号,在提示选择用户时输入
0重新登录即可。
一次运行,能拿回哪些数据?
跑完整个流程后,程序会自动完成四件事,这也是它最核心的能力:
- 抓取全部历史说说:通过 QQ 空间的消息列表接口,分页拉取账号下所有可见的动态,包括文本、发布时间、图片链接和评论;
- 补充"仅自己可见"的内容:主程序还会调用另一个接口,尝试恢复消息列表中缺失的、未删除的说说(这也是项目取名 Get"Qzone"history 的原因之一);
- 分类整理成多张表格:说说、转发、留言、好友、其他内容被拆分成不同的 Excel 文件,方便检索;
- 批量下载所有配图:说说里的每张图片都会存到本地
pic/目录,图片以说说内容命名,即使原链接日后失效,照片依然完好。
抓取过程中,每读取 10 条数据会休息几秒再继续,这是为了降低请求频率、避免触发平台限制。就算中途断网或手动中断,程序也会先保存已抓到的数据再退出——这一点在 main.py 里写得很清楚,很贴心。
一张流程图看懂整个备份过程
从扫码登录到数据落地,完整链路是这样的:
可以看到,流程包含登录、数据获取、内容解析、结果生成以及异常处理分支。每一步都有对应的代码模块,如果你好奇具体实现,可以翻一翻util/目录下的源码,模块划分得很清晰。
导出结果长什么样?打开就知道值了
备份完成后,所有文件会存放在resource/result/[你的QQ号]/目录下,结构如下:
里面最值得打开的是两个文件:
[QQ号]_全部列表.xlsx:时间、内容、图片链接、评论四列,结构规整,适合后续做数据分析;[QQ号]_说说网页版.html:程序把说说、转发、留言合并后按时间倒序渲染成了网页,带头像、昵称、图片和评论区,视觉上几乎还原了 QQ 空间网页版的浏览体验,双击就能在浏览器里翻看。
对绝大多数人来说,这个 HTML 文件就是"把空间搬回家"最直观的成果。
备份完成后,这两件事值得试试
做一份自己的"年度回忆报告"
导出的 Excel 就是现成的数据源。用几行 pandas 代码,就能统计你每年发了多少条说说:
import pandas as pd df = pd.read_excel('[QQ号]_说说列表.xlsx') df['时间'] = pd.to_datetime(df['时间']) df['年份'] = df['时间'].dt.year print(df['年份'].value_counts().sort_index())哪一年话最多、哪一年最沉默,一目了然。这份数据比任何年度总结都真实。
给空间做一次"体检"
看看[QQ号]_好友列表.xlsx,你会发现这些年互动过的人、他们的空间主页链接都被记录下来了。有人可能已经很少联系,但那些共同经历过的说说还在——这正是备份的意义。
进阶:只备份指定年份的说说
想给备份划定范围?在main.py的数据抓取循环里加一个时间判断即可,思路是这样:
from datetime import datetime for i in trange(int(count / 10) + 1, desc='Progress', unit='10条'): # 获取数据后,解析发布时间 if put_time and str(datetime.now().year) in put_time: # 只处理当年的说说同理,你也能在resource/config/config.ini里调整结果输出路径,把备份文件导出到指定的目录或移动硬盘,实现"备份文件不落地"。
卡住了?这三个问题最常见
扫码后一直显示"二维码认证中"别急,这是正常的轮询状态。如果超过两分钟没反应,可能是二维码已过期,重新运行程序生成新二维码即可。同时确认手机 QQ 处于登录状态、系统时间准确。
只能导出部分说说网络不稳定或请求过于频繁都可能导致漏数据。程序支持断点续跑——重新运行时会基于已缓存的登录状态继续,所以多跑一两次通常就能补齐。
图片下载失败个别图片链接失效是正常现象。图片链接已经保存在 Excel 的"图片链接"列里,可以手动打开补救;同时检查pic/目录是否有写入权限。
关于隐私,有几点可以放心
这个项目在设计上有几个值得信任的地方:
- 数据全程本地处理:所有抓取、解析、导出都在你自己的电脑上完成,不上传任何服务器;
- 只拿登录凭证,不碰密码:通过官方二维码登录,cookie 只保存在本地
resource/user/目录; - 代码完全开源:从 main.py 到
util/下各个模块,每一步逻辑都可以自己审查。
当然,工具仅限用于备份自己的账号内容。另外建议:备份完成后,可以删除resource/user/里的登录缓存,再给导出文件夹做一次加密或异地复制,双保险。
现在就开始备份
十年说说的价值,往往在失去之后才被意识到。好消息是,备份的最佳时机就是今天。
现在就可以行动:克隆仓库 → 装好依赖 → 运行python main.py扫码登录。半小时后,你就能在resource/result/[你的QQ号]/目录下,重新翻阅那些以为已经消失的青春。让每一段文字、每一张照片,都成为真正属于你的数字记忆。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考