3分钟完成QQ空间历史说说导出:GetQzonehistory本地备份指南
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
有没有过这样的瞬间:想翻看十年前的某条说说,却翻到手指发酸,最终放弃。QQ空间那个"时间"入口,翻得越深越卡,页面还会时不时提醒你"加载更多"。更扎心的是,平台一旦调整策略,那些动态可能说没就没了。QQ空间历史说说导出,就是 GetQzonehistory 这个开源小工具存在的全部理由——它用最朴素的方式,把你账号下能看见的每一条说说、转发、留言和配图,整整齐齐搬回本地硬盘。
先说结论:这工具不需要你懂爬虫,不碰密码,全程扫码登录,跑完直接在resource/result/你的QQ号/里拿结果。下面按"从零到一"的顺序,带你完整走一遍。
出发前,先看看它替你干了哪些活
GetQzonehistory 本质上是一台"数字搬运机"。它先模拟登录 QQ 空间,拿到你的访问凭证,然后分页拉取历史消息列表和未删除的可见说说,最后把内容拆成几个文件落盘。
图:工具从扫码登录到导出数据的完整流程,每一步都有明确的分工模块
从流程图上能看出,它把"登录、请求、解析、保存"拆成了四个独立环节,各自对应util/目录下的一个模块。这种拆分的好处是:某一步出问题,你能直接从日志定位到是登录失效还是网络超时,不用对着整段代码抓瞎。
第一步:把运行环境搭起来
项目用 Python 写的,建议用虚拟环境隔离依赖,别污染系统环境。按下面的顺序执行:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 下是 myenv\Scripts\activate pip install -r requirements.txt这段命令在做三件事:下载项目源码、创建独立的 Python 环境(避免依赖冲突)、一次性装齐所有库。依赖清单里除了常见的requests、pandas、beautifulsoup4,还有pyzbar和qrcode——它们是扫码登录环节的"眼睛",负责在终端里把二维码渲染出来并解码。
小提醒:Linux/macOS 下如果提示找不到 zbar 共享库,需要先装系统级的 zbar,比如 Fedora 系执行
sudo dnf install -y zbar,装完再重跑 pip 那一步。
第二步:扫码登录,让程序自己开工
环境就绪后,运行主程序:
python main.py终端里会弹出一个 ASCII 码拼成的二维码(黑底白块,手机扫之前注意翻转识别)。用手机 QQ 扫一下、点确认,程序会立刻把登录凭证存到resource/user/目录,以后再次运行就不必重复扫码——它会先让你选"已登录用户",选 0 才重新登录。
登录成功后,程序自动开始干活:先二分探测你的消息总量,再每 10 条一批、每批间隔 3 秒地拉取历史消息列表,接着去抓未删除的可见说说,最后统一整理保存。全程有进度条,中途想停就按Ctrl+C,它会把已经抓到的那部分先存好再退出,不会白干。
第三步:验收成果,认识你的导出文件夹
跑完会听到系统自动帮你打开结果目录(Windows/macOS/Linux 都做了适配)。文件夹里躺着一整套文件,对应不同的内容类型:
图:
resource/result/你的QQ号/下的导出成果,Excel、网页版与图片目录一应俱全
QQ号_全部列表.xlsx:消息列表里的全部条目,含时间、内容、图片链接、评论QQ号_说说列表.xlsx/转发列表.xlsx:你自己的原创说说与转发动态分家QQ号_留言列表.xlsx/其他列表.xlsx:留言板与其他互动内容QQ号_好友列表.xlsx:消息列表里出现过的好友昵称、QQ 和空间主页QQ号_说说网页版.html:把说说和评论还原成网页时间线,头像、表情、图片都在,双击就能在浏览器里翻阅pic/文件夹:说说里的配图按内容命名存成本地文件
Excel 是全平台通用的格式,后续想筛选、统计都方便;网页版则适合直接分享给朋友一起回忆。两层输出,兼顾"数据"和"展示"两种需求。
进阶玩法:把更老的说说和高清图也捞回来
main.py抓的是消息列表里能看到的内容,如果你 2014 年之前的说说更想保住,可以再跑一下另一个入口:
python fetch_all_message.py这个脚本走的是另一条数据通道,专门拉取所有"未删除的可见说说",覆盖更早的时间段,并且会下载高清原图,最后把正文、图片、转发、评论按 Markdown 排版写进resource/fetch-all/所有可见说说.md。相当于给老照片补了一次"高清重制"。
两个入口的取舍很简单:想要 Excel 表格和网页时间线,用main.py;想把古董级说说连同高清图完整搬走,两个都跑一遍。
避坑清单:新手最容易踩的几个坑
- 仅自己可见的说说拿不到:工具只能读到消息列表和可见说说里出现的内容,QQ 的隐私限制决定了"仅自己可见"无法通过这种方式获取,别指望它。
- 网络波动别慌:请求有超时设置,失败批次会打印提示并跳过,不会让整个任务崩掉;重跑时已登录用户可直接复用,进度也不会从零再来。
- 图片重名会自动加时间戳:下载图片时若文件名撞车,程序会在后面拼上时间戳区分,不会互相覆盖。
- 别在高峰期大批量跑:每批请求之间已内置等待,属于正常限速,耐心等进度条走完即可。
写在最后:现在就去备份一次
QQ空间的每一条说说,都是某个时刻的你留下的坐标。与其等某天发现"页面加载不出来了"再后悔,不如现在就花三分钟把resource/result里的成果拿到手——一次备份,换来的是随时可翻、可搜索、可分享的本地记忆库。
动手吧:克隆项目 → 建虚拟环境 → 装依赖 →python main.py,扫码之后剩下的交给进度条。如果你还想要更早年份的完整记录,记得补跑一次fetch_all_message.py,两条腿走路,才叫真正的万无一失。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考