三步搞定微信聊天记录导出:wechat-dump 把你的安卓聊天变成永久HTML档案馆
【免费下载链接】wechat-dumpAnalyzing your wechat message history from android项目地址: https://gitcode.com/gh_mirrors/we/wechat-dump
有没有想过,你手机上那些聊了五年的群、舍不得删的语音、翻旧照片时才想起的对话,其实根本不归你管?微信官方从未提供任何聊天记录导出入口,想备份、想分析、想换设备迁移,都只能干瞪眼。今天要聊的开源工具 wechat-dump,专治这个痛点——它能把安卓手机里的微信聊天记录完整导出,生成包含文字、图片、语音、表情、视频的自包含 HTML 文件,让你像逛网页一样随时翻阅自己的数字记忆。这篇文章就用真实流程带你跑通"微信聊天记录导出"这件事。
别急着动手,先看它凭什么值得用
市面上导出微信记录的路子不少,但各有各的坑。咱们用一张表把话说清楚:
| 方案 | 能导出什么 | 最大问题 |
|---|---|---|
| 微信自带备份 | 仅限手机间迁移 | 无法查看、分析,导出即封闭 |
| 截图/录屏 | 视觉信息 | 量大、检索难、语音表情全丢 |
| 第三方云备份 | 聊天记录 | 隐私风险高,格式仍不可读 |
| wechat-dump | 文字/图片/语音/表情/视频全类型 | 需要 root 设备,需自行解密数据库 |
wechat-dump 走的是"直接解析数据库"的路线,不经过任何中间服务器,数据留在你手里;它最近一次验证是在 2025/01/01 与最新版微信兼容。比起"能看不能碰",它让你真正拥有自己的聊天记录,还能顺手做统计分析。
实战演练:把"某个人"的聊天记录变成 HTML
咱们的目标很具体——导出一个联系人的完整聊天记录。整个过程四步走。
第 1 步:准备环境
git clone https://gitcode.com/gh_mirrors/we/wechat-dump cd wechat-dump pip install -r requirements.txt依赖很简单:Python ≥ 3.8、sox命令行工具、一台已 root 的安卓手机,以及项目自带的 Silk 语音解码器(运行./third-party/compile_silk.sh编译即可)。可选装 ffmpeg,用于本地解码微信图片。
第 2 步:从手机取数据
连接已 root 的手机后,用脚本一键拉取数据库和头像索引:
./android-interact.sh db ./android-interact.sh res其中res会把手机上的avatar、emoji、image2、video、voice2等资源目录复制到本机resource目录。注意:EnMicroMsg.db本身是加密的,需要用 SQLCipher 之类的工具先解密(项目刻意不提供解密步骤,解密密钥与设备 IMEI 和微信 UIN 相关)。
第 3 步:一键生成 HTML
./dump-html.py "联系人显示名称"几秒到几十秒后,当前目录就出现了output.html,用浏览器打开,一份带时间轴、头像、语音、图片的聊天档案就诞生了。
核心能力全景图:一个工具,四种打开方式
- 多格式消息渲染📌 文字、图片、语音、表情、视频、引用回复、QQ 音乐分享全覆盖,连群聊里"谁说了什么"都能区分显示。
- WXGF 专有图片解码微信图片和表情用的是自家 WXGF/WXAM 格式,普通浏览器根本不认。wechat-dump 提供两条解码路径:装了 ffmpeg 就本地解码;没有的话,在安卓手机上装 WXGFDecoder 应用开一个 WebSocket 解码服务,加
--wxgf-server ws://设备IP:端口参数即可。 - 语音转码播放微信语音是 SILK/AMR 格式,工具会调用内置 Silk 解码器加 sox 转成 MP3 并内嵌到 HTML 里,点开就能听,还带时长显示。
- 数据分析工具箱不止导出,
./list-chats.py decoded.db列出所有会话,./dump-msg.py批量导出文字消息,./count-message.sh统计消息数量,./plot-num-msg-by-time.py画出消息活跃时段分布——你的聊天频率、作息规律一目了然。
真实效果直击:导出的聊天记录长什么样
先看最终产物。下图是导出的 HTML 聊天界面,左侧是对方头像和带时长的语音消息,右侧是你的图片和文字气泡,时间戳把不同时段的对话分隔得清清楚楚:
再说解码链路。当电脑端没有 ffmpeg 时,WXGFDecoder 安卓应用在设备上充当解码服务器,启动后显示ws://地址和实时日志,每次收到图片解码请求都会打印二进制数据大小——上图能直观看到 174KB 的 WXGF 原始数据被解码成 348KB 的标准 JPEG:
两个细节值得夸:图片消息会优先匹配高清原图,找不到才回退缩略图;语音、图片、CSS、JS 全部以 base64 内嵌进单个 HTML,文件拷走即用,完全离线可看。
进阶技巧与避坑清单
想导出得更快、更顺,这几点实测有用:
- 表情缓存复用:首次导出会联网下载大量表情,提前解压项目发布的
emoji.cache.tar.bz2到根目录,能省掉一大半下载时间。 - 批量导出多个联系人:写个简单循环,把联系人名字喂给
dump-html.py --output,一个脚本搞定全家桶。 - 大目录用 tar 传输:手机资源目录文件多、路径长,
adb逐文件拷贝又慢又容易出错,建议在设备上用busybox tar打包后整体adb pull。 - 自定义样式:想改外观?直接编辑
wechat/static/下的模板(如TP_MSG.html、wx.css),导出效果随你定制。
新手常踩的坑,基本就这三个:
数据库解密失败——wechat-dump 只认解密后的库文件,确保EnMicroMsg.db已成功解密,且运行参数指向正确路径。
WXGF 图片显示不出来——要么本地装好 ffmpeg,要么确认手机与电脑在同一 Wi-Fi、WXGFDecoder 服务器已启动,且--wxgf-server地址拼写无误。
部分表情缺失——微信版本更新后个别表情可能无法下载,工具会显示占位符,手动从微信里存出这些表情放进resource/emoji即可补全。
你的聊天记录,值得一份永久副本
回到开头那个问题:你的聊天记录到底属于谁?wechat-dump 给出的答案是——属于你。从 root 手机取数据、解密数据库、再到一条命令生成可检索的 HTML 档案,整个过程透明可控,数据全程本地流转;导出之后你还能继续用它的统计脚本做分析、改模板做个性化,甚至基于解析库写自己的管理程序。
心动的话,现在就拉一份代码跑起来吧:git clone https://gitcode.com/gh_mirrors/we/wechat-dump,把你最重要的那段对话,变成永远打不开也不怕的网页珍藏。🚀
【免费下载链接】wechat-dumpAnalyzing your wechat message history from android项目地址: https://gitcode.com/gh_mirrors/we/wechat-dump
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考