5分钟上手wechat-dump把安卓微信聊天记录完整导出成HTML的实战指南【免费下载链接】wechat-dumpAnalyzing your wechat message history from android项目地址: https://gitcode.com/gh_mirrors/we/wechat-dump当你想永久保存聊天记录却发现微信根本没有导出按钮你有没有过这样的时刻手机里攒了好几年的微信聊天记录想整理成一份可以永久保存、随时翻阅的个人档案结果翻遍设置也没找到导出聊天记录这个功能。复制粘贴几千条消息根本不现实。截图那得截到什么时候。官方不给入口数据就永远锁在手机里——这正是绝大多数微信用户面对的尴尬。好在开源社区有解决方案。wechat-dump就是这样一个工具它从安卓设备中读取并解析微信聊天数据库把文字、图片、语音、表情一键渲染成自包含的 HTML 文件浏览器打开即可离线浏览。你不需要写任何代码跟着下面的步骤走5 分钟就能生成自己的第一份聊天档案。一句话说清wechat-dump 到底解决了什么它把锁在微信里的聊天记录变成完全属于你、可离线查看、可统计、可二次开发的数据资产。和市面上零散的截图整理法不同wechat-dump 有三个鲜明的差异点直接解析原始数据库保证数据完整不遗漏任何一条消息产物是单个自包含 HTML图片、样式全部内嵌拷走即用无需联网解析模块完全开放你可以在此基础上写自己的脚本继续挖掘聊天数据。项目最近一次在最新版微信上验证通过工具链成熟稳定可以放心上手。跟着我做从安卓手机到一份 HTML 聊天档案下面进入实战。整个过程分为四步每一步做完你都能看到明确的结果。第一步准备环境三行命令装好依赖你需要准备的东西很常规一台已 root 的安卓手机、装了 adb 的电脑Linux / macOS / Win10Bash 均可、Python 3.8 及以上版本。接着克隆项目并安装依赖git clone https://gitcode.com/gh_mirrors/we/wechat-dump cd wechat-dump pip install -r requirements.txt如果想让语音消息也能转成可播放的格式再补两件事安装命令行工具sox然后编译项目自带的 Silk 语音解码器./third-party/compile_silk.sh到这里环境就绪。✅第二步从手机拉取数据库与资源文件微信的数据分为两部分聊天内容的数据库以及头像、图片、语音、表情等资源文件。项目提供了自动化脚本一条命令搞定./android-interact.sh db ./android-interact.sh resdb会在手机/data/data/com.tencent.mm/MicroMsg下自动定位那个 32 位十六进制字符的 userid 目录拉取EnMicroMsg.db数据库res则把avatar、emoji、image2、voice2等资源目录打包传回本地的resource目录。资源传输可能比较耗时脚本会自动尝试 busybox tar、tar、adb pull 三种方式按最快可行的来。第三步解密数据库先看看有哪些聊天微信数据库是加密的wechat-dump 本身不做解密你需要用 SQLCipher 之类的工具把EnMicroMsg.db解密成明文并命名为EnMicroMsg.db.decoded这是工具默认读取的文件名也可以用--db参数指定别的路径。解密完成后先列出所有聊天确认联系人名称./list-chats.py EnMicroMsg.db.decoded运行结果会打印每个聊天对象在数据库中的准确显示名称。这个名称很关键下一步要用它。第四步一键生成 HTML浏览器里回顾历史现在到了最有成就感的一步。选择你想导出的联系人运行./dump-html.py 联系人的显示名称等待几秒当前目录就会出现output.html直接用浏览器打开一份还原微信界面的聊天记录就呈现在你眼前了——绿色气泡是你的消息灰色气泡是对方的时间戳清晰分隔图片、表情、语音都嵌入其中。如果你想要按时间区间导出或者换输出路径工具都提供了对应参数./dump-html.py 联系人 --output my_chat.html --start 2020-01-01 00:00:00避坑锦囊四个高频问题一次讲透新手最容易卡住的往往是下面这几个地方。这里统一用现象→原因→解决办法帮你排掉。⚠️ 资源拉取失败或极慢现象./android-interact.sh res一直失败或传输速度感人。原因不同微信版本资源目录不同——老版本在/mnt/sdcard/tencent/MicroMsg脚本默认值只适配新版另外安卓系统的 tar 在长路径下容易报错。解决先检查脚本顶部的RES_DIR是否与你的机型一致传输时优先让设备端用 busybox tar 打包再传效率高得多。⚠️ 找不到联系人现象dump-html.py报Couldnt find the chat xxx。原因你输入的名称和数据库里存的显示名称不完全一致比如多了空格或特殊符号。解决先运行./list-chats.py把打印出来的名称原样复制进命令。⚠️ 图片、表情显示为空白现象HTML 生成了但图片区域是空的。原因微信的图片和表情用的是专有的 WXGF/WXAM 格式电脑端没有解码器部分表情还会因为微信版本更新导致下载不到。解决优先给电脑装上 ffmpeg工具会自动本地解码装不了就启用安卓解码服务器见下文进阶玩法。表情缺失可以预先下载项目提供的 emoji 缓存包并解压到项目目录大幅减少下载量。⚠️ 语音消息无法播放现象HTML 里语音条点不开。原因缺少sox或 Silk 解码器。解决安装 sox并执行./third-party/compile_silk.sh编译项目内置的 Silk 解码源码然后重新生成 HTML。进阶玩法如果还想更进一步基础导出你已经掌握了接下来这些能力能让这份档案更有价值。批量导出多个联系人写一个几行的 bash 循环一次导出所有想保留的聊天#!/bin/bash for name in 张三 李四 王五; do ./dump-html.py $name --output ${name}.html done全量文本统计与时间分布分析先把所有聊天的纯文本导出来再做统计./dump-msg.py EnMicroMsg.db.decoded output_dir ./count-message.sh output_dircount-message.sh会输出每个会话的行数、字符数、词数排序表再用./plot-num-msg-by-time.py还能把消息数量随时间的变化画成分布图看看你们聊得最火热的是哪几个月。WXGF 图片解码ffmpeg 之外的第二方案没有 ffmpeg 的环境可以用项目内置的 WXGF Decoder 安卓应用当解码服务器。装上 APK、点一下Start Server在导出命令里加上--wxgf-server ws://设备IP:端口即可应用界面上会实时打印解码日志模板定制与二次开发生成的 HTML 样式来自wechat/static/目录下的模板文件TP_MSG.html控制消息布局、TP_IMG.html控制图片展示、wx.css控制整体风格改完即生效。如果你懂一点 Pythonwechat/目录下的 parser、render、res 模块都是独立可复用的完全可以基于它们写自己的聊天数据分析程序。成果验收此刻你拥有了一份怎样的档案我们来看看实际导出的效果。下图是一份真实生成的 HTML 聊天记录左右气泡区分收发双方时间戳清晰分隔时段文字、图片、语音一应俱全视觉效果和微信本体几乎一致更重要的是这份文件是自包含的——它不依赖网络不依赖微信服务器你可以把它拷到 U 盘、存进网盘或者上传到自己的博客。哪怕将来手机换了、微信号没了这段对话历史依然完整地属于你。下一步从这份档案出发此刻你已经拥有了一份可离线查看的完整聊天档案。如果想玩得更深项目的源码结构非常清晰wechat/是核心解析与渲染模块WXGFDecoder/是安卓解码应用third-party/内置了 Silk 语音解码器。项目还公开了待办清单比如更完整的表情下载、罕见消息类型的支持、host 端 WXGF 解码覆盖等都是不错的贡献方向。把工具装进你的开发环境花 5 分钟导出一份自己的聊天记录——当你第一次在浏览器里翻看那些年聊过的话你会明白为什么这件事值得做。现在就动手吧。【免费下载链接】wechat-dumpAnalyzing your wechat message history from android项目地址: https://gitcode.com/gh_mirrors/we/wechat-dump创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考