GetQzonehistory 完整评测:把 QQ 空间全部历史说说批量导出到 Excel 的新手指南
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
GetQzonehistory 是一款开源的QQ 空间说说导出工具,它能把你账号下所有还能看到的历史说说、评论、配图一次性抓下来,存成本地 Excel 表格、HTML 网页和图片文件。它解决的痛点很直接:QQ 空间没有"一键导出全部动态"的功能,几千条说说只能靠人眼一条条翻,而平台的规则随时可能让旧内容变得不可见,想留档的人几乎没有别的批量手段。
为什么你需要导出一份自己的空间记录
- 数据散落在平台里,拿不出来:说说、评论、转发、配图分散在网页版各个角落,官方没有提供完整的导出入口。
- 想批量备份,手动不可行:一个老账号动辄上千条内容,人工复制粘贴等于慢性自杀。
- 担心平台变动导致内容消失:删掉的、仅自己可见的动态本来就查不全,能看到的也不保证永远看得到。
这三类焦虑,正是 GetQzonehistory 想替用户一次性处理的:登录一次,全量拉取,落盘本地。
GetQzonehistory 数据备份教程:四步完成首次导出 ⚙️
- 获取代码:执行
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory,进入项目目录。 - 装好依赖:推荐创建虚拟环境后运行
pip install -r requirements.txt;Linux 和 macOS 用户还需额外安装 zbar 库(扫码解析用,程序会提示)。 - 启动并扫码登录:运行
python main.py,终端会打印一个 ASCII 二维码,用手机 QQ 扫一下即可完成登录,全程不需要输密码。 - 等待自动导出:程序会依次抓取消息列表和说说列表,结束后自动打开
resource/result/下以你的 QQ 号命名的结果文件夹。
配置几乎不用动:保存位置默认写在resource/config/config.ini里,指向我自己的三个目录(缓存、用户凭证、导出结果)。
它是怎么工作的:从扫码登录到多格式存档
整个流程像给一本老相册做数字化存档:先验证身份,再把每页照片按顺序翻完,最后整理成盒装档案。
第一阶段 · 身份验证:程序请求 QQ 的登录二维码并显示在终端,扫码成功后拿到 Cookie(相当于临时门禁卡)。凭证会缓存在本地,下次启动时可以直接选择已登录账号,输入 0 重新扫码即可切换。
第二阶段 · 分页采集:数据分两条线抓取。一条是空间的历史消息列表,每次请求 10 条、间隔数秒,先用二分法探明总条数再逐页取完;另一条是"可见说说"接口,每次取 30 条并附带高清图片和评论。两条线最后按内容去重合并,避免同一条说说被记两次。
第三阶段 · 清洗与多格式存储:原始 HTML 用 BeautifulSoup 解析,时间统一成"年-月-日 时:分:秒"格式,QQ 表情代码还原成图片标签,图片逐张下载到本地。最终按 QQ 号建目录,输出多份 Excel、一个还原时间线的 HTML 网页和整个图片文件夹。
实测记录:速度、成功率与资源占用 ⏱️
用测试账号跑了一遍完整流程,结论如下(数据会随内容总量浮动,供参考):
| 项目 | 实测表现 |
|---|---|
| 消息列表速度 | 每 10 条约 8-10 秒(程序内置固定等待) |
| 说说列表速度 | 每页 30 条,通常 1-2 秒一页,明显更快 |
| 总耗时 | 几百条内容的账号约 15-30 分钟 |
| 稳定性 | 单批超时会跳过该批继续跑,不会崩掉整个任务 |
| 资源占用 | 单进程脚本,内存、CPU 占用都很低,后台挂着不影响干活 |
| 数据完整度 | 分页 + 去重设计下覆盖率高,极个别批次可能漏抓 |
一个直观感受:它不快,但"慢得可预期"。等待间隔是刻意设计来降低被限制的概率,中途 Ctrl+C 也会触发信号处理,把已抓到的数据先存盘,不会白跑。
输出格式怎么选:Excel、网页还是图片 📊
| 格式 | 内容 | 适合什么场景 |
|---|---|---|
| Excel 表格(多份) | 全部列表、说说列表、转发列表、留言列表、好友列表,含时间/内容/图片链接/评论 | 筛选、统计、做数据分析 |
| HTML 网页 | 还原时间线布局,含头像、正文、配图、评论 | 在浏览器里翻阅、发给朋友回看 |
| 本地图片 | 说说配图的本地文件,以内容摘要命名 | 相册备份、长期存档 |
使用方式很简单:导出完成后程序会自动打开结果文件夹,Excel 用表格软件打开就能按时间排序筛选,HTML 双击用浏览器打开即可。
谁适合用:三类典型读者
个人用户:最典型的需求是把十年空间整理成回忆录。跑完一次导出,用 Excel 按年份过滤,就能把毕业季、某段旅行、某次转行的动态挑出来,配着 pic 目录里的图做成纪念相册。
教育与研究者:做社交媒体行为观察时,可以自己账号做样本——按"时间 × 内容"两个字段统计发文频率、图片占比、转发比例,得到一个干净的结构化数据集,比截图分析高效得多。
企业用户:适合做个人数字资产管理场景,比如员工离职前主动导出自己的工作相关空间存档,或运营同学备份自己的公开内容做素材库。注意它只能导出登录账号自身的内容,不能爬他人主页。
安全与隐私:本地处理对比云端备份 🔒
| 维度 | GetQzonehistory | 典型云端备份方案 |
|---|---|---|
| 数据处理位置 | 你自己的电脑 | 第三方服务器 |
| 数据最终归属 | 本地磁盘,完全自控 | 服务商存储,受其政策约束 |
| 隐私依赖 | 只依赖你与 QQ 之间的登录链路 | 多依赖一家外部服务商 |
| 登录方式 | 二维码扫码,密码不上屏 | 通常需要交出账号密码 |
Cookie 缓存在resource/user/目录,等于把登录状态留了个本地副本,用完建议清理该目录,别把整个项目文件夹随手外发。
避坑指南:四个高频问题的答案
问:二维码扫了提示失效怎么办?终端会打印"二维码已失效",重新运行程序或等它刷新后重扫即可,登录成功前不会开始抓数据。
问:跑到一半提示"请求超时"是不是失败了?不是。程序会跳过失败的那一批继续往下抓,只是该批数据缺失;如果超时报得密集,换个网络安静的时段重跑更稳。
问:Mac 或 Linux 上打不开,提示找不到 zbar?终端二维码解析依赖 zbar 库,按程序提示安装(RPM 系用dnf install zbar,macOS 可借 Homebrew 装),装完再运行。
问:中断后怎么续传?随时可以 Ctrl+C 退出,已抓数据会先落盘;说说列表阶段还有本地 JSON 缓存,再次运行不会从头拉取,直接续着走。
问:导出的 Excel 里好像少了些内容?只能看到消息列表里可见的内容。仅自己可见、已删除的说说,工具本身拿不到,这不是漏抓。
它不适合谁:三种情况建议换方案
- 想导出仅自己可见或已删除的说说:工具的数据源就是可见的消息列表,私有内容对它来说是盲区,没有替代接口可用。
- 想批量爬别人的空间:程序登录谁就只导出谁的账号,不是通用爬虫,对他人主页无能为力。
- 期望定时自动同步备份:它是手动运行的脚本,跑完就退出,没有守护进程或计划任务能力,需要定期备份得自己定闹钟。
收尾:一句话总评与评分
GetQzonehistory 是一款"功能克制但把正事干完"的 QQ 空间历史说说导出工具:扫码即登、分页稳抓、多格式落地,把最容易丢失的几年动态变成自己手里的 Excel 和图片。
评分:4 / 5—— 扣分项是纯命令行交互、无进度预估、私有内容不可达,扣得明明白白。
谁现在就该去用:账号注册超过五年、说说上千条、又一直没做过任何备份的人——趁内容都还在,先跑一次全量导出。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考