零基础也能上手:用GetQzonehistory三步备份QQ空间历史说说
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
深夜整理旧手机相册时,你翻到一张和高中死党在操场拍的合照,猛然想起这条照片当年发在QQ空间,底下还挂着一串当时觉得永远翻不完的评论。你点开空间想重温,却发现说说被折叠、老图片加载不出来,有几条甚至已经找不到了。QQ空间不会永远都在,那些写了十年的心情、几百张照片、朋友们的留言,说没就没。而手动备份?几千条说说一条条复制粘贴,能复制到天亮,图片还得一张张另存为。GetQzonehistory就是为这件事准备的免费开源工具:扫码登录后,它自动把账号下所有的历史说说抓下来,连同评论、图片一起导出成本地文件,几十分钟干完别人要熬几个通宵的活。
一句话说清它是什么
把它想象成一位"数字时光搬运工"就好。你扫码授权后,它像人一样翻遍你空间的历史消息列表,把每一条说说的内容、发布时间、配图、评论都整理归类,最后打包成几样东西交到你手上:Excel表格(方便分析整理)、网页文件(打开就像当年刷空间)、以及一个装满原图的文件夹。和那些来路不明的"一键下载"脚本相比,它最大的区别是——数据全程本地处理,不经任何第三方服务器,备份完的东西永远归你自己保管。
动手前的准备清单
开始之前,你只需要备齐这几样:
| 需要什么 | 说明 |
|---|---|
| 一台电脑 | Windows / macOS / Linux 均可 |
| Python 3.6 及以上 | 建议 3.8+,版本越高越省心 |
| 一部装了手机QQ的手机 | 用于扫码登录,全程不输密码 |
| 稳定的网络 | 抓取期间保持在线即可 |
然后依次执行下面的命令,克隆项目、建虚拟环境、装依赖,全程大约两三分钟:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 用户改为 .\myenv\Scripts\activate pip install -r requirements.txt依赖清单都写在 requirements.txt 里,核心就几样:requests 负责网络请求、beautifulsoup4 负责解析页面、pandas 负责生成表格、qrcode 负责在终端画出二维码。如果你用的是 Linux 或 macOS,扫码识别还依赖一个叫 zbar 的系统库,装不上会在启动时给出对应系统的安装提示,照着敲就行。
一次完整的实操演示
第1步:启动程序,看到二维码
激活环境后运行:
python main.py终端里会弹出一个二维码,这就是登录入口。整个流程从登录到导出的顺序,可以参考下面这张工作流程图。
第2步:手机QQ扫码,完成登录
打开手机QQ的"扫一扫"对准终端二维码,确认登录即可。整个过程不碰密码,安全性比输账号密码高得多。登录成功后,终端会显示你的QQ号和昵称。下次再运行,程序会检测到已经登录过的账号,直接输入序号就能跳过扫码这一步,省去重复操作。
第3步:等待抓取,看进度条
登录后程序会自动开始分页抓取,终端里会出现进度条,每抓取10条会主动休息3秒,避免触发QQ空间的风控。即使中途手滑按了 Ctrl+C 中断,程序也会先把已经抓到的数据保存下来,不会白干一场。
第4步:打开输出文件夹,验收成果
抓取完成后,程序会自动帮你打开输出目录resource/result/[你的QQ号]/。里面的文件结构长这样:
你会看到六张Excel表格,自动按类别归档:全部列表、我的说说、转发列表、留言列表、其他内容,外加一份好友列表(昵称、QQ、空间主页都在)。旁边还有一个_说说网页版.html和装满原图的pic/文件夹。打开HTML文件,就是按时间倒序还原的"网页版QQ空间"。
如果你想把 2014 年以前的老说说也一并补齐(main.py走的是消息列表接口,个别老数据可能不在里面),再执行一句:
python fetch_all_message.py它会走另一条接口,把所有未删除的可见说说连同高清原图拉下来,还额外输出一份 Markdown 文件,直接就能搬去写博客、做内容迁移。
能力速览:它能替你干哪些活
先用一张表快速扫全貌:
| 功能 | 主要作用 | 适合谁用 | 一句话说明 |
|---|---|---|---|
| 扫码登录 | 手机扫码免密登录 | 所有用户 | 不碰密码,隐私更安心 |
| 历史说说抓取 | 自动翻完全部历史消息 | 想完整备份的人 | 分页抓取、进度可视、中断也能保存 |
| 多格式导出 | 输出Excel、HTML、Markdown | 分析派和收藏派通吃 | 要数据有表格,要情怀有网页 |
| 图片批量下载 | 原图全部落到本地 | 担心图床失效的人 | 按说说内容命名,不重名不丢失 |
| 内容自动分类 | 说说/转发/留言/其他分开 | 想分门别类的人 | 六张Excel各归各位 |
| 好友列表导出 | 把互动过的好友存下来 | 想留份人脉记录的人 | 昵称、QQ、空间主页一览无余 |
其中最有卖点的是这两件事:
说说网页版.html:把空间"搬"回本地。程序会按时间倒序把说说重新排好,还原成网页版空间的样子:带头像、昵称、发布时间,配图自动替换成高清版本,评论区也一条不少地挂在动态下面。用浏览器打开,就像回到当年刷自己空间的那个下午。这段还原逻辑写在 main.py 的render_html函数里。
图片本地化:照片是回忆里最容易丢的部分。图床链接一旦失效,原图就再也找不回来。工具会遍历每条说说的图片链接,自动下载到pic/目录,并用说说内容给图片命名,遇到重名自动追加时间戳。哪怕将来QQ空间彻底关闭,你的相册也还安安静静躺在硬盘里。
真实使用场景
刚毕业的程序员阿哲,在体检时突然发现空间相册大量照片提示"加载失败"。他跑了一遍 GetQzonehistory,把大学四年的三百多条说说和八百多张照片全部拖回本地,又顺手用导出的Excel按年份做了个相册索引。对他来说,这就是给青春买了一份保险。
做公众号的编辑小鹿,要写"我的十年"专题,急需十年前的第一条说说当素材。她靠工具导出的数据,几分钟就翻到2010年那条说说,配合fetch_all_message.py生成的 Markdown 文件直接引用,排版省了一半时间。
一位QQ号用了15年的老用户,担心账号哪天出问题,提前用工具把空间内容连同好友列表备份到了移动硬盘。对他而言,这不只是备份,而是把一段完整的网络人生留了个底。
新手最容易踩的坑
坑1:扫码登录后立刻掉线。多半是QQ安全策略拦截,或同时在其他设备登录了空间。解决办法:等几分钟再重试,抓取期间尽量别多端同时在线。
坑2:pip 装依赖一直失败。通常是网络慢或源的问题。换国内镜像一行解决:
pip install -i https://pypi.tuna.tsinghua.edu.cn/simple -r requirements.txt坑3:Linux/macOS 启动时报 zbar 相关错误。这是缺少系统库。macOS 执行brew install zbar,Linux 安装对应的 zbar 包,装完重跑即可。
坑4:只抓到一部分说说。这属于机制限制:消息列表里没有的(比如"仅自己可见")天然抓不到。想尽量补全未删除的可见说说,就跑一遍fetch_all_message.py。
坑5:抓取中途卡住、个别图片下载失败。多数是网络波动或链接已失效。程序支持 Ctrl+C 保存已抓数据,图片也可以从Excel里的链接手动补下,不影响大局。
现在就去备份
数据备份最好的时机永远是现在。等哪天空间里的说说突然无法访问、照片集体失效,再想找回就晚了。接下来你要做的很简单:克隆项目、装好环境、扫码跑一遍,亲眼看看那些被时间封存的说说重新出现在你面前。代码全程开源,想研究原理可以翻翻 util/ 目录下的各个模块,遇到问题也有 README.MD 可以参考。早一天备份,回忆就多一分安全。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考