10分钟把QQ空间历史说说完整备份到本地,别等它消失
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
你翻QQ空间,大概率没翻到过自己发的第一条说说——消息列表太长,根本回不去。GetQzonehistory 是获取QQ空间历史说说的备份工具:扫码登录后自动抓取全部动态,整理成Excel和离线网页存进你的硬盘。读完这篇,你能跑通第一次完整备份。
它具体能帮你做哪几件事
- 抓取历史说说:输入你的扫码登录 → 输出空间历史消息列表里每一条可见说说、转发和留言,含时间、内容、评论
- 导出六张Excel:一份抓取结果 → 全部、说说、转发、留言、其他、好友六张分类表格,时间精确到秒
- 生成网页版纪念册:说说和转发 → 一个HTML文件,按时间倒序还原头像、正文、配图和评论区
- 下载配高清图:说说里的配图 → 存进 pic 目录并自动换成高清链接,文件名直接取自说说内容
- 缓存登录状态:登录成功的Cookie → 存到本地,下次运行选一下账号即可,不用再扫码
跑起来:从装环境到出结果
准备环境
这一步只为电脑配好 Python 和项目依赖,命令照抄即可。
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv # Windows 激活:.\myenv\Scripts\activate # macOS/Linux 激活:source myenv/bin/activate pip install -r requirements.txt卡住了?现象:
pip install半天没动静或提示找不到包。原因:网络访问慢。解法:换国内镜像源重装,pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt
首次运行与扫码登录
运行后终端会打印一个黑白二维码,手机QQ确认即可,全程不碰密码。
python main.py如果之前登录过,程序会先列出已登录账号让你选,选 0 才重新扫码。
卡住了?现象:启动时报"无法找到 zbar 共享库"。原因:缺二维码识别库。解法:Linux 执行
sudo dnf install -y zbar(Ubuntu 用apt install libzbar0),macOS 按终端提示用 Homebrew 安装,引导逻辑在 util/LoginUtil.py。
等待抓取完成
进度条每 10 条推进一步,每批间隔 3 秒,这个节奏是刻意设计的,用来降低触发风控的概率;中途想停直接Ctrl+C,程序会先存好已抓到的数据再退出。
# 跑完后确认导出目录(Windows 换成 dir resource\result) ls resource/result/卡住了?现象:控制台出现"获取消息失败:第 X 批次"。原因:网络抖动漏批。解法:直接重跑一次,登录状态可复用;漏掉的个别批次在对应表格里体现不出来,盯着控制台输出就能发现。
跑完之后,打开这个文件夹
程序跑完会自动打开导出目录,并报告总条数、最早一条说说的时间。目录长这样:
resource/result/你的QQ号/ ├── 六张分类Excel(下面逐项说) ├── 你的QQ号_说说网页版.html └── pic/- 全部列表:所有抓到的消息汇总,时间、内容、图片链接、评论分列存放
- 说说列表:你自己发布的说说,是后续翻旧账最常用的一张
- 转发列表:你转发过的每一条内容
- 留言列表:空间留言板上的互动
- 其他列表:好友在你空间发的动态和互动
- 好友列表:昵称、QQ号、空间主页地址,顺手能当通讯录用
- 说说网页版.html:双击就能离线打开,说说和转发按时间倒序排列,头像、昵称、发布时间、正文、配图、评论区全还原,连QQ表情都还原成图片
- pic/:配图的高清版,文件名取自说说内容,一眼认出是哪条动态
拿到数据后,还能怎么玩
如果你想知道自己哪年话最多:
import pandas as pd df = pd.read_excel('resource/result/你的QQ号/你的QQ号_说说列表.xlsx') df['时间'] = pd.to_datetime(df['时间']) print(df['时间'].dt.year.value_counts().sort_index())哪年话痨、哪年沉默,一眼看穿。
或者按关键词翻旧账:
keyword = '毕业' print(df[df['内容'].str.contains(keyword)])当年提过这件事的每条说说、每张图片,瞬间被捞出来。
顺手把备份设成定时任务,每月自动跑一次增量:
# Linux/macOS:crontab -e 加一行,每月1日凌晨2点跑 0 2 1 * * cd 项目路径 && ./myenv/bin/python main.py往后的每条新说说,也会被安稳地收进这份档案里。Windows 用任务计划程序,思路相同。
安全边界,说清楚
⚠️数据不上传:抓到的内容只写入你自己的硬盘,不经过任何第三方服务器。
凭证存储位置:只存Cookie在本地resource/user/目录,全程不碰密码,不放心删掉它重新登录就行。
源码可审计:全部源码公开,登录、请求、抓取逻辑都能自己核对,任何一步看得见。
仅供学习与技术研究使用,不采集他人数据,尊重平台规则。
今晚就能做完的 4 步
- 克隆项目,装好依赖
- 运行 main.py,扫码登录
- 等进度条走完
- 打开文件夹,翻一翻
回忆不会自己回来,今晚就去搬一份。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考