GetQzonehistory:QQ 空间数据归档完整指南,历史说说一步到位导进 Excel
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
QQ 空间里堆了十年说说,翻起来费劲,想备份更难。GetQzonehistory 就是干 QQ 空间数据归档的:扫码登录、分页抓取,直接导出 Excel 和图片。几行命令跑完,出结果不用你动手。
⚡ 最短路径跑起来
先确认本机有 Python 3.7 以上,然后四步搞定:
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory pip install -r requirements.txt python main.py- 第一行,把项目克隆下来
- 第二行,进入项目目录
- 第三行,装依赖,清单都在 requirements.txt 里
- 第四行,启动:用手机 QQ 扫码登录,进度条走完就出结果
不想装 Python 环境的话,项目 release 页也有打包好的单文件,可以直接执行。
它到底帮你解决了什么
如果你怕丢了过去十年的说说
那用它一次就能全部备份。扫码登录后,它按 QQ 空间消息列表逐页抓取。你删过的旧说说,只要还在列表里就能翻出来。时间、正文、图片、评论最后都整理成带列的 Excel,打开就能读。不想开 QQ 空间时,翻 Excel 也行。
如果你想把说说里的图全存下来
那不用你一张张点开保存。它自动把说说里的图片下载到 pic 文件夹,文件名按说说内容命名。重名时会自动加时间戳,不会互相覆盖。网页版里的图片还会换成高清版本,放大看也不糊。
如果你想分析自己的发布习惯
那这份 Excel 就是现成的分析素材。每条都带精确到秒的发布时间,按年按月一统计,哪年发得最多一眼看出。再结合评论数据,哪些内容互动多,心里马上有数。
📊 数据从哪来、到哪去
QQ 空间数据归档的整个过程分三步。登录后先抓消息列表,这一步能覆盖你删过的旧说说。再走说说接口拉可见说说列表,补上 2014 年及更早的内容。两路数据最后去重、清洗,写成 Excel、网页版和图片库。全程在本地跑,数据不经过任何第三方服务器。核心抓取逻辑在util/GetAllMomentsUtil.py里,想改行为可以从这里入手。
🗂 跑完你会得到哪些文件
运行结束后,结果按你的 QQ 号存到resource/result/的子目录里。一次跑完,QQ 空间数据归档的文件一套齐全:
| 文件 | 是什么,拿来干嘛 |
|---|---|
QQ号_全部列表.xlsx | 消息列表的全部条目,最完整的原始数据 |
QQ号_好友列表.xlsx | 互动过的好友,附空间主页链接 |
QQ号_说说列表.xlsx | 你当前可见的说说,归档的核心 |
QQ号_转发列表.xlsx | 你转发过的内容,单独拆出来存 |
QQ号_留言列表.xlsx | 你留在他人的空间里的留言 |
QQ号_其他列表.xlsx | 消息列表里出现的他人内容 |
QQ号_说说网页版.html | 长得像空间的网页版,浏览器直接打开 |
pic/ | 说说里的全部图片,下载成本地 jpg |
Excel 里就时间、内容、图片链接、评论四列,表格软件里直接排序筛选。网页版连头像和评论区都还原了,打开就像进了一次自己的空间。
⚠️ 你可能踩的坑
Q:删掉很久的说说还能拿到吗?A:能。它走的是空间消息列表,只要条目还在列表里,删过的也能抓回来。但仅自己可见的说说不在列表里,这个拿不到。
Q:为什么跑得这么慢?A:为了稳,每抓 10 条就歇 3 秒。几千条说说的话,全程要几十分钟。这是设计如此,避免被限流。
Q:中途不小心关了怎么办?A:别慌。已抓到的数据会自动保存下来。重新运行,接着抓就行。
Q:换账号或者重新登录怎么做?A:登录凭证存在本地resource/user目录里。再次运行会列出已登录账号让你选,输 0 重新扫码。
Q:扫码一直不成功?A:确认用的是要登录的那个 QQ 在扫。别让二维码超时,过期就重新运行再扫一次。
写在最后
GetQzonehistory 适合把自己空间的历史备份下来,整理一段旧时光。它不适合拿来抓别人的内容,也拿不到私密说说。跑出问题或者有新想法,直接给项目提 Issue,你的反馈就是下一步更新的路标。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考