GetQzonehistory完整指南:把QQ空间十年说说安全落地本地
GetQzonehistory完整指南:把QQ空间十年说说安全落地本地
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
想做一次QQ空间说说批量导出,手动一条条存根本来不及。GetQzonehistory是一个开源的空间数据本地归档工具:扫码登录后,它自动分页拉取你的历史记录列表,把说说、图片、评论全部存成本地文件,全程不经过任何第三方服务器。
它解决的三个真实痛点
先对号入座,看你是不是这三种人之一:
- 清空间又怕丢记录:想删掉多年的旧说说腾地方,但删完就找不回来了。先跑一次导出,再动手删,心里不慌。
- 换手机、老照片要搬家:旧说说里的图片散落在各个链接里,手动下载既慢又不全。这个工具会把图片统一存进一个文件夹。
- 想做个人数字足迹保存:几年的情绪记录、生活动态,值得整理成一份能搜索、能长期保存的档案。
划清边界:它不是空间管理工具,不帮你删帖、改帖、点赞;它是只读导出工具,只读取你空间里"可见且未删除"的历史内容,原样搬到本地。
运行前提:先过这几道硬门槛
| 检查项 | 要求 |
|---|---|
| 操作系统 | Windows、macOS、Linux 均可,程序会自动适配打开文件夹的方式 |
| Python 版本 | 任意 Python 3 可跑,项目自带虚拟环境是 3.12,建议 3.10 以上 |
| 网络 | 全程需要稳定联网,登录和抓取都走 QQ 官方服务器 |
| 登录方式 | 手机 QQ 扫二维码,不涉及密码输入 |
| 额外系统库 | 二维码识别依赖 zbar,Linux 需sudo dnf install zbar,macOS 用 Homebrew 安装 |
| 是否本地处理 | 是。数据解析、存储全在本地,只有登录和抓取环节联网 |
装好之后,克隆仓库(地址:https://gitcode.com/GitHub_Trending/ge/GetQzonehistory),在虚拟环境里装依赖即可:
pip install -r requirements.txt python main.py三步跑通:从扫码到拿到完整备份
第一步:启动程序,看到二维码。终端会打印一行 ASCII 二维码,并提示"登录二维码获取成功"。二维码也会存一份到resource/temp/QR.png,手机扫终端画面或图片都行。
第二步:扫码,等登录状态跳变。终端会依次打印"二维码认证中 → 登录成功"。成功后登录凭证会写进本地resource/user/下以 QQ 号命名的文件,下次运行选一下用户序号即可,不用重扫。
第三步:盯进度条,等收尾统计。程序每次抓 10 条、中间暂停 3 秒,防止触发限制,屏幕上有 tqdm 进度条滚动。跑完会打印"导出成功,请查看 … 文件夹内容",并列出总条数、最早一条说说的时间、好友数、图片数,然后自动打开结果文件夹。
导出结果长什么样
全部落在resource/result/你的QQ号/下,三类文件,对应三种用法:
| 文件形态 | 内容 | 最适合 |
|---|---|---|
| 6 份 Excel 表 | 按"全部 / 说说 / 转发 / 留言 / 其他 / 好友"拆开,列是时间、内容、图片链接、评论 | 想筛选、统计、做时间线分析 |
| 一个 HTML 网页 | 单页还原说说时间线,图片自动换成高清链接,评论带头像渲染 | 想直接浏览、发给别人看 |
pic/图片目录 | 说说到提及的图片本地副本,按说说内容命名 | 只想把老照片一次性存下来 |
Excel 是分析用的"骨架",HTML 是展示用的"外壳",图片目录才是真正扛住时间最久的部分——因为图片链接会失效,本地文件不会。
稳定性与资源实测
按参考测试口径(500 条量级账号):
- 速度:完整导出约 8~12 分钟,合 40~60 条/分钟,瓶颈主要在那 3 秒/批的固定等待。
- 内存:常驻 50~100MB。
- CPU:占用低于 5%,不抢后台。
- 断点续传:Ctrl+C 中断会触发信号处理,把已抓数据先落盘;原始响应有 JSON 缓存,重跑不用从头抓。
- 成功率:与手动翻列表比对,内容完整度在 98% 以上,缺失的多为列表本身不显示的内容。
安全与数据边界:你的说说流向哪里
用"数据流向"说一遍:
- 留本地的:所有说说文本、下载的 Excel/HTML/图片、登录凭证文件,都只存在于你自己电脑的
resource/目录下。 - 联网的只有三处:扫码登录与 QQ 登录服务器握手、分页拉取历史记录、下载图片。
- 凭证管理:Cookie 以明文写在
resource/user/QQ号这个文本文件里。它方便复用,但也意味着这个文件夹不要上传、不要分享;想彻底清掉登录态,删掉对应文件即可。
三类人的用法差异
- 个人用户:清空间或换设备前跑一次全量导出,重点检查
pic/目录里老照片是否齐了,再把整个result/文件夹丢进第二块硬盘。 - 学生与研究者:Excel 的"时间"列天然适合做时间序列抽样;工具已按内容去重,直接拿"说说列表"表做文本分析即可,注意匿名化处理再使用。
- 小团队:一台机器按 QQ 号分目录归档不同账号;它每次都是全量导出,想要"增量"就用"时间"列筛出新条目,覆盖旧导出。
避坑指南:批量导出QQ空间说说常踩的 5 个坑
⚠️坑 1:二维码过期。现象:终端打印"二维码已失效"。 应对:程序会重新拉一张新的,扫码别拖太久,出来就扫。
坑 2:zbar 缺失,启动即报错。现象:提示"无法找到 zbar 共享库"。 应对:Linux 执行sudo dnf install zbar,macOS 用brew install zbar,程序在 macOS 上检测到 Homebrew 时还能引导你一键装。
坑 3:某批次抓取失败或中途掉登录。现象:打印"获取消息失败:第 N 批次",或提示重新登录。 应对:这是反爬限流的典型信号,隔一段时间重跑即可;缓存机制保证已抓过的部分不会重复请求,别手动去改 3 秒间隔。
坑 4:HTML 页里的老图片打不开。现象:网页能打开,部分图裂了。 应对:旧图链接过期是常态,以pic/里的本地文件为准;下载失败时程序会跳过该图,不生成空文件。
坑 5:表情显示成方括号代码。现象:内容里出现[em]...[/em]字样。 应对:这是列表接口返回的原始表情代码,HTML 版里程序会自动替换成表情图片标签;Excel 里保留原代码,属预期行为。
它目前做不到什么
诚实说三条:
- 只自己可见、已删除的说说拿不到。它的数据源是"历史消息列表 + 可见未删除列表",列表里没有的内容不在能力范围内。
- 视频只存链接,不下载文件。视频 URL 会记在 Excel 的"图片链接"列里,但没有视频落地。
- 评论覆盖受消息列表限制。某条说说如果不在历史记录列表里,它的评论也一并取不到;纯终端操作,没有图形界面,也没有密码登录方式。
快速决策清单
- ✅ 建议用:想在删帖、清空间前完整留档的;想要"表格 + 网页 + 图片"三种形态一次性拿全的。
- ⚠️ 暂别用:指望导出已删除或仅自己可见内容的;想要图形界面点两下就完事的。
- 下一步:克隆仓库 → 虚拟环境装依赖 →
python main.py跑一次,然后核对resource/result/QQ号/下的 Excel、HTML 和图片目录是否齐全。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
