
GetQzonehistory实操指南3步备份QQ空间全部历史说说【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory整理旧照片时翻到一张 2014 年的空间留言截图你想查一下那年还发过什么。可空间里的动态只展示近几年的内容手动翻回 2014 年不现实。GetQzonehistory 就是为此写的一个用 Python 导出 QQ空间历史说说的工具把十几年前的说说、转发和评论整理成 Excel 和网页全程本地处理登录只扫码、不输密码。项目速览30 秒看懂它能做什么GetQzonehistory 是一个 Python 写的开源备份工具。它走 QQ 空间官方扫码登录接口拿到凭证然后按页拉取空间消息列表里的历史互动再补一份未删除说说做合并去重最后把结果写成结构化文件放在本地目录。运行环境是 Python 3.9 以上Windows、macOS、Linux 都能跑。核心能力有四条扫码登录免密码、消息列表全量备份、未删除说说合并、Excel HTML 本地图片输出。项目说明项目GetQzonehistoryQQ空间历史说说导出工具语言Pythonpandas、BeautifulSoup、requests环境Python 3.9另需系统级 zbar 库平台Windows / macOS / Linux产物格式6 个 Excel、1 个 HTML 网页、1 个图片目录跑起来从克隆到启动的 3 步第一步拿项目、装依赖git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate pip install -r requirements.txt这一段把仓库克隆下来建好独立虚拟环境并把 pandas、requests 等依赖一次装齐。Windows 上把第四行换成myenv\Scripts\activate。第二步首次启动python main.py启动后终端会打印一串字符组成的二维码用手机 QQ 扫码确认登录流程会自动往下走。第三步确认输出位置可选结果目录由resource/config/config.ini里[File]段的result字段控制默认./resource/result/。想换位置只改这一个字段即可。功能全景扫码之后发生了什么按输入 → 处理 → 输出的数据流走一遍。输入扫码登录与凭证缓存登录模块 从空间登录服务器取二维码在终端打印成 ASCII 码你用手机 QQ 扫完确认后程序拿到 cookie 并写入resource/user/目录以 QQ 号命名。下次运行会列出已登录用户让你选序号输入 0 才强制重新扫码。也就是说二维码只需扫一次重复运行或断点续跑都不必再走认证。处理从数总数到分页抓取请求模块 先做一件有点绕的事用二分法探消息列表的总条数不断试不同偏移量看请求是否还有数据。确定总量后主程序 开始每次 10 条地翻页每个请求等 5 秒、每页再歇 3 秒靠 tqdm 打印进度。每一页用 BeautifulSoup 解析 HTML抽出发布时间、内容、图片链接同时顺手把出现过的昵称、QQ 号、空间主页攒成好友表。节奏看起来慢约 8 秒 10 条这是故意限速几千条大约要一小时让它挂着跑就行。中途按 CtrlC 也不会白跑程序注册了信号处理会把已抓到的数据先保存再退出。消息列表抓完后还有第二路数据源GetAllMomentsUtil 按每页 30 条拉取未删除说说接口能覆盖到 2014 年之前的可见说说再按内容比对和消息列表去重合并。消息列表够不到的部分就是靠这步补上的。输出6 个 Excel、一个网页、一套图片抓完后save_data按条目里有没有你的昵称以及留言 / 转发等关键词分流写出六张表把所有图片下载到本地用说说内容命名超 40 字符截断重名自动加时间戳最后用说说表和转发表渲染一个 QQ 空间风格的 HTML 网页按时间倒序、QQ 表情还原成图片、缩略图自动换成高清、评论带头像。到这里QQ空间历史说说的备份就完成了。产物文件字段说明QQ号_全部列表.xlsx时间 / 内容 / 图片链接 / 评论消息列表全部条目QQ号_说说列表.xlsx时间 / 内容 / 图片链接 / 评论你自己发布的说说QQ号_转发列表.xlsx时间 / 内容 / 图片链接 / 评论你转发的内容QQ号_留言列表.xlsx时间 / 内容 / 图片链接好友给你留下的评论QQ号_其他列表.xlsx时间 / 内容 / 图片链接列表里别人的说说QQ号_好友列表.xlsx昵称 / QQ / 空间主页互动过的好友汇总QQ号_说说网页版.html网页空间风格时间线含评论走一遍一次完整的十年备份记录设想一位 90 后用户想找回 2012–2019 年的全部 QQ空间历史说说。启动后终端先打出二维码扫码确认屏幕打印用户{QQ号},昵称登录成功。接着出现正在获取消息列表数量的二分查找进度条每次探测都带 5 秒等待大概几分钟结束。之后进入主循环每 10 条提示一次Pause for 3 seconds...tqdm 显示整体进度。这段时间可以忙别的别关终端就行。若干分钟到一小时后取决于条数程序自动打开结果文件夹并打印汇总消息总数、最早一条说说的时间、好友数、说说数、转发数、留言数、图片数。目录长这样resource/result/ └── 12345678/ ├── 12345678_全部列表.xlsx ├── 12345678_说说列表.xlsx ├── 12345678_转发列表.xlsx ├── 12345678_留言列表.xlsx ├── 12345678_其他列表.xlsx ├── 12345678_好友列表.xlsx ├── 12345678_说说网页版.html └── pic/ # 全部说说图片打开 HTML 就是一条像空间的时间线你的头像、说说正文、图片下面挂着带头像的每条评论。Excel 直接按年份筛选2014 年的所有说说是一次过滤的事。如果还想把 2014 年之前的可见说说导出成 Markdown图片也下载到本地、含转发和评论再单独跑一次python fetch_all_message.py即可产物在resource/fetch-all/。避坑指南最常碰到的 3 个问题⚠️ 以下三个基本覆盖了绝大多数报错现场。启动即提示无法找到 zbar 共享库症状还没出现二维码程序就打印无法找到 zbar 共享库并退出。原因扫码用的 pyzbar 依赖系统级的 zbar 动态库pip 装不上它。解法先装系统库再重跑。Linux 执行sudo apt install zbardnf 系发行版用sudo dnf install zbarmacOS 执行brew install zbar程序检测到 Homebrew 时也可以交互式自动安装。反复出现二维码已失效或卡在认证中症状二维码刚打出来就失效或者一直循环二维码认证中。原因二维码有效期很短超时没扫码确认就会失效网络不稳定也会让轮询拿不到状态。解法保证网络能正常访问 QQ 空间网页二维码一出现就尽快在 2 分钟内扫完。登录成功一次后凭证缓存在resource/user/重跑时选用户序号即可跳过扫码输入 0 才是强制重新登录。导出的时间线比预期短缺了几条说说症状Excel 里最早的时间明显晚于记忆自己发过的内容没出现。原因主程序以空间消息列表为数据源从未来过消息列表的说说比如仅自己可见的抓不到这是数据源边界不是 bug。解法先确认空间设置里消息列表可见再用python fetch_all_message.py导出可见未删除说说含 2014 年前的 Markdown 版本做对照。网络超时漏掉的个别条目属于正常现象主程序按内容去重重跑不会产生重复数据。适合谁能延伸出什么对普通用户最直接的收益是把散落十几年的记忆变成一套可存档的文件HTML 相当于一个能离线翻的第二空间Excel 可以按年份筛出成长轨迹甚至打印成册。对偏技术和数据向的读者这个仓库是个结构很干净的抓取小样本扫码登录、二分探总数、分页限速、信号中断保存都是标准做法。导出的 Excel 也可以直接喂给情感分析或话题统计做自己的数据实验。和手动翻页的对比维度GetQzonehistory手动翻页 / 截图耗时自动跑完几千条约 1–2 小时含限速等待一次看十来条几千条要翻好几天登录方式扫码一次凭证本地缓存每次手动登录反复输密码或验证数据形态统一字段的 Excel HTML 图片目录零散截图无法筛选统计覆盖范围消息列表全部条目 可见未删除说说翻到哪里算哪里容易漏处理位置完全本地数据不出本机停留在浏览器里无法结构化留存写在最后说说是互联网上最早的时间线之一把它变成机器可读的文件比截图更耐用。按上面的 3 条命令克隆仓库并装好依赖运行python main.py扫码完成第一次全量备份打开resource/result/QQ号/逐个检查 Excel 和网页版需要 2014 年之前的内容再跑一次python fetch_all_message.py补一份 Markdown【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考