一键导出 QQ 空间历史说说:用 GetQzonehistory 五分钟跑完全流程

📅 发布时间:2026/8/22 22:43:58
一键导出 QQ 空间历史说说:用 GetQzonehistory 五分钟跑完全流程
一键导出 QQ 空间历史说说用 GetQzonehistory 五分钟跑完全流程【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory前几天想把空间里几年的互动消息批量拉下来存档一张一张截图既不快也漏得多索性找一个能一次跑完的办法。下面这个方案就是围绕QQ 空间历史说说导出这件事做的。GetQzonehistory 是一个用 Python 写的本地工具它通过模拟网页端登录拿到消息列表和可见说说再分类、去重后落盘。最终会在resource/result/你的QQ号/目录下生成六个 Excel 表格、一个可离线浏览的网页外加一个存放原图的pic/文件夹。整个过程扫码登录即可不用会写代码。 定位是什么一个 QQ 空间历史说说导出工具把它当成一台批量拉数据 归档的机器来理解几条要点足够看清边界运行方式装好依赖后本地运行数据全程不出本机登录走官方扫码。产出格式全部列表 / 说说列表 / 转发列表 / 留言列表 / 其他列表 / 好友列表六个.xlsx加一个.html网页页图片存到pic/。耗时量级取决于消息条数一般几分钟程序每批抓 10 条、批间隔约 3 秒条数越多越久。上手门槛会建虚拟环境、装依赖即可无需改动代码。从零跑通克隆、装依赖、启动在终端依次执行下面命令。Windows 激活虚拟环境的命令是myenv\Scripts\activatemacOS / Linux 用source myenv/bin/activate。git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate pip install -r requirements.txt装好依赖后启动主程序python main.py启动后终端会弹出登录二维码用 QQ 扫一下完成授权。随后程序开始逐批抓取进度条以10 条为单位推进结束后会在resource/result/你的QQ号/下打开结果目录。逐个看产出文件六个表格加一个网页结果目录下的文件和用途如下文件名前缀是你的 QQ 号QQ号_全部列表.xlsx消息列表里所有互动记录最完整的一份。QQ号_说说列表.xlsx本人原创说说。QQ号_转发列表.xlsx转发内容。QQ号_留言列表.xlsx好友留言。QQ号_其他列表.xlsx其他互动内容。QQ号_好友列表.xlsx出现过的互动好友含昵称、QQ、空间主页。QQ号_说说网页版.html把说说与转发拼成一条类信息流的时间线。pic/按内容命名的原图。各列表的字段含义与用途字段含义能用来做什么时间发表或互动的时间精确到秒按时间排序、还原时间线内容昵称 正文表情保留为文本标记全文检索、关键词统计图片链接关联图片 URL多图用逗号分隔批量下载、归档原图评论评论的昵称、时间、内容JSON 文本分析互动、还原留言那个.html页则负责看它把文字、图片、评论排成接近空间原貌的时间线方便直接翻阅。⚙️ 内部流程扫码、采集、去重、导出整条流水线可以拆成四步扫码登录登录模块 生成二维码扫码成功后把会话凭据存到resource/user/下次可直接复用免去重复扫码。数据采集请求模块 模拟浏览器按 10 条一批翻页抓消息列表同时拉取所有未删除的可见说说作为补充来源。去重合并数据清洗模块 按内容匹配剔除重复项把消息列表与可见说说的结果合并成一份干净的数据。分类导出拆分出说说、转发、留言、其他、好友五份列表下载pic/原图并渲染出.html时间线。断点续传抓取过程中按Ctrl C会先把已抓到的数据落盘不会全部作废再次运行时还会复用resource/fetch-all/下的缓存不必从零重抓。哪三类人适合用它想把老空间留档的人空间数据会随平台调整而变得不完整手动截图又太慢。这里一次跑出结构化表格和原图存到本地硬盘或私有存储即可后续翻看、迁移都不再依赖网页端。做个人时间线、回忆整理的人六个表格天然按类型分好配合.html时间线页能快速把哪年发了什么、和谁互动理清楚。适合做毕业纪念、年度回顾这类按年归档的整理。想研究自己发言与互动的人导出的字段规整、带时间戳和评论结构能直接导入表格工具做统计比如统计某段时间的发言量、最常互动的好友为个人习惯的复盘提供数据底稿。⚠️ 边界与常见坑现象、原因、怎么办现象登录后抓不到数据。原因是网络无法访问空间网页版或登录态失效。先确认浏览器能正常打开空间网页再重新扫码登录仍不行可换到网络稳定的时段重跑。现象数据有遗漏、部分说说没出现。原因是数据来自消息列表与可见说说仅自己可见的私密说说本来就不在其中。这是机制边界无法通过重跑补齐建议提前知悉数据范围。现象图片打不开或链接失效。原因是部分历史图片链接已过期。程序会跳过无效链接继续处理其余图片不受影响可结合日志确认具体失败项。现象担心隐私与合规。数据只在本地处理不上传第三方导出内容涉及他人信息时分享前注意保护隐私并遵守平台条款。 依赖一览与社区入口各依赖包的用途如下依赖包用途requests发送网络请求、抓取页面与图片beautifulsoup4解析空间返回的 HTML 结构pandas / openpyxl / pyarrow组装数据并写出.xlsx表格qrcode / Pillow / pyzbar生成与识别登录二维码tqdm显示抓取与处理进度条fake-useragent / chardet伪装浏览器标识、识别响应编码代码按职责拆在util/目录下阅读 登录模块 与 请求模块 能快速建立整体印象如有改进或问题可在项目仓库的 Issue 区反馈。把几年的空间消息整理成一份可检索的本地档案比反复截图可靠得多。先按上面的命令跑通一遍扫一次码剩下的交给它自动完成。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考