
一次实测我把十年QQ空间说说完整备份到了本地【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory前几天整理旧照片翻出一张 2013 年配在 QQ 空间说说里的图顺手点进空间想找回当年的完整文案结果页面加载了半天全是空白。那一刻我意识到回忆还在云端但我随时可能失去它。于是我用一个晚上借助开源工具 GetQzonehistory 完成了一次完整的QQ空间说说备份。这篇文章就是这次实测的全程记录从环境准备到数据落盘每一步都写得能复现。契机为什么我不再相信云端帮你存着说说的内容本身不复杂一段文字、几张图、一串点赞和评论。但它是按时间线排列的删一条、屏蔽一个好友、换一次手机号时间线就会出现缺口。平台策略每年都在变接口说关就关与其祈祷服务器永远稳定不如把数据拿回自己手里。我想要的备份要满足三个条件免费、不依赖特定软件、格式能长期打开。Excel 满足表格需求HTML 满足浏览需求图片文件满足存档需求——这三样恰好就是 GetQzonehistory 输出的东西。认识工具GetQzonehistory 靠什么把说说搬回本地这是一个用 Python 写的小工具核心思路是模拟登录 QQ 空间网页版然后走两条通道把数据取回来消息列表通道抓取空间互动消息页覆盖说说、转发、留言、好友互动等信息未删除说说通道调用空间内部的说说列表接口按页拉取自己发布过的全部可见说说包括 2014 年之前的老内容还能拿到高清图地址。两条通道的结果会合并、去重最后统一落盘。整个流程用一张图就能说清从扫码登录、数据抓取到文件生成的完整流程工具的目录划分也很直观util/下是五个功能模块main.py和fetch_all_message.py是入口配置放在resource/config/config.ini结果默认输出到resource/result/。如果你不想碰 Python项目的 release 页面还提供了打包好的单文件版本双击就能跑。本地备份QQ空间的四步实战记录下面按我实际操作时的顺序走一遍附带踩坑点。第一步拉代码、建环境zbar 是第一个坑git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate pip install -r requirements.txt python main.py依赖列表里有pyzbar它依赖系统级的 zbar 库。在 Linux 上如果报无法找到 zbar 共享库需要先装系统包RPM 系用sudo dnf install -y zbarmacOS 用户则要先brew install zbar。这一步是新手最容易卡住的地方装好就能继续。第二步终端扫码登录全程不碰密码程序启动后会自动向腾讯的登录接口申请一个二维码然后以 ASCII 字符画的形式直接打印在终端里——没有图形界面也能扫。用手机 QQ 扫码确认后登录态 cookie 会保存到resource/user/下次再跑就直接复用不用反复扫码。这一步的安全感在于整个过程不输入账号密码授权范围也仅限于以你的身份访问空间属于标准的扫码授权流程。第三步两条抓取通道互相补齐登录成功后工具先抓消息列表。它每次取 10 条然后强制休息 3 秒——这是刻意的限速设计目的是把请求频率压低避免触发平台风控。我按这个节奏粗算了一下600 条互动消息大概需要 3~4 分钟量大的账号要有耐心别去把延时改小。消息列表跑完后第二条通道开始调用说说列表接口每页 30 条地拉取未删除说说把 2014 年之前的老内容也一并补上然后和消息列表去重合并。这里有个很贴心的机制中间过程会写入resource/fetch-all/[QQ号]/下的 JSON 缓存文件即使中途断网或手动中断重新运行也能接着上次的进度继续不会从头白跑。另外主程序注册了中断信号处理器你在终端按CtrlC停掉程序它也会先把已经抓到的数据保存下来再退出。第四步等待期间它在后台做的三件事抓取完成后工具会自动完成三件收尾工作把数据整理成多张 Excel下载说说里的所有图片默认转成高清图地址再把说说、评论、表情重新渲染成一个还原网页版排版 HTML 页面。图片会按说说内容自动命名重名时自动加时间戳后缀文件名里的非法字符也会被清洗掉。落盘之后的成果六张表、一个网页、一个相册全部完成后打开resource/result/[你的QQ号]/目录你会看到下面这套结构按 QQ 号分目录存放表格、网页、图片各自归档各文件的用途如下文件内容一句话用途你的QQ号_全部列表.xlsx抓到的所有消息汇总数据全集后续清洗的原料你的QQ号_说说列表.xlsx自己发布的说说最核心的回忆档案你的QQ号_转发列表.xlsx转发过的内容补全互动轨迹你的QQ号_留言列表.xlsx留言板记录那些踩踩还在你的QQ号_好友列表.xlsx好友昵称、QQ、主页好友关系备份你的QQ号_其他列表.xlsx好友在自己空间的互动人际往来的原始记录你的QQ号_说说网页版.html还原网页版排版离线浏览、随手分享pic/全部说说图片高清原图存档我最喜欢的是那个 HTML 文件头像、昵称、发布时间、表情、配图、评论含评论人昵称和头像全部按时间倒序还原双击打开就能像刷空间一样从头翻到尾完全不需要联网。评论里的[em]表情代码会被替换成图片标签连早年那些非主流表情都保留了。QQ空间历史说说导出之后还能怎么玩数据落盘只是开始表格化之后能做很多空间里做不到的事做年度回顾按年份、月份筛选说说统计自己哪一年话最多、哪一年最沉默顺便生成我的年度报告找重要节点用 Excel 的筛选功能定位毕业、旅行、生日等关键日期把多年时间线串成个人大事记整理相册pic/目录已经按说说归好了图片可以直接当素材库做纪念册、拼图、打印都方便分析好友互动把其他列表按 QQ 号聚合看看这些年谁在你空间出现得最频繁。如果懂一点 Python用 pandas 读取 xlsx 后可以自由组合这些维度比如按星期几统计发说说的习惯、按关键词分类内容主题。数据在自己手里玩法没有上限。几个诚实的边界说明实测过程中也有几件事需要提前讲清楚避免期望落差仅自己可见的说说拿不到。这类内容不在空间对外可见的消息列表里任何工具都无能为力消息列表里没有的记录也补不回来。如果某些说说早年被删除缓存里也没有就无法还原限速是保护机制。那个 3 秒间隔不要图快改小否则可能触发风控导致抓取失败请只备份自己的账号。项目自带免责声明仅供学习和技术研究使用拿它去爬别人空间的内容既不合适也有风险。结尾备份一次安心十年这次实测给我最大的感受是备份这件事难的不是工具而是决定动手的那一刻。真正跑起来从扫码到拿到全部数据也就一顿晚饭的功夫。GetQzonehistory 把最繁琐的登录、抓取、解析、归档都封装好了你要做的只是运行一条命令然后看着进度条走完。现在每当我再翻到十年前那条今天天气真好的说说心里都会踏实一分——因为它不仅活在腾讯的服务器上也躺在我自己的硬盘里。这份安心值得你也试一次。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考