ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

QQ空间备份实操:用 GetQzonehistory 免费导出全部说说、评论与高清图片

QQ空间备份实操:用 GetQzonehistory 免费导出全部说说、评论与高清图片 QQ空间备份实操用 GetQzonehistory 免费导出全部说说、评论与高清图片【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistoryGetQzonehistory 是一款免费开源的QQ空间备份工具用手机QQ扫码完成免密登录后它会自动把账号下的历史说说、转发、留言、评论和配图逐条抓取下来整理成 Excel 表格与可离线打开的网页版全部存进你自己的电脑。本文以数据迁移项目的视角带你完成从评估、验收、跑通到善后的全过程。一个常被忽略的事实说说再多也只是寄存在别人的服务器上把QQ空间比作一台你租了十年的服务器你在这里发动态、传照片、写留言积累了上千条记录但这份数据资产的运行权始终不在你手里。服务器的运营方随时可能调整策略、清理旧数据账号一旦出现异常或者某次误操作清空了空间这些内容就会在几分钟内彻底消失。更现实的风险是链接失效。十年前一条说说的配图其原始地址今天可能早已变成死链——你记得发过那张照片字节却已经不在了。这正是QQ空间数据备份的意义把散落在别人机房里的字节转存成你能随时打开、随时检索的本地文件。截图只能留下画面而 GetQzonehistory 带走的是结构化的原始数据。先花十秒做个判断这套工具适合谁不是所有人都需要QQ空间历史说说的完整导出动手之前先对号入座适合不适合发过大量说说、想长期留档的用户只想保存几条特定说说的人手动复制更快打算停用、注销QQ空间的老用户对命令行完全陌生且不愿尝试的人想做个人年度数据统计的爱好者指望一键导出别人账号数据的人工具不支持也不应这么用判断清楚了再往下走。一次导出目录里能验收四样东西运行完成后程序会自动打开resource/result/你的QQ号/目录并在控制台打印出总条数、最早一条说说的发布时间、各类消息数量与图片张数。整个导出结果可以按下面这张结构图验收第一样六张 Excel 表内容分门别类数据没有混在一起而是按消息类型拆成了六张表文件名内容*_全部列表.xlsx所有抓取到的消息汇总含时间、内容、图片链接、评论*_说说列表.xlsx你自己发布的说说*_转发列表.xlsx转发过的每一条内容*_留言列表.xlsx空间留言板的互动记录*_其他列表.xlsx好友在你空间的互动消息*_好友列表.xlsx昵称、QQ 号、空间主页地址时间精确到秒图片链接单独成列评论也做了结构化拆分。这意味着数据不仅是看得见更是可计算的——后面做统计就靠它们。第二样一个双击就能打开的网页版*_说说网页版.html会把说说与转发按时间倒序排列还原出头像、昵称、发布时间、正文、配图和评论列表连 QQ 表情都做了还原处理。它不依赖网络双击即可浏览适合当作一份随时翻看的本地档案。第三样自动下载并高清化的图片配图会被下载到pic/目录文件名直接取自说说内容方便对应到具体动态。抓取时程序还会自动把图片链接替换为高清版本将缩略图参数替换为原图参数避免存下一堆模糊缩略图。即使未来原链接失效本地原图依然完好。第四样一份可复用的登录凭证登录状态会以 Cookie 形式缓存在resource/user/目录下次运行时程序会先列出已登录用户让你选择不用重新扫码——这是为定期备份准备的。第一次跑通只需要三步全程不碰密码运行环境需要 Python 3Windows、macOS、Linux 都支持。克隆仓库、装依赖、启动git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv # Windows: myenv\Scripts\activate # macOS/Linux: source myenv/bin/activate pip install -r requirements.txt python main.py三条命令之后流程开始自动推进整体节奏可以对照下面这张图第一步扫码登录。程序生成二维码手机QQ扫一下即完成登录全程不输入密码也不收集密码。登录凭证只存在本地。第二步等待抓取。进度条按每批 10 条、批间停顿 3 秒的节奏推进这个间隔是刻意设计的限速用于降低触发平台风控的概率条数多时请耐心等待。第三步验收结果。抓取完成后程序会汇总统计并自动打开导出文件夹。如果你中途想停直接按CtrlC中断信号会先触发保存逻辑见main.py的signal_handler已抓到的数据不会白费。新手最容易卡住的五个地方现象原因与对策依赖装不上或下载极慢换成国内镜像源pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt提示无法找到 zbar 共享库二维码识别库缺失。Linux 执行sudo dnf install -y zbarDebian/Ubuntu 为apt install libzbar0macOS 上util/LoginUtil.py会引导你通过 Homebrew 一键安装扫码后提示二维码已失效或无反应确认手机QQ已登录、网络正常、系统时间准确重新运行生成新二维码刚被安全策略拦截时等几分钟再试只抓到一部分说说工具能获取的是空间历史消息列表中的内容列表之外的如仅自己可见的说说天然抓不到网络不稳也会漏批次可多运行几次分批保存跑得特别慢正常现象批间停顿是刻意限速也可分多次运行每次都会增量保存结果另外请求缓存按QQ号存放在resource/fetch-all/目录见util/GetAllMomentsUtil.py多账号之间互不干扰。数据落地之后至少值得尝试三种玩法玩法一用 Pandas 把说说变成年度报告导出的 Excel 列名是时间、内容、图片链接、评论。想看看自己哪个月话痨、哪句话写得最长几行代码就能算出来import pandas as pd df pd.read_excel(你的QQ号_说说列表.xlsx) df[时间] pd.to_datetime(df[时间], format%Y年%m月%d日 %H:%M:%S) df[月] df[时间].dt.to_period(M) print(df.groupby(月).size()) # 每月发说说的条数 df[字数] df[内容].str.len() print(df.sort_values(字数, ascendingFalse).head(3)[[时间, 内容]]) # 最长三条再往上走还能做词频分析、统计配图数量变化把回忆变成一张数据图表。玩法二配置定时任务实现自动增量备份往后的新说说也想收进档案在 Linux/macOS 的 crontab 里加一行每月自动跑一次0 3 1 * * cd /path/to/GetQzonehistory source myenv/bin/activate python main.pyWindows 用户用任务计划程序同样可以。有了 Cookie 复用定时任务甚至不需要重新扫码。玩法三把网页版当作私人时光索引说说网页版.html离线可读适合直接收藏。配合 Excel 做数据检索——想找某年某条内容先查表再回网页版看上下文效率比在空间里一页页翻高得多。安全与边界三个可以放心的理由和一条不能越的线全程本地处理抓到的数据只写入你的硬盘不会上传到任何第三方服务器。扫码免密登录不收集、不保存你的QQ密码Cookie 存在本地resource/user/不放心可随时删除、重新登录。开源可审查登录、请求、解析逻辑分别在util/LoginUtil.py、util/RequestUtil.py、util/GetAllMomentsUtil.py每一步都能自己核对导出路径配置在resource/config/config.ini。同时要划清边界工具自带免责声明仅供学习与技术研究使用不得用于商业或非法用途。备份的对象应该是你自己的空间内容请勿采集他人数据尊重平台规则与他人隐私。行动清单把备份排进今天的日程克隆仓库到本地git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创建虚拟环境并安装依赖装不上就用阿里云镜像运行python main.py扫码完成登录等进度条走完去resource/result/你的QQ号/验收六张表、网页版和高清图用得顺手的话在项目主页点一颗 Star帮更多想备份的人找到它备份这件事最怕的不是麻烦而是以为数据会一直在。今天花十几分钟完成一次导出十年后你会感谢现在动手的自己。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进