十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

10分钟把QQ空间历史说说完整备份到本地,别等服务器把它删了

10分钟把QQ空间历史说说完整备份到本地,别等服务器把它删了 10分钟把QQ空间历史说说完整备份到本地别等服务器把它删了【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory把QQ空间的消息列表拉到底最早一条停在 2019 年——可你明明更早之前就开通过空间。GetQzonehistory 是一款免费的开源工具帮你把历史说说做本地备份扫码登录、自动抓取、导出成表格。读完这篇你就能自己跑通一次完整导出。为什么该给历史说说做一份本地备份想想你多年前发的那些内容高考前夜的碎碎念、第一次独自出行的打卡、毕业旅行的合影。它们目前只是寄存在别人的服务器上。平台改版、账号异常、一次手滑的删除任何一条都可能让它们无声无息地消失。「看起来还在」和「真的还在」之间隔着的是一整段找不回来的时间。所以趁现在还能访问先搬一份下来。先看清楚成果六张表、一个网页版、一个图片目录跑完一次工具会在resource/result/下按你的QQ号建好子目录里面是这样一套结果六张 Excel 表格分门别类全部列表所有抓到的消息汇总时间、内容、图片链接、评论各占一列说说列表你自己发布的说说本体转发列表你转发过的每一条留言列表留言板的互动记录其他列表朋友在你空间的互动消息好友列表昵称、QQ号、空间主页每人一行网页版 HTML离线翻旧账的纪念册。说说是按时间倒序还原的头像、昵称、发布时间、正文、配图和评论区都在QQ 表情也会还原成图片。双击就能打开不需要联网。pic/图片目录配图自动下载。文件名直接取自说说内容去掉非法字符、超过 40 字会截断抓取时还会把图片链接自动换成高清版本不用手动补图。问题为什么还会漏掉部分说说解决工具抓的是空间历史消息列表里的内容不在列表中的比如仅自己可见的说说天然抓不到跑之前心里有数即可。问题图片文件名看着被截断了解决文件名由说说内容生成会去掉空格和特殊符号并限制在 40 字以内对照表格里同一行的「内容」列就能对上。三步跑通全流程环境、登录、导出装依赖虚拟环境照抄即可项目基于 PythonWindows、macOS、Linux 都支持没配过环境也没关系下面这段直接复制git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv # Windows: .\myenv\Scripts\activate # macOS/Linux: source myenv/bin/activate pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt问题启动时直接报错说缺少 zbar 共享库解决这是二维码识别的底层库没装。Linux 系执行sudo dnf install -y zbarDebian/Ubuntu 用apt install libzbar0macOS 上 util/LoginUtil.py 内置了引导跟着提示用 Homebrew 一键装即可。扫码登录一次下次自动复用环境就绪后运行主入口程序会在终端直接打印登录二维码用手机QQ扫一下就行全程不需要输密码python main.py登录成功后Cookie 会按QQ号存成文件放在resource/user/目录里。之后每次再运行程序先列出已登录用户让你选输序号直接复用登录态输 0 才重新扫码。问题扫码后二维码一直显示已失效解决确认手机QQ已在线、电脑系统时间准确然后重跑生成新二维码如果刚被安全策略拦下隔几分钟再试别多台设备同时登录空间。跑完为止进度、中断保护与结果统计进度条以每 10 条消息为一批推进每批之间暂停 3 秒——这个节奏是刻意放慢的用来降低触发平台风控的概率。说说多时整体耗时偏长正常现象别中途强杀。中途真想停按 CtrlC 就行程序会先把已抓到的数据存盘再退出这个中断保护逻辑写在 main.py 的 signal_handler 里跑一半不白跑。跑完会自动打开结果文件夹终端还会汇总总条数、最早一条说说的发布时间、各列表条数。想给存档做增量补充时再运行一次即可python main.py # 会先显示已登录用户列表输入序号复用登录态拿到结果之后统计、定时备份与名片用 pandas 数一数「每年发了多少条」。导出的 Excel 列名固定为时间、内容、图片链接、评论几行代码就能看出哪年话痨、哪年沉默import pandas as pd df pd.read_excel(你的QQ号_说说列表.xlsx) df[时间] pd.to_datetime(df[时间]) print(df[时间].dt.year.value_counts().sort_index())再往深了做可以统计配图数量变化、找高频词把回忆变成一份「个人年度报告」。网页版当纪念册定时任务做增量备份。说说网页版.html 适合直接收藏也可以配个定时任务每月跑一次——Linux/macOS 在 crontab 里加一行Windows 用任务计划程序。增量备份的意义在于往后的每条新说说也会被收进同一份档案。好友列表是一张还能用的名片。昵称、QQ号、空间主页一行一人想翻某个老同学的空间时不用靠记忆去搜了。数据流向与使用边界全程本地处理抓到的数据只写入你自己的硬盘不会上传到任何第三方服务器扫码免密登录不收集、不保存QQ密码Cookie 在本地 resource/user/ 目录不放心随时删掉重新扫源码公开可审查登录、请求、解析逻辑分别在 LoginUtil.py、RequestUtil.py、GetAllMomentsUtil.py 里每一步都能自己核对多账号互不干扰登录信息按QQ号分文件存放项目README里写明了免责这个工具仅供学习和技术研究使用。备份的是你自己的空间内容别拿去采集别人的数据尊重平台规则这两条是底线。等你打开结果目录看到十年前那条说说带着原文和图片静静躺在硬盘里时开头那个「消息列表停在 2019 年」的疑问就解了。克隆项目按上面的步骤装好虚拟环境运行python main.py扫码完成登录等进度条走完到 resource/result/ 下翻一翻你的这些年顺手的话给项目点个 Star卡住了就提个 issue【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表