十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

QQ空间备份教程:5 分钟扫一次码,历史说说 Excel+网页全量导出

QQ空间备份教程:5 分钟扫一次码,历史说说 Excel+网页全量导出 QQ空间备份教程5 分钟扫一次码历史说说 Excel网页全量导出【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory翻回 2014 年的说说网页版要点几千次上一页而当年配图早过了有效期。GetQzonehistory 是一个 QQ空间说说备份工具手机 QQ 扫一次码可见的历史说说、评论、图片就被归档成本地 Excel 和可翻阅的网页版全程数据只落在你自己的硬盘上。四步跑通 QQ空间备份最快 5 分钟整条链路就四步确认 Python → 拿代码 → 装依赖 → 启动。全部命令如下照抄即可。先确认 Python 3 环境查看本机 Python 版本后面所有命令都以它为前提python3 --version获取 GetQzonehistory 源码把仓库拉下来并进入目录git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory建虚拟环境并安装依赖两行命令一步到位不污染系统环境装依赖走国内镜像网络慢也能稳住python3 -m venv myenv source myenv/bin/activate # Windows 激活命令不同myenv\Scripts\activate pip install -i https://mirrors.aliyun.com/pypi/simple/ -r requirements.txt补装 zbar 系统库二维码解码依赖它缺了第一步就会报错。按你的系统挑一行装sudo dnf install -y zbar # CentOS / Fedora # sudo apt install -y zbar # Ubuntu / Debian # brew install zbar # macOS启动主程序开始 QQ空间说说备份跑起来后终端会打印一个黑白字符块的二维码python main.py手机 QQ 扫它并确认程序每 3 秒轮询一次登录状态直到登录成功才开抓。二维码在终端显示乱码打开resource/temp/QR.png直接扫图。 登录凭证以明文存在resource/user/目录文件名即 QQ 号相当于账号钥匙——别放网盘同步、别拷给别人不再用的账号删掉对应文件即可。跑完先看这里QQ空间备份产物在哪、各管什么默认所有产物在resource/result/{QQ号}/下三个resource/子目录的分工由 resource/config/config.ini 定义temp/放二维码图和 JSON 中间文件user/放登录 cookie 缓存result/放导出结果目录写满或没权限就改它。产物里面装了什么适合拿来干嘛{QQ号}_全部列表.xlsx消息列表全量时间/内容/图片链接/评论关键词检索、筛选{QQ号}_说说列表.xlsx你自己发的说说去重年度统计、回忆杀{QQ号}_转发列表.xlsx你转发过的内容梳理我转发过什么{QQ号}_留言列表.xlsx你给别人的留言按人回溯互动{QQ号}_其他列表.xlsx好友的相关动态看别人关于你的记录{QQ号}_好友列表.xlsx列表中出现的好友昵称/QQ/主页通讯录式速查pic/全部图片的本地副本离线保存不怕原图失效{QQ号}_说说网页版.html仿空间样式网页双击即阅点图看高清翻阅程序走消息列表 可见说说两路数据先各自拉全再按作者归属分类去重所以一份导出里既有你自己发的也有别人关于你的记录。机制拆解备份流水线背后的三件事GetQzonehistory/ ├── main.py # 主入口登录→抓取→落盘 ├── fetch_all_message.py # 第二入口导出 Markdown ├── util/ # 登录/请求/分页/解析等模块 └── resource/ # 配置、缓存、cookie、结果首单凭条扫码只发生一次像便利店首单必验证、之后刷会员卡程序先向登录接口申请一张一次性二维码打在终端里你手机 QQ 扫码确认后每 3 秒轮询一次状态直到成功拿到的会话 cookie 按 QQ 号存进resource/user/。下次启动它直接列出已登录用户列表输个序号复用登录态凭条过期了删掉对应文件重新扫码就行。称重猜箱消息总数是二分称出来的服务端不直接报消息总数程序就在 0 到 1000 万之间做二分探测取中点偏移量发一次请求有数据说明总量更大没数据说明更小最多约 24 轮收敛出真值。确认总数后按下面的节奏翻页——每批 10 条、批间停 3 秒跟真人刷页面差不多不容易被当成异常流量count Request.get_message_count() # 二分探测消息总数 for i in trange(int(count / 10) 1): response Request.get_message(i * 10, 10) # 每批 10 条 # 解析 HTML 成 [时间, 内容, 图片, 评论] time.sleep(3) # 批间歇 3 秒 save_data() # 写 Excel 下载图片急停按钮中途掐断也带得走数据程序注册了SIGINT/SIGTERM信号处理你按 CtrlC 手动掐断时它先把内存里已抓到的数据写盘再退出断网不丢前面的进度。落盘阶段还会按作者昵称把消息分流进上面 5 个 Excel 并去重顺手把图片一张张下载到pic/。翻车速查表常见报错一条命令解决现象大概率原因一条命令解决启动提示无法找到 zbar 共享库系统级 zbar 没装sudo dnf install -y zbar按系统换 apt/brew终端只有乱码看不到二维码字体不支持 ASCII 码打开resource/temp/QR.png直接扫图登录失败:请重新登录缓存 cookie 过期删掉resource/user/里对应账号文件再跑长时间停在正在获取消息列表数量二分每轮都要发请求网络慢就慢耐心等太久 CtrlC 中断已抓数据会自动保存再重跑pic/里少了几张图个别图片请求失败重跑python main.pycookie 还在不用重扫一条命令自检 Python 环境和全部依赖是否就位python -c import requests, pandas, qrcode, pyzbar, bs4, openpyxl; print(依赖全部OK)进阶玩法备份之后的三种用法导出 Markdown 纯文本档案想把归档塞进 Obsidian 或做博客跑第二个入口它会生成所有可见说说.md图片同步下载并用本地路径引用python fetch_all_message.py多账号轮换备份resource/user/会积累多个账号的 cookie 文件启动时列出已登录用户列表选序号复用输0重新扫码切到另一个号。结果按 QQ 号分目录存放互不覆盖。用 pandas 做年度统计备份完的 Excel 直接读看看自己哪一年话最多import pandas as pd df pd.read_excel(resource/result/你的QQ号/你的QQ号_说说列表.xlsx) df[时间] pd.to_datetime(df[时间], formatmixed) print(df.groupby(df[时间].dt.year).size())写在最后备份一份十年的说说成本 一次扫码 一次等待Excel 负责分析网页版负责翻阅机器和人各取所需文字、图片、评论分列存放可检索、可筛选、可二次加工数据从头到尾只在你硬盘上cookie 即钥匙别外传平台会改版接口会搬家——硬盘里那份副本永远只听你的。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表