十年匠心定制 · 商业建站与技术教学双线并行 咨询热线:400-886-1026 service@lmnt.cn
ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

QQ空间历史说说完整导出 · GetQzonehistory 一键本地归档

QQ空间历史说说完整导出 · GetQzonehistory 一键本地归档 QQ空间历史说说完整导出 · GetQzonehistory 一键本地归档【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你大概率也遇到过QQ空间里几年前发的说说图片开始裂掉、评论变得残缺而平台并不提供完整的导出功能。GetQzonehistory 可以完整导出 QQ空间历史说说扫码一次把你的说说、转发、留言、图片整理成本地 Excel、HTML 和图片存档。GetQzonehistoryQQ空间历史说说本地归档工具它解决的是一个很具体的问题QQ空间网页版不提供批量导出手动复制粘贴图片一张张另存几百条说说能折腾一整天。GetQzonehistory 模拟 QQ空间网页端的扫码登录自动翻页抓取你账号下的历史消息列表逐条解析说说的时间、内容、图片链接和评论最后分类整理成 Excel 表格、网页版时间线和本地图片文件夹。相比手动备份这款免费的说说导出工具有两点关键差异。第一是流程一步到位从扫码到落盘全程只需要在登录环节交互一次。第二是产出分层——Excel 方便统计筛选HTML 还原原始排版pic/文件夹保存图片本体三者互不依赖丢一个不影响另外两个。配合主页视图可见说说的抓取能力部分数据可追溯到 2014 年之前一次运行基本能覆盖你 QQ空间的完整时间线。从零跑通三步完成首次备份预计总耗时 10 分钟环境与登录后续导出时长取决于说说总量500 条左右约十来分钟。第 1 步克隆项目安装依赖git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv # 激活虚拟环境Windowsmyenv\Scripts\activate # 激活虚拟环境macOS/Linuxsource myenv/bin/activate pip install -r requirements.txtrequirements.txt 里列了 requests网络请求、beautifulsoup4内容解析、pandas 与 openpyxlExcel 生成、qrcode登录二维码等组件一条命令装齐。第 2 步运行主程序扫码登录python main.py启动后终端会显示登录二维码用手机 QQ 扫码授权体验和平时登录 QQ空间一致。看到用户你的QQ号,你的昵称登录成功后采集自动开始。如果之前登录过多个账号程序会列出清单让你选择输入 0 可重新扫码。第 3 步等进度条走完自动验收终端会显示进度条每抓取 10 条暂停 3 秒——这是内置的限速保护避免被平台拦截中途不要手动中断。完成后程序打印统计报告消息总数、最早一条说说时间、图片数量等并自动打开结果文件夹验收方法见下一节。产出物解析数据落在哪里如何逐项核对主程序 main.py 会把全部结果写入resource/result/你的QQ号/目录文件内容说明验收要点你的QQ号_全部列表.xlsx全部可见消息总表时间/内容/图片链接/评论总条数 ≥ 各分类表之和你的QQ号_说说列表.xlsx你自己发布的说说时间范围覆盖你最早到最近的一条你的QQ号_转发列表.xlsx你转发的内容转发来源与正文完整你的QQ号_留言列表.xlsx你收到的留言记录无遗漏你的QQ号_其他列表.xlsx好友发布的其他内容与总表交叉比对你的QQ号_好友列表.xlsx好友昵称、QQ、主页链接与实际好友数基本一致你的QQ号_说说网页版.html网页版时间线含头像、图片、评论双击打开说说与评论正常渲染pic/说说原始图片按说说文字命名抽查几张能正常打开一个容易忽略的细节HTML 里的图片引用的是 QQ空间原始网络链接图片失效后网页版会裂图想长期离线浏览要以pic/里的本地备份为准。项目还提供一个第二入口 fetch_all_message.pypython fetch_all_message.py它从主页视图拉取全部未删除说说含 2014 年之前的老数据以 Markdown 格式写入resource/fetch-all/图片同步下载到同目录。两个入口都跑完后用终端报告的条数对照表格逐项核对数字对得上才算备份真正完成。原理速览四个小模块配合完成采集可以把它理解成一位快递员拿到门牌登录后逐页搬回你的消息列表再分箱打包。main.py 是总流程核心工作由 util/ 下的几个文件分工完成模块职责util/LoginUtil.py二维码登录、cookie 保存与多账号复用util/RequestUtil.py请求历史消息列表分页与消息总量util/GetAllMomentsUtil.py分页拉取可见说说列表含更早的历史数据util/ToolsUtil.py清洗接口返回的 HTML、生成 Excel/HTML 模板、缓存读写util/ConfigUtil.py读取配置、初始化各目录登录态和已抓取的中间结果会缓存在resource/user/与resource/temp/所以重复运行不用重新登录中断后已抓数据也不丢。你不需要懂网络协议记住链路即可扫码登录 → 翻消息列表 → 补说说列表 → 解析分类 → 落盘。边界与注意哪些说说导不出来私密说说导不出设为仅自己可见的说说不出现在消息列表和可见列表里任何工具都拿不到。建议先把老说说改为好友可见再执行导出。抓取速度偏慢每 10 条暂停 3 秒、单次请求还有内置等待总量越大耗时越长。请预留足够时间不要中途 CtrlC万一中断重跑时程序会基于缓存继续。登录态存在本地cookie 以文本文件形式存放在resource/user/下该文件等同于你的登录凭据。别外传该文件夹换电脑或不再使用时记得处理掉。zbar 依赖macOS/Linux 需要系统先装 zbar二维码解析库缺失时程序会提示对应系统的安装命令Windows 无需处理。仅限个人备份用途工具面向备份自己账号的数据请遵守平台规则不要用它抓取他人数据或用于商业用途。现在打开终端依次跑完上面三条命令扫码登录跑完后用终端报告核对一遍 Excel。你的 QQ空间历史说说从此有一份不依赖任何服务器的本地副本。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表