ARTICLE DETAIL

资讯详情

深耕编程入门与网站建设的一线实战洞察。

三分钟把QQ空间全部历史说说导出成Excel:GetQzonehistory完整使用指南

三分钟把QQ空间全部历史说说导出成Excel:GetQzonehistory完整使用指南 三分钟把QQ空间全部历史说说导出成ExcelGetQzonehistory完整使用指南【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory如果你担心多年积累的QQ空间内容某一天突然找不回来那么 GetQzonehistory 这款免费开源工具值得放进你的备份清单。它可以把 QQ 空间的历史说说、转发的内容、好友留言和图片一键导出为 Excel 表格、HTML 网页和本地图片帮你完成一次彻底的 QQ 空间数据归档。整个过程只需要在本地电脑上跑一条命令扫码登录后程序就会自动翻页抓取、分类整理最后把结果文件夹直接打开给你看。下面是从安装到落地的完整走法。3分钟跑起来QQ空间说说导出的安装与启动步骤整个安装流程就是标准的 Python 项目套路拉代码、建虚拟环境、装依赖、跑主程序。# 拉取项目代码 git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory # 创建并激活虚拟环境推荐 python -m venv myenv source myenv/bin/activate # Windows 用 .\myenv\Scripts\activate # 安装依赖 pip install -r requirements.txt # 启动 python main.py启动后终端会打印一个二维码用手机 QQ 扫码即可。登录成功那一刻程序还会告诉你用户QQ号登录成功然后就开始自动干活了。有两个小细节值得提前知道Linux 用户依赖包里的 pyzbar 需要系统的 zbar 共享库支持RPM 系系统执行sudo dnf install -y zbarDebian/Ubuntu 系则装zbar相关包否则扫码环节会报错退出。不想装环境项目的 release 页面提供打包好的单文件可执行程序双击就能跑适合不想折腾 Python 的朋友。依赖方面核心是 requests发请求、BeautifulSoup解析 HTML、pandas openpyxl生成 Excel、qrcode pyzbar二维码生成与识别、Pillow图片处理版本都在 requirements.txt 中锁死了装好基本不会出兼容性问题。导出文件说明一次QQ空间数据归档会生成哪些产物抓完数据后程序会把结果按你的 QQ 号建一个文件夹默认在 resource/result 目录下并在结尾自动打开它。里面的东西大致长这样文件内容QQ号_全部列表.xlsx所有互动记录的汇总QQ号_说说列表.xlsx你自己发布的原创说说QQ号_转发列表.xlsx你转发别人的内容QQ号_留言列表.xlsx好友给你空间的留言QQ号_其他列表.xlsx归不进上面几类的互动QQ号_好友列表.xlsx互动过的好友昵称、QQ号、空间主页QQ号_说说网页版.html还原成类QQ空间网页版样式的可视化页面pic/文件夹说说里的全部图片按内容命名Excel 表格的列结构很朴素就是四列时间、内容、图片链接、评论时间精确到秒评论是结构化的评论人、时间、内容都在里面。网页版则会把 QQ 表情自动替换成表情图片按时间倒序排好图片支持点开看大图——适合直接发给家人回看。图片文件会尝试拿高清链接自动把缩略图 URL 换成大图规格文件名用说说的内容生成重名时自动加时间戳后缀基本不会互相覆盖。数据链路拆解从扫码到Excel经历了什么把整个流程拆成四步逻辑其实很直白扫码登录util/LoginUtil.py 负责和 QQ 官方登录接口打交道拿到会话凭证cookies并缓存在 resource/user/ 目录下以 QQ 号命名。第二次运行时直接选上次的账号即可不用重复扫码。分页抓数据util/RequestUtil.py 模拟浏览器会话分两路取数——一路走历史互动消息接口每页 10 条、每页间隔 3 秒另一路走说说列表接口util/GetAllMomentsUtil.py每页 30 条能覆盖到未删除的全部说说包括 2014 年之前的老内容。解析与去重util/ToolsUtil.py 负责清洗 HTML、处理特殊字符重复内容会被过滤掉不会在结果里出现两条一模一样的记录。分类落盘main.py 根据内容特征把记录分到原创、转发、留言、其他四个桶里再统一写成 Excel、HTML 和图片文件。所以如果你只想改输出格式比如额外导一份 CSV主要动 main.py 的保存逻辑想调抓取节奏就去改 main.py 里的分页大小和 sleep 间隔。模块之间通过 util/ 目录的函数边界交互改起来不伤筋动骨。本地化处理QQ空间数据为什么可以放心备份 很多人对这类工具的第一反应是我的账号和数据会不会过服务器答案是不会没有中间服务器所有请求都是你的电脑直接和 QQ 空间官方接口对话解析、存储全在本地完成不存在数据先上传到第三方再下载的情况。走官方登录流程登录用的是 QQ 标准扫码验证qrcode pyzbar 生成和识别二维码全程不碰账号密码。凭证只存本地登录态缓存在 resource/user/ 的本地文件里你删掉这些文件就等于彻底登出。可控可删导出的数据就在 resource/result/ 下想备份到网盘、U盘或者删除都是普通的文件操作。一句话它更像一台私人归档机而不是一个需要信任的在线服务。三类实用场景个人数据备份还能怎么用个人归档与纪念。用了好几年QQ空间的人说说里基本是一部私人编年史。导出的 Excel 加网页版组合适合做年度回顾、整理某段时期的记忆也适合作为长期电子档案。轻量的自我数据分析。因为字段规整时间 内容 评论拿 pandas 做二次分析门槛很低按月份统计发布频率、看不同年份的话题变化、统计哪些好友互动最多都是十几行代码的事。内容迁移。很多老博文、老照片散落在QQ空间里导出的图片文件夹加 HTML 排版可以直接作为博客迁移、数字遗产整理的素材库比截图保存完整得多。大批量抓取避坑指南限速、中断与边界⚡ 说说上万条的老玩家要注意这几点限速是故意的消息列表每 10 条停 3 秒这个节奏是用来规避平台频率限制的不建议调快账号被临时限制就得不偿失了。中断了怎么办程序注册了 CtrlC 的信号处理你随时按中断键已抓到的数据会先落盘成 Excel 再退出说说列表一路的抓取结果也有本地 JSON 缓存下次重跑会接着用。所以抓了一半断网不是灾难重新运行即可。图片下载量图片是逐张下载的图多的号耗时长属正常现象pic/文件夹大小可以提前心里有数。拿不到的内容要心里有数仅自己可见的说说、已经删除的内容平台接口本身就不返回工具无法变魔术早期上传的图片质量以平台原始存储为准。磁盘空间依赖包加上图片缓存预留几百 MB 到几 GB 比较稳妥主要看你的图片量。常见问题速答Q仅自己可见的说说能导出来吗不能。工具的数据来源是空间可见的历史消息和说说列表接口仅自己可见的内容不在接口返回范围内。Q导出过程中断网了之前的进度会丢吗不会。中断时已有数据会保存重新运行后从缓存/断点继续已处理的内容不会重复抓取。Q导出的文件用别的软件能打开吗Excel 是标准 .xlsxWPS、Google Sheets、LibreOffice 都能直接打开HTML 是普通网页任意现代浏览器可看。QQQ 表情在表格里是一堆乱码标签吗不是。程序会把 QQ 表情转成对应的表情图片网页版直接渲染成图特殊字符也会做转义读起来和你在QQ空间看到的一致。Q会不会影响账号安全工具走官方扫码登录、请求频率克制正常使用风险很低但它本质是模拟网页端行为不建议在公共网络环境下长时间挂机抓取。写在最后谁该把 GetQzonehistory 用起来如果你的QQ空间已经很久没打开过、或者你担心平台规则变化导致老内容消失那么花三分钟跑一次 GetQzonehistory把说说、图片、评论全部落到自己手里是成本最低的一次个人数据备份。它对新手友好扫码即开始、结果自动打开文件夹对想二开的开发者也友好模块边界清晰改输出格式或加数据源都不难——数字记忆值得由自己保管而不是寄存在别人的服务器上。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表