ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

GetQzonehistory:一条命令导出QQ空间全部历史说说和空间图片

2026/8/24 20:35:48 拓冰建站 浏览量
GetQzonehistory:一条命令导出QQ空间全部历史说说和空间图片 GetQzonehistory一条命令导出QQ空间全部历史说说和空间图片【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistoryGetQzonehistory 是一款 QQ空间说说导出工具扫码登录自己的账号后程序在本地把历史消息列表和全部未删除的说说抓取下来分类保存为 Excel、HTML 网页和图片文件夹。整个过程不需要密码也不经过第三方服务器。 谁适合用谁不适合用适合的场景想把自己账号多年的空间说说、评论、图片做一次性归档备份需要结构化数据按时间和内容过滤筛选电脑能安装 Python愿意等待几十分钟到几小时的运行时长不适合的场景想导出别人空间的说说工具只能登录并抓取自己的账号期望拿到仅自己可见的私密说说消息列表里不存在的内容抓不到想要分钟级出结果数千条数据按内置节奏需要数小时 最小上手路径QQ空间历史说说备份的安装与运行命令环境要求Python 3.7 以上Linux 或 macOS 需先安装 zbar 扫码解码库。git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory pip install -r requirements.txt python main.pyLinux 执行sudo dnf install -y zbarmacOS 执行brew install zbar。运行python main.py后终端会打印一个 ASCII 二维码用手机 QQ 扫码并确认看到登录成功字样后进度条开始滚动结束时程序自动打开结果目录并打印说说的总条数、最早一条的发布时间和图片数量。 完整运行流程数据输入、处理与导出产出物整套 QQ空间说说导出流程是一条输入→处理→输出的管道输入扫码登录产生的 cookie保存在 resource/user/ 目录下次运行可选择复用不必再扫码处理一先对历史消息列表接口做二分查找确定总条数再每 10 条一批、每批间隔约 8 秒地抓取处理二调用说说接口按每页 30 条拉取全部可见且未删除的说说可覆盖 2014 年之前的早期数据与消息列表去重合并处理三按内容分类、下载图片、生成网页产出物统一放在 resource/result/{QQ号}/ 目录下文件内容适合用途{QQ号}_全部列表.xlsx消息列表全部条目完整留底、查重{QQ号}_说说列表.xlsx本人原创说说时间/内容/图片链接/评论按年份整理、词频分析{QQ号}_转发列表.xlsx本人转发内容区分原创与转发{QQ号}_留言列表.xlsx好友在本人说说下的留言互动统计{QQ号}_其他列表.xlsx互动消息中的他人内容还原互动上下文{QQ号}_好友列表.xlsx互动好友的昵称、QQ号、空间主页好友关系存档{QQ号}_说说网页版.html按时间倒序还原的网页版说说流浏览、打印pic/全部图片按说说正文前 40 个字符命名图片本地归档关键能力拆解四个值得注意的设计扫码登录与本地会话调用 QQ 官方扫码接口终端直接打印二维码不经过密码输入。登录 cookie 写入本地文件重新运行程序时列出已登录账号供选择。双数据源合并消息列表接口只能覆盖进入过互动消息的说说说说列表接口能拉取全部可见未删除的说说且包含 2014 年之前的早期数据。两者按内容去重后合并补齐各自来源的缺口。图片批量下载规则自动将缩略图链接替换为高清版本按说说正文命名重名自动追加时间戳无效链接直接跳过不报错。QQ空间图片批量下载由此一步完成。中断保护抓取中按 CtrlC 会先触发信号处理函数把已抓到的数据写入 Excel 再退出说说列表的响应会写入本地 JSON 缓存完整抓取一次后重跑不再重复请求该接口。 典型用法三种条件建议如果账号数据量在几百条以内那么可以一次性跑完总耗时约十几分钟到半小时结束后核对终端打印的各列表条数即可。如果主要目的是图片归档那么只需保留 pic/ 文件夹和全部列表.xlsx图片文件与表格中图片链接列可对应追溯。如果历史数据达数千条那么先按每 10 条约 8 秒估算总时长选择空闲时段运行中途中断后重跑即可已缓存部分不会重复抓取。⚠️ 边界与已知限制只能导出登录账号自己的数据不支持抓取他人空间。仅自己可见的私密说说和已删除的说说无法获取消息列表外的内容也不会补全。需要稳定网络内置延时决定速度约为每 10 条 8 秒数千条需要数小时。Linux 与 macOS 必须先安装 zbar否则程序启动时直接退出。HTML 页面中的图片仍指向网络地址需要联网才能显示完全离线查看要依赖 pic/ 目录的本地文件。图片为单线程逐张下载没有断点续传网络波动时部分图片可能缺失。给想读源码的人最值得看的是 util/LoginUtil.py 里的二维码轮询循环ptqrshow 取码、ptqrlogin 轮询状态、check_sig 换取 cookie以及 bkn 和 ptqrtoken 两个哈希的计算方式是理解 QQ 扫码登录接口的完整样本。util/RequestUtil.py 的 get_message_count 用二分查找确定消息总量避免了逐页探测util/GetAllMomentsUtil.py 展示了 JSONP 响应剥离、分页拼接和本地缓存的写法。main.py 里注册 SIGINT 信号处理、在退出前落盘数据的做法同样适合参考。上手只需三步克隆仓库并安装依赖运行 main.py 扫码登录让程序跑完到 resource/result/{QQ号}/ 检查 Excel、HTML 和图片文件夹。请只用于归档自己账号的数据不要抓取他人空间。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考