ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

QQ空间历史说说导出工具GetQzonehistory:一次扫码拿回完整档案

2026/8/24 1:48:36 拓冰建站 浏览量
QQ空间历史说说导出工具GetQzonehistory:一次扫码拿回完整档案 QQ空间历史说说导出工具GetQzonehistory一次扫码拿回完整档案【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistoryQQ空间的旧说说在网页版信息流里已经翻不到但记录本身没有消失——它们还留在账号的消息列表里。GetQzonehistory 是一个免费的 Python 工具通过一次扫码登录把 QQ 空间发布的历史说说、转发、留言全部导出成 Excel 和 HTML并把配图下载成本地文件供你永久留存。旧说说为什么还能找回来QQ空间对外的动态页只展示近期的内容但账号的历史消息列表其实完整保留了谁在什么时间发布/转发/评论了什么。GetQzonehistory 的思路就是绕开动态页模拟扫码登录后按页翻完整个消息列表再把当前仍可见的说说作为补充来源做去重合并。两点需要先说清楚登录采用官方扫码方式全程不接触密码登录逻辑见util/LoginUtil.py抓取、解析、去重、写文件全部在本机完成不经过第三方服务器唯一拿不到的是仅自己可见的说说——这类内容不在消息列表里属于平台侧的边界任何第三方工具都无法突破。从安装到导出5 分钟搭好环境前提是本机装好了 Python建议 3.10 以上其余步骤如下拉取代码到本地git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory进入目录后创建并激活虚拟环境Windows 激活myenv\Scripts\activatemacOS/Linux 用source myenv/bin/activate按requirements.txt安装依赖核心是下面几项一次装齐即可依赖用途requests / chardet网络请求与响应编码识别beautifulsoup4解析消息列表的页面结构pandas / openpyxl / pyarrow生成 Excel 文件Pillow / pyzbar / qrcode二维码生成与识别、图片处理tqdm / fake-useragent进度显示、请求头模拟然后运行这条命令终端弹出二维码后用手机版 QQ 扫码确认python main.py之后的事交给程序进度条会按每 10 条一批发出请求批与批之间自动间隔 3 秒避免请求过密。说说数量大的账号整体需要几十分钟期间不要关终端即可。另外项目的 release 页也提供了打包好的单文件可执行版不想碰 Python 环境可以直接用它。导出结果文件清单运行结束后所有产物集中在resource/result/你的QQ号/下目录结构如下六个数据文件按内容分类文件名都以 QQ 号开头文件内容主要字段全部列表.xlsx消息列表抓到的全部记录时间、内容、图片链接、评论说说列表.xlsx仅自己发布的说说同上转发列表.xlsx自己的转发记录同上留言列表.xlsx好友给自己空间留下的评论时间、内容、图片链接好友列表.xlsx消息中出现的互动好友昵称、QQ、空间主页其他列表.xlsx其余互动消息时间、内容、图片链接同目录还会生成QQ号_说说网页版.html把说说和转发合并成按时间倒序的网页QQ 表情会还原成图片原图链接自动替换为高清版本浏览器打开即可回看pic/子目录存放所有下载成功的说说配图以内容文字命名并自动处理重名。拿到的 Excel 长这样拿去做时间线统计、年度回顾都很顺手时间内容图片链接评论2015年3月20日 14:30:22昵称今天天气真好http://...jpg[(评论时间, 内容, 昵称, QQ)]2016年8月15日 20:45:10昵称毕业快乐无无导出流程的细节整条链路分四段对应main.py里的三个动作扫码登录生成二维码、轮询登录态、缓存登录信息到resource/user/同一台机器第二次运行可直接选上次账号无需重新扫码翻页抓取先查消息总数再以每批 10 条拉取自动识别页面编码部分老消息页是 GBK每批间隔 3 秒util/RequestUtil.py负责所有请求细节补充与去重抓取完消息列表后再拉一遍当前可见说说内容互为子集的会自动跳过保证不重复也不遗漏落盘按自己发布/转发/留言/其他四类分桶写 Excel生成 HTML 页面逐张下载图片。一个实用细节程序注册了中断信号处理导出中途按 CtrlC 也会先把已抓取的数据保存下来不会白跑。进阶用法自定义路径与定时备份改保存位置编辑resource/config/config.ini里面定义了 temp、user、result 三个目录导出目录想放哪就改成哪配置读取逻辑在util/ConfigUtil.py多账号轮换登录态按 QQ 号缓存在resource/user/启动时列出已登录账号供选择适合帮家人分别备份定时备份导出是全量重抓配合系统计划任务Windows 任务计划程序 / macOS launchd每月跑一次即可持续归档新发的内容只导某一类数据分桶逻辑集中在main.py的save_data()里想只留说说或只留图片按注释定位对应分支调整即可。常见问题与解决问题原因解决步骤扫码成功但一直拿不到数据网络抖动或登录态失效重新扫码确认手机 QQ 版本较新换一个网络环境再试导出的条数比印象中少仅自己可见的说说不在消息列表内这是平台边界无法补全其余内容建议多跑一两次确认部分图片没下载下来原图链接已失效或被防盗链拦截程序会跳过失效链接继续执行Excel 里仍保留原链接可手动访问Windows 终端中文乱码控制台默认编码非 UTF-8先执行chcp 65001再运行程序macOS 提示缺少 zbar 库pyzbar 依赖系统库按终端提示用 Homebrew 安装 zbar 后重试进度条走得慢每 10 条固定间隔 3 秒属正常节奏条数多时预留 30 分钟以上中断按 CtrlC 也会保存已有数据项目内部结构一览代码量不大按职责分成五个模块看源码或做二次开发都有明确入口文件职责main.py主流程登录 → 翻页抓取 → 补充去重 → 分类落盘 → 生成网页版util/LoginUtil.py二维码生成、登录态轮询与缓存util/RequestUtil.py对 QQ 空间各接口的请求封装与登录态维护util/GetAllMomentsUtil.py抓取当前可见说说作为消息列表的补充源util/ToolsUtil.py页面清洗、编码处理、HTML 模板与表情还原等工具函数配置与产物目录在resource/下config / user / temp / resultREADME 里附了完整目录说明。青春里的每条说说都值得有个不会被信息流冲刷掉的归宿装好依赖、扫一次码剩下的交给它。本工具仅供个人记忆备份与学习研究使用请遵守 QQ 平台使用条款尊重他人隐私与版权勿用于商业用途。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考