
用GetQzonehistory完整导出QQ空间历史说说一条命令把十年动态搬回本地【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你有没有过这样的时刻翻QQ空间时发现某条说说下面朋友的评论突然被拉回十年前的那个下午又或者换电脑、清缓存之后才意识到那些记录一旦消失就再也找不回来。本文要介绍的GetQzonehistory正是为此而生——它是一款开源 Python 工具能把你在 QQ 空间发布过的历史说说、转发、留言连同图片一起下载到本地生成 Excel 表格和网页版页面全程只需扫码登录一次。一句话总结下载源码 → 扫码授权 → 自动抓取 → 本地归档三分钟跑完整个流程。上图是工具在你电脑上生成的目录骨架所有产出都按 QQ 号归档互不混淆一次备份你能拿到哪些东西跑完程序后所有结果都会落在resource/result/你的QQ号/这个文件夹里。打开它你会得到一套按内容类型分好的文件6 个 Excel 表全部列表、说说列表、转发列表、留言列表、好友列表、其他列表每张表都包含时间、内容、图片链接、评论等字段1 个网页版文件QQ号_说说网页版.html把说说和转发按时间倒序拼成可浏览的时间线头像、配图、评论区都还原了出来1 个 pic 文件夹说说里出现的图片会自动下载到本地按内容命名方便单独整理成相册。这意味着你拿到的不是一段难以复用的日志而是一套可以直接筛选、统计、分享的完整资料。工具内部是怎么运转的GetQzonehistory 把整个抓取过程拆成了四个环节每个环节对应util/目录下的一个模块各管一摊扫码登录LoginUtil.py程序请求腾讯登录接口生成二维码你用手机 QQ 扫一下即可完成授权全程不涉及密码输入登录凭证会保存在本地供下次复用翻页请求RequestUtil.py以每次 10 条的速度遍历空间消息列表并对结果做数量探测摸清你一共有多少条历史消息内容解析GetAllMomentsUtil.py BeautifulSoup从页面里提取说说正文、发布时间、图片链接、评论人昵称等字段还会额外调用空间接口补抓那些未删除的可见说说含 2014 年之前的早期内容本地落盘ToolsUtil.py把解析结果写入 Excel、拼装 HTML 模板、逐张下载图片并统计各类条数打印在终端里。整个链路是登录获取凭证 → 请求数据 → 解析清洗 → 分类存储中间环节出错会自动跳过继续不会中断整个备份三步上手从零开始跑通第一步准备好运行环境你只需要一台装了 Python 3.7 的电脑。强烈建议先建一个独立虚拟环境避免污染系统依赖# 拉取项目源码 git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory # 进入项目目录 cd GetQzonehistory # 创建并激活虚拟环境myenv 是环境名可随意改 python -m venv myenv source myenv/bin/activate # Windows 下改为 myenv\Scripts\activate第二步安装依赖项目把需要用到的库都列在了requirements.txt里一条命令全部装好pip install -r requirements.txt其中比较关键的有requests发请求、beautifulsoup4解析网页、pandas生成 Excel、Pillow和pyzbar二维码的生成与识别、tqdm进度条。如果你在 macOS 上遇到 zbar 报错按终端提示用 Homebrew 安装即可。第三步运行并扫码python main.py程序启动后会先探测已登录用户——如果是第一次使用会弹出一张二维码掏出手机 QQ 扫一下看到登录成功后程序就开始自动抓取。终端会实时滚动进度条你可以清楚看到当前处理到第几批数据。跑完后程序会自动打开结果文件夹并打印一份统计清单类似这样共有 N 条消息说说列表 X 条 / 转发列表 Y 条 / 留言列表 Z 条图片共 M 张最早一条说说发布于 20xx年x月x日请务必留意工具只能获取消息列表和可见说说范围内的内容。那些设置为仅自己可见的说说不在其中这是平台隐私机制决定的任何工具都无法绕过。拿到数据之后怎么用备份只是第一步Excel 才是真正值钱的部分。你可以像处理任何表格一样对它做各种二次加工import pandas as pd # 读取导出的说说列表 df pd.read_excel(你的QQ号_说说列表.xlsx) # 从时间列拆出年份统计每年发了几条 df[年份] df[时间].str[:4] print(df[年份].value_counts().sort_index())按年份统计发帖频率、筛选特定关键词、给重要日期加标签……这些操作在 Excel 里拖拽几下也能完成。而 HTML 网页版则适合直接发给家人朋友一起回忆或者长期存档。下面这张表帮你快速看清各产出的用途产出文件内容适合做什么_全部列表.xlsx所有消息的原始明细全量备份、程序化分析_说说列表.xlsx你自己发布的说说年度回忆、时间线整理_转发列表.xlsx转发过的内容回顾当年转发过什么_留言列表.xlsx收到的留言保存朋友的互动痕迹_好友列表.xlsx出现在动态里的好友及主页联系人索引_说说网页版.html带图片和评论的网页时间线直接浏览、分享pic/文件夹说说配图的本地副本单独整理成相册两个入口按需二选一除了main.py项目还提供了一个fetch_all_message.py。两者的差别在于产出格式对比项main.pyfetch_all_message.py输出格式Excel HTML 图片Markdown 文档 图片数据来源消息列表 可见说说可见说说分页抓全图片处理下载到 pic 文件夹下载到缓存目录并嵌入 Markdown适合场景想要结构化表格做分析想要一份纯文本可读的存档如果你只是想快速留一份人肉可读的记录跑fetch_all_message.py拿到 Markdown 就够了如果要做筛选统计main.py的 Excel 是更好的选择。排错与常见问题速查第一次运行多少会遇到点小状况这里把最常出现的问题列成速查表现象原因解决办法提示找不到 zbar缺少二维码识别库Linux 用sudo apt install libzbar0macOS 按提示安装 zbar二维码一直认证中二维码过期终端会提示重新生成再扫一次即可某批数据返回为空单次请求超时或网络抖动程序会自动跳过继续无需干预抓到的条数比预期少部分内容仅自己可见属正常现象平台隐私限制无法绕过中途想停数据没抓完按 CtrlC程序会先把已抓到的内容保存再退出如果你的情况不在表里翻一翻项目 README 和 issue 区多半能找到前人的处理记录。把主动权拿回自己手里说到底工具的价值不在于多酷而在于它把你和平台之间的单向依赖变成了一份随时可以带走的本地资产。下次再有人问起你那些年发的说说还在吗你大可以打开文件夹把 HTML 拖进浏览器一页页翻给他看。现在就动手吧克隆代码、装好依赖、扫码给自己存一份不会过期的记录。十分钟后你就能拥有一份完整的历史说说存档——这可能是你为过去的自己做的最简单也最划算的一件事。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考