尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

GetQzonehistory:QQ空间历史说说免费备份方案

GetQzonehistory:QQ空间历史说说免费备份方案 GetQzonehistoryQQ空间历史说说免费备份方案【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你有多久没翻过 QQ 空间里那些老说说了想逐条找回文字、配图和评论时手动复制既慢又容易漏。GetQzonehistory 是一个开源工具模拟登录你的 QQ 空间按批次拉取历史消息列表和未删除说说最后导出为 Excel、网页版 HTML 和原图文件全部落在本机。 它比手动操作强在哪对比维度GetQzonehistory手动逐条复制处理范围一次拉取全部历史消息翻多少页复制多少页数据完整性文本、时间、图片链接、评论一起导出图片和评论常遗漏导出格式Excel 分表 网页版 HTML 原图只剩文字或截图中断处理CtrlC 停止时自动保存已抓数据从头再来登录方式官方二维码不碰账号密码需要手动登录网页端关键差异只有两点导出是结构化的评论和图片链接都进表格抓取过程中断了已有数据不会丢。 从零到跑通第一步克隆仓库并装依赖git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv pip install -r requirements.txt激活虚拟环境后Windows 为.\venv\Scripts\activatemacOS/Linux 为source venv/bin/activate再装依赖避免污染本机 Python。依赖只有 pandas、requests、beautifulsoup4、qrcode 等常见库。第二步扫码登录python main.py程序会显示一个二维码用 QQ 手机 App 扫一下即完成登录全程不输入密码。首次运行时如果提示缺少 zbar 库按终端提示装好再重跑原因和解法见文末踩坑速查。登录状态会缓存下来之后再运行不用重复扫码。第三步等待抓取与导出登录后程序先拉取历史消息总条数然后每 10 条一批逐页抓取批次之间间隔 3 秒之后再去空间主页补齐未删除的可见说说最后统一落盘。说说多的账号需要一些时间中途直接 CtrlC 也可以已抓到的数据会先保存。第四步拿到结果结果按 QQ 号建目录放在resource/result/QQ号/下结构如下QQ号_全部列表.xlsx、QQ号_说说列表.xlsx、QQ号_转发列表.xlsx、QQ号_留言列表.xlsx、QQ号_其他列表.xlsxQQ号_好友列表.xlsxQQ号_说说网页版.html按时间倒序还原的网页版说说pic/所有说说的原图 它具体在帮你处理什么登录扫码一次会话缓存复用二维码生成和解析逻辑在util/LoginUtil.py。登录成功后 cookies 写入resource/user/目录下次启动会列出已登录账号让你选择输入 0 重新扫码。缓存文件只是纯文本不想留就直接删掉。抓取分批拉取中断自动保存核心循环在main.py按 10 条一批请求历史消息接口用 chardet 自动识别返回内容编码再用 BeautifulSoup 解析每条的时间、正文和图片链接请求封装在util/RequestUtil.py。程序注册了 CtrlC 的信号处理中途停止时先调用保存函数再退出。导出Excel 分表 网页版 原图保存逻辑同样在main.py的save_data中消息按自己的说说 / 转发 / 留言 / 其他拆分到四张表头像、昵称、评论一并写入随后生成网页版 HTML并把图片逐张下载到pic/文件名取自说说内容前 40 个字符。导出完成后程序会自动打开结果目录终端会打印各表条数和图片总数。 进阶玩法如果你还想用 Excel 做自定义统计导出结果就是普通 xlsxpandas 直接读import pandas as pd df pd.read_excel(resource/result/QQ号/QQ号_说说列表.xlsx) df[时间] pd.to_datetime(df[时间]) print(df.dt.year.value_counts().sort_index()) # 按年统计发帖频率如果你还想拿 JSON 原始数据和更早的内容另有一个入口脚本fetch_all_message.pypython fetch_all_message.py它拉取所有未删除可见说说的 JSON 原始数据含 2014 年之前的内容并替换为高清图片链接结果缓存到resource/fetch-all/适合想自己解析字段的用户。⚠️ 踩坑速查扫码前提示无法找到 zbar 共享库→util/LoginUtil.py依赖 pyzbar 解析二维码Linux 需先装系统库如sudo dnf install -y zbar或sudo apt install -y zbar→ 装完重跑python main.py。扫码后提示登录失败→ 二维码有时效过期或网络抖动都会失败 → 重跑程序拿新码再扫。导出条数比印象里少→ 工具走的是历史消息列表接口仅自己可见的说说、已彻底删除的内容不在其中 → 可见说说的缺口可用fetch_all_message.py补齐。运行很慢 / 中途断网→ 说说多时本身就是按批慢速抓取断网后已抓数据已保存 → 直接重跑续抓批次间隔可在main.py的 sleep 处调整。 数据与隐私边界数据只流向本机抓取、解析、导出全程在你电脑里完成文件只写入resource/result/不上传任何服务器。登录走官方二维码流程不使用也不存储账号密码会话缓存在resource/user/可随时删除。工具只作用于你登录的那个账号不抓取他人空间。代码完全开源登录、请求、导出各模块的分工在util/目录一目了然可自行审查。想找回老说说的第一步是把逐条复制换成一条命令。需要时按上面从零到跑通装一套即可导出结构见export_structure.png。延伸阅读main.py主程序入口抓取循环与保存逻辑util/登录、请求、配置、导出等模块fetch_all_message.py未删除可见说说的 JSON 原始数据获取脚本【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表