尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

5分钟导出QQ空间全部历史说说:GetQzonehistory完整指南

5分钟导出QQ空间全部历史说说:GetQzonehistory完整指南 5分钟导出QQ空间全部历史说说GetQzonehistory完整指南【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你登录QQ空间想找回三年前发的第一条说说却发现时间线里早已没有它的踪迹——这时候就需要 GetQzonehistory。这个 Python 数据备份工具会把QQ空间历史消息列表里的全部说说、转发、留言导出成 Excel 和离线 HTML 档案全程本地运行不传输密码。装好跑起来5分钟完成首次导出环境要求很简单Python 3.7 以上。Linux 用户需要额外装一下 zbar识别登录二维码用# 克隆项目 git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory # 创建并激活虚拟环境 python -m venv myenv source myenv/bin/activate # Windows 用 myenv\Scripts\activate # 安装依赖并启动 pip install -r requirements.txt python main.py程序启动后终端会打印一个登录二维码用手机QQ扫码确认即可。整个安装过程大约 5 分钟之后的导出时间取决于你的数据量1000 条消息大概 10-20 分钟终端里有进度条不用盯着看。跑完你得到什么QQ空间导出文件都放在哪运行结束后工具会自动打开resource/result/你的QQ号/目录内容如下文件内容全部列表.xlsx所有历史消息按时间排序说说列表.xlsx你发布的说说含时间、内容、图片链接、评论转发列表.xlsx/留言列表.xlsx你的转发记录、与好友的留言互动好友列表.xlsx互动好友汇总昵称、QQ、空间主页QQ号_说说网页版.html还原空间说说界面的离线网页含图片和评论区pic/目录所有说说图片自动下载按内容命名单条说说记录大致长这样2018年9月2日 21:47:30 新学期第一条说说 http://.../s1.jpg 1条评论。Excel 可以直接筛选、透视 HTML 版用浏览器打开就能翻点图片还能看高清大图非常适合攒一本数字纪念册。它是怎么做到的登录、抓取、导出三步走扫码登录LoginUtil.py 走QQ官方扫码通道终端里生成二维码你扫码确认后拿到 cookies 并缓存在resource/user/下次运行免重扫。全程不涉及密码账号安全性有保障。历史消息抓取RequestUtil.py先通过二分查找估算你历史消息的总条数再每次取 10 条分批拉取批与批之间留几秒间隔避免触发平台限频。个别批次失败会打印提示并继续不会让整个任务崩掉。解析与去重main.py用 BeautifulSoup 从每页 HTML 里提取时间、内容、图片和好友信息合并当前可见说说时用ToolsUtil.py里的is_any_mutual_exist按内容判重保证同一条说说只出现一次。最后由 pandas 落成 Excel并渲染出那个离线 HTML 页面。谁会用得上大四毕业生正在做毕业纪念册但四年的说说不止一半已经从空间时间线消失。用它把未删除的记录连同好友评论一起拿回来素材才是完整的。帮家人存档的父母孩子离家多年你想留下一份他中学时期的成长记录。在账号还能登录的窗口期跑一次说说、照片、留言全部落盘比截图靠谱得多。自媒体创作者十年前的空间是真实素材库。导出后用 Excel 全文搜索当年的原话和生活细节选题和文案都有处可查。踩坑与排错5个常见问题扫码登录时提示无法识别二维码Linux/Mac⚠️ pyzbar 依赖 zbar 库Linux 执行sudo dnf install -y zbarMac 执行brew install zbar装完重新运行程序。某条说说就是找不回来工具的数据来源是空间历史消息列表如果这条说说从未出现在列表里比如早年设为仅自己可见就属于平台限制不是程序 bug。导出过程感觉特别慢每批请求都有刻意留的等待间隔数据量大时本来就要十几分钟起耐心等进度条走完即可。中途断网或按了 CtrlC不用担心白跑程序注册了信号处理中断时会自动把已抓取的数据保存下来之后重跑继续即可。登录失败或二维码频繁失效清空resource/user/下的旧登录缓存重新运行获取新二维码网络环境差时建议换个时段。代码怎么组织的整个项目结构非常直白main.py是完整导出入口另有fetch_all_message.py可以只抓消息util/目录五个模块各司其职README 里有完整的目录说明。模块职责main.py主入口串联登录、抓取、解析、导出完成后自动打开结果目录LoginUtil.py二维码登录、cookie 获取与缓存RequestUtil.py网络请求、消息总量估算、分页抓取GetAllMomentsUtil.py补充抓取当前仍可见的未删除说说ToolsUtil.pyHTML 解析、内容判重、离线网页模板一起把它做得更好作者自己在 README 里承认代码还有不少疏漏非常欢迎完善。你可以直接提 issue 或提交 PR比较容易上手的方向抓取失败批次自动重试而不是整轮重来增加 JSON / CSV 等新导出格式优化登录流程和终端提示的体验做一个图形化版本降低非程序员的使用门槛收尾每条说说都是你过去的一页现在可以完整落盘保存。打开终端跑一次python main.py今天就完成你的第一次QQ空间数据备份。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表