尧图建网站 尧图建网站 YAOTU WEB BUILD 免费咨询
ARTICLE DETAIL

资讯详情

深耕网站建设与建站编程的一线实战洞察。

三步导出QQ空间全部历史说说到Excel

三步导出QQ空间全部历史说说到Excel 三步导出QQ空间全部历史说说到Excel【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory打开QQ空间主页时间线里只剩最近几条说说更早的记录已经看不到了。实际上这些记录大多还留在QQ空间的历史消息列表里只是页面不再展示。GetQzonehistory 通过扫码登录拉取这份历史消息列表再合并当前可见说说最终把说说、转发、留言导出成 5 个 Excel 列表和 1 个网页图片全部落盘到本地。 项目速览项目说明仓库地址见下方「装环境」步骤中的克隆命令开发语言Python 3核心功能抓取QQ空间历史消息列表与可见说说的历史数据导出输出格式5 个 Excel 列表、1 个 HTML 网页、pic/ 图片目录适用平台Windows、macOS、LinuxmacOS 需先安装 zbar 核心能力双源抓取分页拉取QQ空间历史消息列表获取早期记录同时补充当前可见的未删除说说覆盖 2014 年之前的内容。扫码登录不输入账号密码用 QQ 手机扫码完成网页登录登录态写入 resource/user/重跑时可直接选择已登录的账号。分类导出说说、转发、留言自动归入不同 Excel 文件字段统一为时间、内容、图片链接、评论。网页还原生成说说网页版 HTML按QQ空间布局排布内容并把缩略图地址替换为高清图地址。中断保存手动 CtrlC 退出时已抓取的数据会写入磁盘重新运行不浪费前面的进度。⚙️ 工作原理上图展示扫码登录、消息列表抓取、数据合并与多格式导出的完整流程登录util/LoginUtil.py 生成登录二维码用 QQ 手机扫码完成QQ空间网页登录。分批抓取程序按每批 10 条请求历史消息列表批与批之间暂停 3 秒从返回的页面里解析出时间、内容、图片链接和好友信息。补充与清洗util/GetAllMomentsUtil.py 拉取全部可见的未删除说说与消息列表数据去重合并util/ToolsUtil.py 负责页面清洗和时间格式处理。分类导出结果写入 resource/result/你的QQ号/ 目录生成 5 个 Excel 列表和 1 个 HTML 页面并把图片下载到 pic/ 子目录。 三步上手装环境克隆仓库并创建 Python 虚拟环境前提是本地已安装 Python 3git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activateWindows 用户把最后一行换成myenv\Scripts\activate。跑起来安装依赖并启动主程序pip install -r requirements.txt python main.py启动后用 QQ 手机扫描终端里的二维码登录。抓取过程以 10 条为一个批次显示进度条每批之间有 3 秒间隔说说越多耗时越长等它跑完。看结果结束后终端会打印各列表的总条数、最早一条说说的时间并自动打开结果目录。到 resource/result/你的QQ号/ 下核对每个 Excel 的行数是否与终端输出一致pic/ 目录里图片是否完整。 产出物说明上图展示导出后 resource/result 目录下的文件组织与分类所有文件都在 resource/result/你的QQ号/ 目录文件内容字段用途QQ号_说说列表.xlsx时间、内容、图片链接、评论自己发布的说说QQ号_转发列表.xlsx时间、内容、图片链接、评论自己转发的内容QQ号_留言列表.xlsx时间、内容、图片链接好友的留言记录QQ号_全部列表.xlsx时间、内容、图片链接、评论历史消息的完整合并记录QQ号_好友列表.xlsx昵称、QQ、空间主页互动过的好友汇总QQ号_说说网页版.html说说、图片、评论还原QQ空间版式的可视化页面说说图片会下载到 pic/ 子目录按内容命名重名时自动加时间戳。好友发的非互动内容单独导出到 QQ号_其他列表.xlsx。 适用场景个人说说档案整理用 QQ号_说说列表.xlsx 按「时间」列排序逐年翻阅自己的发布记录把 pic/ 目录复制到移动硬盘集中备份旧照片用 QQ号_全部列表.xlsx 核对各分类是否有遗漏制作可视化回顾页浏览器直接打开 QQ号_说说网页版.html说说、图片、评论按时间线展示修改 HTML 中的样式调整配色或导出成 PDF 打印说说数据统计用 pandas 读取 QQ号_说说列表.xlsx按年、月统计发布频率对「内容」列做关键词计数回看某个阶段常写的主题换平台前的数据留存完整跑一次导出保留 resource/result/ 整个目录后续想更新时重新运行程序同名文件会被新结果覆盖❓ 常见问题macOS 提示缺少 zbar 库运行brew install zbar安装Linux 系统用包管理器安装例如sudo dnf install -y zbar。重新执行python main.py程序启动时会自动检测 zbar 是否可用。登录成功但抓到的数据很少先用浏览器打开QQ空间确认「历史消息」本身可以正常翻页查看。重新运行时在账号列表里选 0触发重新扫码登录。不在消息列表中的记录如仅自己可见的说说无法被获取这是数据源的限制。pic/ 目录里图片比预期少对照终端打印的图片总数检查目录文件数。失效链接会被程序跳过不会导致整体失败。换网络环境重新运行一次可补抓临时失败的部分。运行速度慢或想中途退出每批 10 条、间隔 3 秒是固定设计总时长随说说数量增长。需要中断时按 CtrlC已抓取的数据会保存下次重跑即可。⚠️ 注意事项本工具仅限个人存档与技术研究使用不要用于商业用途。 抓取走的是QQ空间网页接口遵守平台使用条款不要去掉内置的请求间隔做高频抓取。 导出结果包含好友的昵称、QQ 号和留言内容分享前删除涉及他人的信息不要整包外传。写在最后GetQzonehistory 把QQ空间页面上看不到的历史变成 5 个 Excel 列表、1 个 HTML 页面和一个图片目录。数据全部落在本地文件里后续整理、统计、备份都按你自己的节奏来。行动清单克隆 GetQzonehistory 仓库并进入目录创建虚拟环境安装 requirements.txt 中的依赖运行python main.py扫码登录并等待导出完成核对 resource/result/你的QQ号/ 下每个文件的条数把整个结果目录复制到移动硬盘或备份盘【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表