ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

GetQzonehistory 完整指南:4 步把 QQ 空间历史说说免费导出成 Excel 与网页版

GetQzonehistory 完整指南:4 步把 QQ 空间历史说说免费导出成 Excel 与网页版 GetQzonehistory 完整指南4 步把 QQ 空间历史说说免费导出成 Excel 与网页版【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory一、GetQzonehistory 是什么它解决的痛点GetQzonehistory 是一个免费开源的 QQ 空间说说导出工具作用是把账号下的历史说说说成结构化文件保存在本地Excel 表格、可浏览的网页时间线、图片相册。它解决的核心问题是——QQ 空间网页版没有批量导出按钮手动截图复制费时费力且内容散落在消息流里时间久了根本找不到。这个工具会替你登录 QQ 空间分页拉取历史消息列表和未删除的说说再按时间、内容、图片链接、评论整理成文件。整个流程跑在你自己的电脑上数据不经过任何第三方中转跑完后文件夹会自动打开终端还会打印总条数、最早一条说说时间和图片数量等统计信息。二、从登录到导出核心流程的四个阶段阶段一二维码登录与凭证保存工具从 QQ 空间登录接口取回二维码并以字符画形式直接打印在终端里你用手机 QQ 扫一下即可完成登录。LoginUtil.py 负责这条链路轮询扫码状态登录成功后从响应中提取 cookies按 QQ 号命名存入 resource/user/ 目录。下次运行会看到已登录用户列表选中对应账号即可复用输入 0 才重新扫码。阶段二二进制搜索统计消息总量QQ 空间的消息接口不直接返回总条数RequestUtil.py 的做法是在 0 到 1000 万的范围内做二分查找每轮取中间偏移量请求 100 条有数据就往后半段找没有就往前半段找逐步逼近总量。这个预步骤决定了后面进度条的总长度。阶段三分页抓取与解析主循环 main.py 每批取 10 条批间固定休息 3 秒请求层还有 5 秒等待和5 秒连接、10 秒读取的超时控制节奏接近人工翻页降低被限流的风险。每批返回的 HTML 会先用 chardet 探测编码接口是 GBK 系编码再交给 BeautifulSoup 提取时间、文本、图片链接内容重复的条目自动跳过。消息列表抓完后还有一轮补全调用未删除说说接口按每页 30 条翻页页间只停 20 毫秒能覆盖到 2014 年之前的内容每条最多带 100 条评论图片链接会被替换成高清版本最后与消息列表合并去重。阶段四分类保存与多格式输出结果按 QQ 号归入独立目录生成 6 个 Excel、1 个 HTML 网页和 1 个图片文件夹。运行中按 CtrlC 不会白干——程序注册了信号处理会先把已抓到的数据落盘再退出下次重跑只需续上剩余部分。三、实测表现导出结果长什么样六种输出文件各对应什么输出内容适合用来全部列表.xlsx消息流里所有动态完整底账含别人给你空间留下的互动说说列表.xlsx你本人发布的说说时间/内容/图片/评论在 Excel 里筛选、统计转发列表.xlsx你转发的内容单独归档转发源留言列表.xlsx、其他列表.xlsx收到的留言、其他好友动态保留互动记录好友列表.xlsx好友昵称、QQ 号、空间主页通讯录整理说说网页版.html仿空间时间线的页面浏览器打开浏览点图片可看高清原图pic/ 文件夹所有说说图片按说说内容命名相册备份HTML 页面对 QQ 表情做了还原形如 [em]hehe[/em] 的表情代码会自动转成图片标签不会出现一堆方括号文本。耗时与稳定性抓取阶段的固定节奏是每批 10 条约 8 秒3 秒批间等待加请求层 5 秒1000 条消息大约 13 分钟第二轮未删除说说列表按 30 条/页翻页速度明显更快。请求超时被限制在秒级单批失败会跳过该批继续不会整体中断。需要注意的是 macOS 和 Linux 首次运行要先装 zbar 共享库pyzbar 靠它解码二维码缺库时程序会给出安装指引并直接退出不会带着错误状态往下跑。四、适合谁用按用途分四类场景换手机、改密码前的用户先跑一次完整导出得到的是可搜索的 Excel 和图片文件而不是一个截图压缩包。已迁去其他平台的用户把 HTML 时间线当空间时代纪念册留档图片是本地文件不依赖链接长期有效。想做简单统计的人六张表列名统一配合好友列表就能回答哪一年发得最多谁评论我最多这类问题。想改着玩的开发者代码全部开源仓库里另附 fetch_all_message.py可把说说导出成内嵌图片的 Markdown 文件改输出格式只需要动一个模块。五、上手三步与三个坑安装与运行步骤克隆仓库git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory按 README.MD 创建虚拟环境安装 requirements.txt 里的依赖beautifulsoup4、pandas、openpyxl、pyzbar 等。运行 python main.py扫终端里的二维码结束后程序自动打开结果文件夹并打印统计。容易踩的三个坑仅自己可见的说说抓不到。数据源是消息列表和公开说说接口设为仅自己可见的内容不在导出范围内这一点 README 里也明确写了。macOS 缺 zbar。pyzbar 依赖 zbar 共享库程序检测到 Homebrew 时会询问是否自动安装需要手动确认不装则无法显示二维码。登录态会过期。cookies 失效后重新扫码即可已导出的结果按次保存在对应 QQ 号目录下不受影响。六、价值与边界GetQzonehistory 把QQ 空间没有批量导出这件事变成了一条本地可复现的流水线扫码登录、二分计数、分页抓取、分类落盘四步跑完得到六张表、一个网页和一套图片。它的边界同样清楚——只覆盖网页端可见的内容仅自己可见的说说无法找回。若后续想扩展最值得做的两件事是给导出加增量模式跳过已保存的说说以及在抓取中断后记录断点偏移避免重跑重复请求。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表