GetQzonehistory一键导出QQ空间历史说说Excel的完整备份方案【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory手动复制一条空间说说大约要10秒。如果你账号里有3000条历史说说那是8个多小时纯手工搬运图片还得逐张另存——而这类重复劳动本来就该交给脚本。GetQzonehistory 做的事情很简单把QQ空间的历史说说到自动导出为Excel连同原图、离线网页版和好友互动清单一起打包存到本地。 为什么手动整理行不通QQ空间的网页端对旧内容并不友好主页只展示近期动态更早的内容散落在消息列表里只能一页一页往回翻。单条说说还好说上万条互动消息靠人工复制既慢又容易漏漏掉的那几条往往恰恰是最早、最有记忆点的内容。除了效率问题还有两个更现实的隐患数据随时可能不可恢复。账号异常、平台策略调整都可能让早期内容彻底无法访问硬盘损坏尚且可以抢救线上数据没有第二份就真没了。散落在多个角落。自己的说说、转发、留言、评论分散在不同页面人工整理基本不可能对齐最终得到的只是一堆残缺片段。GetQzonehistory 的思路是反过来既然网页端提供了消息列表这个可翻页的入口那就让程序替你翻完翻完再和你当前可见的说说列表做一次合并把能拿到的内容一次性落到本地文件里。 三步跑通QQ空间备份准备工作只需要一个 Python 3.7 环境。下面是从零到跑通的完整命令git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 用 myenv\Scripts\activate pip install -r requirements.txt python main.py启动后程序会展示登录二维码用手机 QQ 扫码即可全程不需要输入密码。macOS 用户第一次运行如果提示缺少 zbar 库扫码相关的 pyzbar 依赖程序会自动检测 Homebrew 并询问是否代为安装回复 y 即可细节见 util/LoginUtil.py。登录成功后终端会打印用户QQ号,昵称登录成功随后进入抓取阶段进度条以10条为单位推进。跑完时程序会直接打开结果文件夹你只需要检查文件。 跑完之后你得到什么6个Excel加1个离线网页结果统一落在resource/result/你的QQ号/下首次运行会自动创建目录resource/result/你的QQ号/ ├── 你的QQ号_全部列表.xlsx # 消息列表全量记录 ├── 你的QQ号_说说列表.xlsx # 自己发布的原创说说 ├── 你的QQ号_转发列表.xlsx # 转发类内容 ├── 你的QQ号_留言列表.xlsx # 留言类内容 ├── 你的QQ号_其他列表.xlsx # 涉及好友的其他动态 ├── 你的QQ号_好友列表.xlsx # 互动好友昵称、QQ、空间主页 ├── 你的QQ号_说说网页版.html # 离线还原的说说时间线 └── pic/ # 所有说说图片按内容自动命名各 Excel 的字段都很直白方便直接用筛选或公式做二次处理文件字段全部/说说/转发列表时间、内容、图片链接、评论留言/其他列表时间、内容、图片链接好友列表昵称、QQ、空间主页其中内容是消息的完整摘要文本评论列保留了与每条说说相关的互动数据。所有图片会下载到pic/子目录文件名取自说说的开头文字自动去除特殊字符、截断到40字以内重名文件会追加时间戳避免覆盖。那个 HTML 网页版值得单独提一句它把说说、转发按时间线合并还原QQ 表情也替换成了图片标签双击就能在浏览器离线翻阅效果接近空间原貌。 程序替你做了什么一次运行的完整时间线理解下面这条流程你就知道导出结果为什么可信登录取凭证扫码后程序拿到 cookies缓存到 resource/user/ 目录下次运行可直接复用。统计消息总数向空间消息接口查询总条数决定要翻多少页。分页翻消息列表每次请求10条批与批之间停顿约3秒限速保护main.py 主循环中可以看到用 BeautifulSoup 解析每条消息的时间、内容摘要和图片链接同时把消息里出现的好友昵称、QQ、主页链接顺手记录下来。合并可见说说消息列表覆盖不到最近的内容util/GetAllMomentsUtil.py 会再抓取一份未删除说说列表做内容相似度比对去重后并入主数据——相当于两套记录对了一次账谁多谁少都不丢。落盘输出按自己发的/转发/留言/其他分类写入6个Excel逐张下载图片最后渲染出 HTML 网页版。整个过程中没有任何数据上传到第三方服务器所有解析和存储都在本机完成。️ 两种进阶用法独立导出一份纯可见说说Markdown。项目里还有一个 fetch_all_message.py它是独立入口专门抓取所有可见的未删除说说注释标明覆盖2014年之前的内容输出为一个所有可见说说.md正文、本地图片、每条评论、转发的源内容全都包含原始 JSON 缓存在resource/fetch-all/下重跑时可直接复用缓存而不是重新请求。如果你只关心自己发的内容、不想要好友互动数据这个入口更轻量。对Excel做二次分析。导出的字段规整用 pandas 读进来就能做统计按年份分布看哪一年话最多、统计点赞数最高的前几条、找出留言互动最频繁的那几个QQ号。这些结论对回忆杀来说比翻网页快得多。❓ 高频问题与解答macOS 报 zbar 相关错误pyzbar 依赖系统的 zbar 库。程序检测到 Homebrew 后会提示一键安装选 y 即可没有 Homebrew 的话需要手动装 zbar报错信息里有指引。为什么有些说说没导出工具的数据源是消息列表 可见未删除说说。已经删除的说说、从未出现在这两个入口里的内容比如仅自己可见的早期说说是拿不到的这是平台侧的限制不是程序漏抓README 中也做了同样说明。导出过程很慢正常吗正常。每页10条、批间停顿3秒是刻意的限速节奏说说到万级数量时总耗时会到几十分钟。挑一个网络稳定的时段挂着跑即可。中途断了怎么办按 CtrlC 会触发保存逻辑把已抓到的数据先写成Excel再退出不会白跑已进行的进度。个别图片下载失败历史图片链接失效是常见情况程序会跳过坏链接继续处理不影响文字和其余图片的完整性。⚖️ 开跑前的几件小事数据边界程序只获取你自己登录账号的数据全程本地处理不经过任何远程中转。用途合规项目自带免责声明——仅限个人学习和技术研究遵守QQ平台使用条款不用于商业或任何侵犯他人权益的场景。资源预估图片是大头提前留足磁盘空间时间上按消息总数 ÷ 每10条约5秒粗略估算心里有数再开跑。保存位置文件保存路径由resource/config/config.ini控制见 README 的目录结构说明想换目录时改这里以项目实际为准。 最后跑完那一刻终端会告诉你最早的一条说说发布在20XX年X月X日。把resource/result/整个文件夹扔进网盘你的空间档案就真正属于你了——十年后再打开那份全部列表.xlsx第一条还是当年写下的那行字一个字节都不会少。现在就可以git clone下来先跑一次看看你空间的最早一条到底藏在哪一年。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
阅读完成 · 觉得有帮助?