资讯动态

把QQ空间历史说说全部搬回本地,一个开源工具4步搞定

发布时间:2026/8/14 9:53:27 来源:尧图企业网站定制
把QQ空间历史说说全部搬回本地一个开源工具4步搞定【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你有没有过这种时刻突然想翻看五年前的那条说说结果发现它早被淹没在几百条动态里翻到手酸也找不到或者担心哪天QQ账号出问题那些带照片、带评论的青春记录说没就没。GetQzonehistory 就是为解决这个痛点而生的开源工具它能一次性把你在QQ空间发布过的历史说说连同图片、评论抓回本地存成Excel、网页和图片三份备份全程不需要你手动翻页更不会把你的数据传到任何第三方服务器。下文把它拆成4个关卡你跟着走一遍就能跑通整条链路。先说结论这份工具的核心价值就一句话——QQ空间历史说说备份本地化、可离线、可检索。第一关领装备三行命令把环境拉起来这个工具用Python写的你只需要在电脑上装好Python 3.6以上的版本再按顺序执行下面几步。为什么推荐先建虚拟环境因为后续要装的十几个依赖包pandas、beautifulsoup4、Pillow这些只隔离在这个环境里不会污染你系统里其他项目的Python出问题删掉重来也干净。git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory python -m venv myenv source myenv/bin/activate # Windows 用 .\myenv\Scripts\activate pip install -r requirements.txt看到命令行末尾没有报错说明装备齐了。依赖清单里除了上面提到的三个还有qrcode生成二维码和pyzbar识别二维码这两个是下一关的关键道具。第二关刷脸进门手机QQ扫个码就完成登录装备齐了直接运行python main.py。程序会在终端里打印出一个二维码这时掏出手机QQ点右上角扫一扫对准屏幕确认登录即可。整个过程不涉及账号密码登录走的是QQ官方的扫码接口密码不会经过这个工具。️ 新手易踩坑如果你的电脑是Linux或macOS扫码前可能会提示找不到zbar库。别慌按提示执行sudo dnf install -y zbarFedora系或brew install zbarmacOS装上即可这是pyzbar识别二维码的底层依赖。登录成功后程序会把登录状态缓存到resource/user/目录。下次再运行它会直接列出已登录账号让你选不用重复扫码——这在后面讲定时备份时很省事。登录和扫码的逻辑集中在 util/LoginUtil.py想研究二维码轮询机制的话从它入手。第三关坐等收数据看看程序在后台都干了啥扫完码程序会开始自动干活。它的大致动作是这样的先向QQ空间的历史消息接口发起请求每批拉10条说说解析出时间、文本、图片链接和评论循环取完全部数据每批之间主动停3秒避免把服务器请求得太密集。全部拉完后还会调用一个可见说说全量获取模块把消息列表里没覆盖到的内容再补一轮尽量保证数据不遗漏。整个登录→抓取→处理→导出的走向项目里这张图画得很清楚跑程序前可以先扫一眼建立全局认知图GetQzonehistory从登录验证到数据导出各环节的流转关系黄色节点含分支逻辑对应获取消息列表和补充可见说说两条数据通道这里有个细节值得注意接口返回的原始HTML里带着\x开头的十六进制转义字符程序会先用正则把它们还原成中文再解析这就是 util/ToolsUtil.py 里process_old_html干的事。所以你最终看到的说说内容是干净的、可直接阅读的文本。第四关清点战利品Excel、网页、图片三件套到手跑完最后一步程序会自动打开导出目录里面的结构长这样图导出结果以你的QQ号为目录名存放在 resource/result/ 下包含多份Excel、一个网页版文件和一个pic图片文件夹具体来说你会拿到这几样东西Excel文件按类型拆成你的QQ号_说说列表.xlsx、_转发列表.xlsx、_留言列表.xlsx、_好友列表.xlsx等每张表都带时间、内容、图片链接、评论列直接丢进Excel或pandas里就能分析。网页版HTML程序会把说说和转发按时间倒序渲染成一个可离线浏览的页面头像、图片、评论区一应俱全双击就能看像回到了QQ空间网页版。pic图片文件夹说说里附带的图片会被自动下载到本地文件名直接取自说说内容的关键词重名会自动加时间戳方便你日后按内容找图。拿到Excel后最轻量的玩法是拿pandas做统计。比如下面这段加载备份文件按年份看看你每年发了多少条import pandas as pd df pd.read_excel(你的QQ号_说说列表.xlsx) df[发布时间] pd.to_datetime(df[时间]) print(df[发布时间].dt.year.value_counts().sort_index())隐藏关卡三个进阶玩法按需解锁第一关只是拿到了基础版如果你想玩得更顺手下面三个思路可以试试。玩法一补全2014年之前的说说。主程序走的是历史消息列表列表里没有的内容比如部分仅自己可见的说说会漏掉。仓库里的fetch_all_message.py走的是另一条可见说说全量获取通道一页拉30条并把原始JSON缓存到resource/fetch-all/跑一次能补齐不少缺口。玩法二把抓取节奏调慢。想对QQ服务器更温柔一点打开main.py找到循环里的这行time.sleep(3) # 每抓10条歇3秒把它改成5秒或更长即可代价是总耗时变长换来的是请求更不容易被限流。玩法三挂到定时任务里自动备份。因为登录状态已缓存Linux/macOS可以用crontab每月跑一次0 2 1 * * cd /path/to/GetQzonehistory source myenv/bin/activate python main.py。Windows用户则用任务计划程序新建一个月度触发器指定运行myenv\Scripts\python.exe main.py。️ 新手易踩坑如果发现只能导出部分说说多半是网络波动导致某批请求失败。程序对每批数据都有容错失败会自动跳过继续下一批所以多跑几次把几次的结果合并往往能凑齐完整数据。最后一步现在就跑一次给自己留份数字保险备份这件事做一次的成本远低于后悔的成本。工具的使用逻辑不复杂装好依赖、扫码登录、跑完看resource/result/目录三分钟就能上手。代码全部开源接口调用、数据处理、导出渲染的每一环都能在源码里找到对应实现——想深挖的话请求逻辑看 util/RequestUtil.py配置项看 util/ConfigUtil.py导出渲染看main.py里的save_data和render_html两个函数。现在就去克隆项目跑通第一遍。等那批Excel和网页落在你硬盘上你就再也不用担心哪条说说会悄悄消失了。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价