GetQzonehistory:不写一行代码,一次扫码把QQ空间历史说说永久备份回家
GetQzonehistory:不写一行代码,一次扫码把QQ空间历史说说永久备份回家
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
深夜翻手机相册,突然想起高中那条火遍全班的说说的评论区,你想回去看看,却发现早就翻不到了。QQ空间里的几百条动态,正随着平台改版、消息列表越藏越深,一点点变得难以找回。GetQzonehistory 就是来帮你抢回这些记忆的开源工具:它能把QQ空间历史说说完整抓取下来,在你自己的电脑上批量导出为Excel、网页和图片,实现QQ空间说说备份的永久保存。
那些动态,其实一直在悄悄"变远"
你可能会想:动态不都好好地在空间里吗?只要我不删,它就一直在。这话十年前成立,现在越来越不一定了。
- 平台会改版。你有没有发现,空间里的消息列表越来越难翻到老内容?接口调整、展示逻辑变化,都是用户没法控制的事。
- 账号有风险。被盗号、被冻结、长期不登录被回收……任何一样落到你头上,几百条说说连同评论区里的嬉笑怒骂,可能一夜归零。
- 手动翻不现实。就算一切正常,让你对着消息列表一页页往下翻几年前的动态,手机可能先累死。
手动抢救不靠谱,唯一稳妥的办法,是在本地留下一份完整的副本。GetQzonehistory 干的就是这件事——而且它做得很讲究:
- 全程不出你的电脑:所有抓取、解析、导出都在本地完成,你的数据不会经过任何第三方服务器;
- 扫码登录,不用输密码:走QQ官方二维码机制,密码这种东西根本不需要碰;
- 一份数据,三种形态:结构化Excel适合整理分析,还原版HTML适合像逛空间一样浏览,图片单独归档不怕链接失效;
- 自动分类归档:说说、转发、留言、好友列表,跑完自动分好,不用你手动整理;
- 随时能停:中途按Ctrl+C,已经抓到的数据也会先保存下来,不白跑。
一句话概括:你负责扫码,剩下的它全包。
三分钟上手:一条命令、一次扫码、一张报表
从零到第一次看到成果,只需要三下。前提是你的电脑装好了Python,然后:
第一下,把工具请进门。
git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory pip install -r requirements.txt就这么一行接一行跑完,依赖装好,工具就位。想更干净的话,可以先用python -m venv myenv建个虚拟环境再装,不影响使用。
第二下,扫码放行。
python main.py程序启动后会在终端里打印一个二维码,掏出手机QQ扫一下,点确认。第一次登录成功后,登录状态会被缓存到本地,下次再跑直接选号进入,不用重复扫码。
第三下,收下成果。
进度条跑完,程序会自动打开导出目录resource/result/你的QQ号/。里面已经有Excel表格、一个网页版HTML、一个装满图片的pic/文件夹——你的QQ空间说说备份,到这里就齐活了。
从命令到结果,全程不到十分钟,中间你唯一要动的就是扫一下码。
它像一位细心的档案管理员
你可能好奇:它到底是怎么把几年的说说翻出来的?打个比方,它就像一位被雇来整理你旧仓库的档案管理员,按顺序干三件事。
第一件:清点库存。它先估算出你名下大概有多少条消息,然后每次取一小批(默认10条)往回翻,翻完一批歇几秒,避免动作太猛被服务器盯上。
第二件:按内容归档。每条动态读出来之后,它根据内容特征自动分类:你原创的进"说说列表",转发的进"转发列表",好友的留言单独放,互动对象还会整理成一份好友列表。
第三件:装订成册。最后把所有数据写成几份Excel、生成一个还原空间风格的HTML网页,再把说说里的图片按内容命名下载到pic/文件夹。
整个过程里没有一行代码需要你碰——它自己把"抓取、清洗、分类、导出"这串脏活累活全干完了。
导出之后,这些数据还能怎么玩
备份到手只是第一步,这批数据真正的乐趣在于"用起来"。
玩法一:做一份属于你的数字年志。从Excel里按年份统计发布量,看看哪年你最话痨、哪年你突然安静了。给数据发烧友的最小示例:
import pandas as pd df = pd.read_excel("你的QQ号_说说列表.xlsx") df["年份"] = df["时间"].str[:4] print(df["年份"].value_counts().sort_index())就四行,跑完你就能看到每一年的说说条数——一段用数字重放的青春。
玩法二:把空间搬回家当博客。导出的HTML是完整还原网页版空间的,离线也能打开,图片、评论都在。想搭个人回忆站点,直接拿它当底稿就行。
玩法三:做电子相册。pic/文件夹里所有照片按内容命名、按时间归位,拖进任意相册软件,就是一部按时间线播放的影像史。
几个不为人知的小彩蛋
工具默认的设定已经够用,但如果你想调一调,有三个小地方值得动。
- 调节抓取节奏。在
main.py里找到time.sleep(3),这就是每翻一批休息的秒数。网络好可以调小跑快点,网络差就调大求稳。 - 只备份某一年。给循环里加一个年份判断,就能只把特定年份的说说留下,其他跳过。
- 定时自动备份。配个系统定时任务,每个月自动跑一次,让备份变成习惯,而不是心血来潮。
翻车自救指南:先别慌
第一次跑,踩到一两个小坑很正常,先别慌,按表自救:
| 症状 | 大概率原因 | 先试这招 |
|---|---|---|
| 扫码后没反应或提示二维码失效 | 网络不稳、二维码过期 | 换稳定网络重新运行,生成新码再扫 |
| 只抓到一部分说说 | 接口限制或消息列表本身没有更早记录 | 把抓取间隔调大、多跑几次,允许它慢慢补全 |
| 个别图片下载失败 | 原图链接已失效 | 去Excel里拿链接手动存,或重新跑一遍 |
| 装依赖时报错 | 网络源太慢 | 加国内镜像源,如-i https://pypi.tuna.tsinghua.edu.cn/simple |
最后两句放心话,和一个行动邀请
关于安全,给你两句定心话。第一句:你的数据从头到尾只在你自己的电脑上转圈,工具代码完全开源,放心可以去翻。第二句:它只读你的历史消息,不碰密码,登录走官方扫码流程,登录凭据缓存也都在本地,用完删掉resource/user/下的文件即可。
回忆这种东西,丢了就是丢了,没有人能替你找回。与其等某天突然发现翻不到那条说说再后悔,不如现在花十分钟,给QQ空间的所有历史说说做一次永久备份。工具入口在main.py,想研究扫码登录的原理看 util/LoginUtil.py,想了解数据清洗和导出细节看 util/ToolsUtil.py。扫码,等它跑完,然后安心地把青春存档。
【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
