ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

一键备份QQ空间全部历史说说:从安装到自动导出的完整指南

一键备份QQ空间全部历史说说:从安装到自动导出的完整指南 一键备份QQ空间全部历史说说从安装到自动导出的完整指南【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory做了十年QQ的老用户大概都有同感空间动态翻到深处要反复下拉加载2013 年的老照片和早期好友的评论散落在几百页动态里想一次看全几乎不可能。GetQzonehistory做的就是这件事——把 QQ 空间的历史说说、留言互动、好友信息和配图一次性导出成本地 Excel 和离线网页适合想批量备份自己空间记录的个人用户。快速跑起来整个过程只有一条主线拿到代码、装好依赖、扫码登录、让程序自己跑完。先克隆代码并进入目录git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory接着建一个虚拟环境避免依赖污染本机 Pythonpython -m venv myenv source myenv/bin/activateWindows 用户改用myenv\Scripts\activate激活。然后安装依赖requirements.txt里锁了requests、pandas、beautifulsoup4等全部需要pip install -r requirements.txt最后运行主程序python main.py终端会打印一个二维码打开手机 QQ 扫一下就能建立会话全程不用输入账号密码登录态会缓存在resource/user/下下次启动时可以选择已登录账号免扫码。登录成功后程序先估算消息总条数再每批 10 条地翻页拉取每批之间停 3 秒拉完消息列表后还会通过可见说说接口把 2014 年前后、消息列表里没覆盖到的内容一并补进来。全部结束时会打印说说、转发、留言、好友、图片的条数并自动打开结果文件夹。运行完你会得到什么所有产物落在resource/result/你的QQ号/目录里按 QQ 号自动分文件夹多账号导出互不覆盖内容位置说明全部消息汇总QQ号_全部列表.xlsx时间、内容、图片链接、评论四列含去重后的全量数据原创说说QQ号_说说列表.xlsx只保留你自己发布的说说转发记录QQ号_转发列表.xlsx你转发过的内容含原始来源收到的留言QQ号_留言列表.xlsx好友给你的留言与回复好友动态QQ号_其他列表.xlsx互动里出现的好友发布内容好友信息QQ号_好友列表.xlsx昵称、QQ 号、空间主页链接说说配图pic/子目录每条说说中的图片逐张下载保存离线网页QQ号_说说网页版.html按时间倒序还原说说、转发、评论与头像浏览器打开即可离线翻阅以上文件全部只写在你本机目录不会上传到任何服务器。它内部是怎么跑的代码分成五个模块各管一段顺着依赖关系读一遍就能看懂整个流程模块职责文件路径入口与流程编排登录校验、分批拉消息、去重合并、写 Excel 并生成 HTMLmain.py登录模块生成并轮询登录二维码计算g_tk缓存与复用登录凭证util/LoginUtil.py请求引擎携带 cookie 请求空间接口用二分法估算消息总数内置超时与等待限速util/RequestUtil.py配置管理读取resource/config/config.ini决定缓存与导出目录util/ConfigUtil.py辅助工具清洗接口返回的 HTML、内容去重比对、输出离线网页模板util/ToolsUtil.py另外两个入口各司其职fetch_all_message.py 专注抓取全部可见未删除的说说util/GetAllMomentsUtil.py 按每页 30 条分页拉取并落盘缓存避免重复请求。进阶玩法定期自动备份在 crontab 里加一行让它每周日凌晨自动跑0 2 * * 0 cd /path/to/GetQzonehistory source myenv/bin/activate python main.py要留意登录态会失效二维码那一关仍需人工扫所以更现实的做法是设一个每周提醒花两分钟扫码跑一次导出按 QQ 号分文件夹天然支持增量更新。自定义导出路径编辑resource/config/config.ini改result、temp、user三项指向新目录即可util/ConfigUtil.py 每次启动都会重新读取这份配置。导出数据二次处理拿到 Excel 后用 pandas 几行代码就能统计发布频率import pandas as pd df pd.read_excel(QQ号_说说列表.xlsx) df[时间] pd.to_datetime(df[时间], format%Y年%m月%d日 %H:%M:%S, errorscoerce) print(df.set_index(时间).resample(ME).size())也可以直接用 Excel 的数据透视表对内容列做词频统计看看不同年份的发文特点。你可能想知道Q跑完大概要多久取决于消息量。每次请求之后固定等待 5 秒加上分批翻页和估算总量的二分过程几千条内容通常要 1 到 2 小时建议挂后台跑进度条会实时显示。Q中途断网或按了 CtrlC之前抓的白跑吗不会。程序注册了中断信号处理收到停止指令时会立刻把已抓取的数据写入 Excel然后退出之后重新运行即可从头拉取不需要手动处理断点文件。Q能拿到哪些数据哪些拿不到能拿到 QQ 空间消息列表里可见的互动消息加上你发布的全部未删除可见说说含 2014 年之前的。仅自己可见的说说和已经删除的内容无法抓取接口本身就不返回。Q我的账号数据安全吗所有文件只写在本机不经过第三方服务器。登录凭证缓存在resource/user/下存的是会话 cookie 而非密码不想留痕直接删掉缓存文件即可。Q需要会写代码才能用吗不需要。全程只有复制命令、扫码、等待三件事不用改任何代码。唯一的额外要求Linux 下需要系统装有 zbar 库sudo dnf install -y zbar或对应发行版命令macOS 可用 Homebrew 安装缺了程序会在启动时明确提示。先跑一次完整备份确认 Excel 和网页版 HTML 都生成后再退出程序把resource/result/目录整体存入网盘做异地留存之后按每周提醒重跑一次即可保持更新。运行中遇到抓不全、图片下载失败或依赖缺失等问题可以到项目仓库的 issue 区反馈维护者会跟进。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表