ARTICLE DETAIL

资讯详情

深耕网站建设与运营推广的一线实战洞察。

5分钟跑通GetQzonehistory:完整导出QQ空间历史说说,Excel与网页一次到位

5分钟跑通GetQzonehistory:完整导出QQ空间历史说说,Excel与网页一次到位 5分钟跑通GetQzonehistory完整导出QQ空间历史说说Excel与网页一次到位【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory你翻到空间互动消息的第18页还是没找到大三那年发的那条说说。不是没发过——QQ空间的消息页只对产生过互动的内容做分页早期动态分散在互动消息列表和可见说说列表两个入口里手动翻页根本翻不完。GetQzonehistory 通过QQ扫码登录把这两个数据源合并去重按类型拆成多张Excel表格再附上一份还原版网页时间线全部写到本地。整个过程在你自己电脑上运行数据不经过任何第三方服务器。GetQzonehistory是什么本地脚本批量备份QQ空间历史说说它是一个Python脚本项目模拟扫码登录你的空间先抓互动消息列表再补抓可见且未删除的说说合并去重后导出6张Excel表加1个HTML时间线。不上传cookie不收集密码代码全部可见可改。备份方式实际痛点GetQzonehistory的做法手动翻页截图只能存下当前页图文分离、无法检索每批10条自动翻页时间/内容/图片链接/评论逐字段入表第三方在线工具登录凭证要交给对方服务器全程本地运行cookie只落在自己电脑只截图保存图片没文件名规律几年后对不上号图片按内容命名存入pic/子目录与表格行一一对应四步跑起来装环境、拉代码、装依赖、扫码运行1. 装环境确认本机Python在3.9以上依赖里pandas 2.2的最低要求python --version看一眼即可3.12更稳。2. 拉代码git clone https://gitcode.com/GitHub_Trending/ge/GetQzonehistory cd GetQzonehistory这一步把源码下载到本地并进入项目根目录后续所有命令都在这里执行。3. 装依赖python -m venv myenv .\myenv\Scripts\activate # WindowsmacOS/Linux改用source myenv/bin/activate pip install -r requirements.txt建一个隔离的虚拟环境再安装requirements.txt里的11个依赖pandas、requests、beautifulsoup4、qrcode等避免污染系统Python。4. 运行python main.py终端会打印一张ASCII二维码用手机QQ扫一下然后等进度条走完。抓多少条取决于你的历史消息量期间无需任何操作。导出目录速查GetQzonehistory生成了哪些文件程序结束后会自动打开结果目录Windows走资源管理器Linux走xdg-open所有产物都在resource/result/你的QQ号/下resource/result/你的QQ号/ ├── 你的QQ号_全部列表.xlsx # 全部消息时间/内容/图片链接/评论 ├── 你的QQ号_说说列表.xlsx # 你发布的说说 ├── 你的QQ号_转发列表.xlsx # 你转发的内容 ├── 你的QQ号_留言列表.xlsx # 好友留给你的留言 ├── 你的QQ号_其他列表.xlsx # 其他好友的动态 ├── 你的QQ号_好友列表.xlsx # 昵称/QQ号/空间主页 ├── 你的QQ号_说说网页版.html # 带头像和评论的还原时间线 └── pic/ # 说说图片按内容命名下图是同一结构的可视化版本导出完成后可对照检查是否缺文件5张分类表加1个网页版加图片目录缺任何一项都说明对应数据为空或抓取中途断了。各表字段口径一致以说说列表为例时间内容图片链接评论2016年09月01日 20:15:00你的昵称 开学第一天图片直链已同步存入pic/[[评论时间,内容,昵称,QQ号]]2014年03月12日 14:30:00你的昵称 入校发的第一条说说空空内容列固定是昵称 正文格式评论列是结构化列表后续做统计时可直接解析。内部机制双数据源如何合并成一份记录输入util/LoginUtil.py在终端生成登录二维码手机扫码后拿到cookie程序随后查询互动消息的总条数。分批抓取main.py每批请求10条消息、批间停3秒用BeautifulSoup解析出时间、内容、图片链接、好友昵称与QQ号。补抓可见说说util/GetAllMomentsUtil.py翻页请求可见且未删除的说说每页30条这部分覆盖2014年以前的早期内容。合并去重消息列表里已出现的说说不再重复加入只把缺失的部分补进来。输出pandas按类型写成6张Excel图片逐张下载到pic/最后渲染说说网页版.html。下图把上面五步压缩成一张流程图色块依次对应扫码登录、消息列表、可见说说、好友列表、导出文件想深入读源码的话从main.py底部的__main__段读起最直接登录与签名计算细节都在util/LoginUtil.py里。进阶用法三个基础运行之外的玩法只留Markdown单独运行fetch_all_message.py专抓可见且未删除的说说并下载高清图在resource/fetch-all/下生成所有可见说说.md一页30条。二次分析pd.read_excel直接读入全部列表.xlsx按时间列的年份分组统计发帖量评论列先eval再展开就能统计互动最多的人。改网页版样式时间线HTML由util/ToolsUtil.py里的模板函数渲染改模板即可换配色和排版适合再导出成PDF。避坑指南四个高频问题部分说说缺失设过仅自己可见且从未产生互动的内容不会进互动消息列表这是平台入口限制。解法程序已并入可见说说列表兜底大部分剩余缺口只能接受备份间隔别拉太长。二维码失效、登录失败登录二维码有时效过期或网络波动都会提示登录失败:请重新登录。解法重跑python main.py重新出码出码后马上扫。中途断了不敢重跑按CtrlC不会丢数据程序注册了信号处理退出前会把已抓内容写盘。解法直接重跑可见说说的JSON缓存在resource/fetch-all/目录会直接复用只补抓缺失部分。导出耗时超预期每批10条要停3秒上万条消息仅列表抓取就要几十分钟。解法挑网络空闲时段挂机或到release页下载已打包的单文件版本直接运行。行动清单三步完成第一次备份✅ 按上文命令克隆仓库并装好依赖pip install -r requirements.txt。✅ 运行python main.py手机QQ扫码等进度条走完按每批10条、间隔3秒估算万条消息约50分钟。✅ 打开resource/result/你的QQ号/核对Excel行数与pic/图片数量把整个目录拷一份到移动硬盘。网页里能翻到的只是平台的展示窗口这个目录才是完整底账。【免费下载链接】GetQzonehistory获取QQ空间发布的历史说说项目地址: https://gitcode.com/GitHub_Trending/ge/GetQzonehistory创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表