本项目是一个基于 Python 的自动化脚本,旨在从“起点读书” App 的主题配置文件中批量提取、重命名并分类存储高画质的阅读背景图片。
通过对起点 App 阅读背景设置页面的网络封包分析,我们获取了主题配置的 JSON 数据。本项目通过解析这些数据,自动完成从腾讯云对象存储(COS)下载、内存流式解压、以及文件格式校验的完整流程,将静态底图(readBg)提取出来。
- 分类处理:根据背景属性(免费、会员专属、活动限定)自动分文件夹存储。
- 内存提取:采用
zipfile内存流读取技术,无需在本地解压乱码的临时文件,完美解决 Windows 路径乱码导致的报错问题。 - 自动去重:通过 MD5 校验机制,记录已处理的图片,支持断点续传,避免重复下载。
- 格式自适应:自动识别并保留原始文件后缀(
.jpg,.png等),确保画质不损。 - 非法字符过滤:自动清理文件名中的特殊字符,确保在 Windows/Linux 系统下均能正常保存。
-
Python 3.8+
-
依赖库安装:
Bash
pip install requests
-
获取数据:将抓包得到的
101.json,102.json,103.json放入项目根目录下的JSON文件夹内。 -
运行脚本:
Bash
python extract_bg.py -
查看结果:提取后的图片将保存在
img目录下对应的分类文件夹中。
Plaintext
qidian_bg/
├── JSON/ # 抓包获取的原始数据
│ ├── 101.json # 免费背景
│ ├── 102.json # 会员卡专属
│ └── 103.json # 活动限定
├── img/ # 脚本自动生成的分类图片目录
├── extract_bg.py # 核心处理脚本
├── processed_md5.txt # 已处理记录(脚本运行后生成)
└── README.md
- 仅限学习交流:本项目仅供计算机技术研究、爬虫逻辑学习及网络协议分析参考使用,严禁用于任何商业用途。
- 版权声明:项目中涉及的所有背景图片、动画素材(PAG文件)及相关文学作品 IP 的版权均归 上海阅文信息技术有限公司(起点读书) 或其原始创作者所有。
- 法律责任:使用者因违反相关法律法规或服务协议而导致的任何争议、侵权及损失,由使用者自行承担,本项目作者不承担任何法律责任。
- 及时删除:请在下载后的 24 小时内删除所有提取的资源。如果你喜欢相关作品,请通过正规渠道订阅起点读书会员支持原版。