批量下载与脚本采集的官方态度
想写个脚本把全站图搬回来?官方态度很明确:别。FAQ 里专门有条「Am I allowed to run scrapper/mass download scripts?」,回答是请求大家不要做。
为什么管得这么严
官方的理由说得直白:这个站不跑广告,没有收入去养能扛住海量请求的大服务器——官方自述「不是什么大公司,只是几个想提供个好壁纸站的人」。批量抓取的流量成本,最终砸的是所有普通用户的加载速度。
合法的程序化通道:接口 + 限流
想自动化,用公开接口,遵守每分钟 45 次的限流:
- 搜索、单图、标签、收藏夹都是标准 GET,返回 JSON。
- 工具做节流与退避,401 与 429 的处理见 每分钟 45 次的限流与两类报错。
- 接口给的是「按需取用」的正当姿势:壁纸轮换、收藏备份这类用途完全够用。
接口与爬虫的分界:接口是有邀请的访问(官方文档明示欢迎);绕过接口直接批量抓网页、多线程轰图床,是无邀请的透支。
给折腾党的替代方案
- 想要「整批下载」:先在收藏夹里筛一遍,再对收藏列表走接口逐张取原图地址,间隔 2 秒下一张——一晚上拿几百张毫无压力,且全程在限流内。
- 想要「离线全库」:没有这个需求,也请没有这个行为——真需要海量壁纸素材做训练数据,这里的版权条款也不支持。
接下来去哪
- 接口能力总览:看 公开接口能帮你做成什么事。
- 版权边界:看 作品被传上去了,权利人怎么申请处理。