一、前言:为何抓取 P2P 平台运营数据?
P2P(Peer-to-Peer)网络借贷平台曾在中国金融科技发展史中占据重要位置。无数投资人依赖平台公示的运营数据进行风险判断和投资决策。尽管近年政策趋严,但诸如网贷之家、网贷天眼等网站仍保留了大量平台运营历史数据,如:
- 平台累计成交量
- 借贷余额
- 出借人数
- 借款人数
- 利率、期限等指标
本文以“网贷之家(wdzj.com) ”为例,实战讲解如何使用现代 Python 爬虫技术,构建一个异步、高效、可靠的爬虫系统,批量采集主流 P2P 平台的运营数据。
二、目标网站分析
2.1 网站结构与数据来源
官网示例页面:
- 平台列表页:https://shuju.wdzj.com/platform.html
- 运营数据页:动态生成,XHR 请求返回 JSON 格式数据
打开开发者工具后可发现:
-
平台数据通过 API 接口加载,URL 如下:
pgsql 复制编辑 https://shuju.wdzj.com
订阅专栏 解锁全文

被折叠的 条评论
为什么被折叠?



