摘要:在数据采集的深水区,阻碍你的往往不是网络请求本身,而是那一串串看似乱码的密文、Base64字符串或自定义编码。很多工程师习惯“一把梭”复制JS逆向代码,却因不懂底层原理而在参数变更时束手无策。本文剥离复杂的数学证明,从爬虫实战视角重构密码学知识体系:厘清编码与加密的本质区别,拆解对称/非对称加密在Web协议中的应用模式,掌握哈希签名与TLS指纹的对抗逻辑。所有理论均绑定真实采集场景,助你从“脚本搬运工”进化为“协议分析师”。
一、认知纠偏:编码≠加密,混淆≠安全
在动手破解前,必须先建立正确的概念模型。90%的“解密失败”源于把编码当加密、把混淆当算法。
1.1 核心概念对照表
| 类别 | 目的 | 可逆性 | 典型代表 | 爬虫场景 |
|---|---|---|---|---|
| 编码 (Encoding) | 数据格式转换,确保传输兼容 | ✅ 完全可逆 | Base64, URL Encode, Hex, Unicode |

订阅专栏 解锁全文

331

被折叠的 条评论
为什么被折叠?



