规则挖掘篇:为什么用决策树挖规则,而不是拍脑袋?

前面章节把样本和特征备齐了。这一章是整套课的核心——从数据里挖出能上线的策略规则

先回答一个问题:凭经验拍脑袋定规则不行吗?行,但有三个短板:不可解释(讲不清为什么)、漏非线性(人脑难发现变量交叉)、难比对(没法科学评估好坏)。决策树正好补这三块。

决策树的原理是递归分裂:从全量样本开始,每次选"最能把好坏分开"的特征和切点,把样本一分为二,再对每边继续分,直到满足停止条件(如最大深度、最小叶子数)。每次分裂都对应一条"如果…则…"的规则,天然可解释。

为什么它适合策略岗?

  • 可解释:每一条分裂都能讲给业务听,不像黑箱模型;
  • 自动:从数据里找非线性切割点,人不用猜;
  • 可比对:挖出来的树规则和专家规则做 Champion/Challenger(冠军挑战者)对比,谁好用谁。

提醒:树只在"被接受且有 Y"的样本上训,拒绝样本没 Y。直接拿来预测会有乐观偏差,务必配合前面讲的拒绝推断。下篇讲怎么把一棵树变成一张准入决策表。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值