机器学习常用算法总结

本文概述了回归算法如最小二乘法、决策树,以及基于实例的KNN和正则化方法(如Ridge和LASSO)。深入探讨了深度学习,包括深度神经网络和卷积网络,展示了从基础到高级的不同技术。
  • 回归算法

回归算法是试图采用对误差的衡量来探索变量之间的关系的一类算法。回归算法是统计机器学习的利器。在机器学习领域,人们说起回归,有时候是指一类问题,有时候是指一类算法,这一点常常会使初学者有所困惑。

    • 最小二乘法(Ordinary Least Square)
    • 逻辑回归(Logistic Regression)
    • 逐步式回归(Stepwise Regression)
    • 多元自适应回归样条(Multivariate Adaptive Regression Splines)
    • 本地散点平滑估计(Locally Estimated Scatterplot Smoothing)
    • 线性回归(linear regression)
  • 基于实例的算法

基于实例的算法常常用来对决策问题建立模型,这样的模型常常先选取一批样本数据,然后根据某些近似性把新数据与样本数据进行比较。通过这种方式来寻找最佳的匹配。因此,基于实例的算法常常也被称为“赢家通吃”学习或者“基于记忆的学习”。

    • k-Nearest Neighbor(KNN)
    • 学习矢量量化(Learning Vector Quantization, LVQ)
    • 自组织映射算法(Self-Organizing Map , SOM)
  • 正则化算法

正则化方法是其他算法(通常是回归算法)的延伸,根据算法的复杂度对算法进行调整。正则化方法通常对简单模型予以奖励而对复杂算法予以惩罚。

    • Ridge Regression
    • Least Absolute Shrinkage and Selection Operator(LASSO)
    • 以及弹性网络(Elastic Net)
  • 决策树算法

决策树算法根据数据的属性采用树状结构建立决策模型, 决策树模型常常用来解决分类和回归问题。

    • 分类及回归树(Classification And Regression Tree, CART)
    •  ID3(Iterative Dichotomiser 3)
    • C4.5
    • Chi-squared Automatic Interaction Detection(CHAID)
    • Decision Stump
    • 随机森林(Random Forest)
    •  多元自适应回归样条(MARS)
    • 梯度推进机(Gradient Boosting Machine, GBM)
  • 贝叶斯方法

贝叶斯方法算法是基于贝叶斯定理的一类算法,主要用来解决分类和回归问题。

    • 朴素贝叶斯算法
    • 平均单依赖估计(Averaged One-Dependence Estimators, AODE)
    • Bayesian Belief Network(BBN)
  • 基于核的算法

基于核的算法中最著名的莫过于支持向量机(SVM)了。 基于核的算法把输入数据映射到一个高阶的向量空间, 在这些高阶向量空间里, 有些分类或者回归问题能够更容易的解决。

    • 支持向量机(Support Vector Machine, SVM)
    • 径向基函数(Radial Basis Function ,RBF)
    • 线性判别分析(Linear Discriminate Analysis ,LDA)
  • 聚类算法

聚类,就像回归一样,有时候人们描述的是一类问题,有时候描述的是一类算法。聚类算法通常按照中心点或者分层的方式对输入数据进行归并。所以的聚类算法都试图找到数据的内在结构,以便按照最大的共同点将数据进行归类。

    •  k-Means算法
    • 期望最大化算法(Expectation Maximization, EM)
  • 关联规则算法

关联规则学习通过寻找最能够解释数据变量之间关系的规则,来找出大量多元数据集中有用的关联规则。

    • Apriori算法
    • Eclat算法
  • 人工神经网络

人工神经网络算法模拟生物神经网络,是一类模式匹配算法。通常用于解决分类和回归问题。人工神经网络是机器学习的一个庞大的分支,有几百种不同的算法。其中深度学习就是其中的一类算法。

    • 感知器神经网络(Perceptron Neural Network)
    • 反向传递(Back Propagation)
    •  Hopfield网络
    • 自组织映射(Self-Organizing Map, SOM)
    • 学习矢量量化(Learning Vector Quantization, LVQ)
  • 深度学习

深度学习算法是对人工神经网络的发展。 在近期赢得了很多关注, 特别是百度也开始发力深度学习后, 更是在国内引起了很多关注。 在计算能力变得日益廉价的今天,深度学习试图建立大得多也复杂得多的神经网络。很多深度学习的算法是半监督式学习算法,用来处理存在少量未标识数据的大数据集。

    • 受限波尔兹曼机(Restricted Boltzmann Machine, RBN)
    • Deep Belief Networks(DBN)
    • 卷积网络(Convolutional Network)
    • 堆栈式自动编码器(Stacked Auto-encoders)
  • 降低纬度算法

像聚类算法一样,降低维度算法试图分析数据的内在结构,不过降低维度算法是以非监督学习的方式试图利用较少的信息来归纳或者解释数据。这类算法可以用于高维数据的可视化或者用来简化数据以便监督式学习使用。

    • 主成份分析(Principle Component Analysis, PCA)
    • 偏最小二乘回归(Partial Least Square Regression,PLS)
    • Sammon映射
    • 多维尺度(Multi-Dimensional Scaling, MDS)
    • 投影追踪(Projection Pursuit)
  • 集成算法

集成算法用一些相对较弱的学习模型独立地就同样的样本进行训练,然后把结果整合起来进行整体预测。集成算法的主要难点在于究竟集成哪些独立的较弱的学习模型以及如何把学习结果整合起来。这是一类非常强大的算法,同时也非常流行。

    • Boosting
    • 随机森林 Bootstrapped Aggregation(Bagging)
    • AdaBoost
    • 堆叠泛化(Stacked Generalization, Blending)
    • 梯度推进机(Gradient Boosting Machine, GBM)
    • 随机森林(Random Forest)
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

此时@此刻

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值