机器学习day03

本文深入探讨了机器学习中的线性回归算法,包括理论和实例分析,接着介绍了回归性能评估的方法。此外,还讲解了分类算法中的逻辑回归以及聚类算法k-means的应用。

回归算法-线性回归分析

线性回归:
  目标值: 连续的
    寻找一种能预测的趋势
  二维:
    直线关系
  三维:
    特征, 目标值  平面
  线性关系定义:
    y = kx + b
    b: 偏置
      单个特征: 更加通用
      多个特征: 找到合适的k预测结果
    定义:
      特征与目标值之间进行建模的回归分析
  矩阵:
    大多数算法计算基础
    必须是二维
    满足了特定运算需求
    乘法:
      (m行, l列) * (l行, n列) = (m行, n列)
  迭代算法:
    回归
      预测时候有差距
      损失函数: (误差)
          算法      策略(损失函数)        优化    >>>迭代过程
        线性回归      误差平方和
                     最小二乘法

        逻辑回归

        目的:
          寻找最优化的w
          w的数量取决于特征的数量
        优化方法:
          正规方程
          梯度下降:
            沿着函数下降的方向找, 更新w值

线性回归实例

sklearn:
  优点:
    封装好, 建立模型简单, 预测简单
  缺点:
    算法的过程, 参数都在API内部优化
  神经网络

回归性能评估

  均方误差
梯度下降:
  需要选择学习率
  多次迭代
  n很大
  适用于各种模型
正规方程:
  不需要
  一次得出
  n < 10000 时可以
  线性模型, 不适合与逻辑回归等其他模型
    过拟合:
      训练数据上能获得很好的拟合, 此外的数据不能很好 (模型复杂)
        eg:
          LinerRegression
        根据结果现象判断: 过拟合, 欠拟合
          欠拟合
            训练集: 不好
            测试集: 不好
          过拟合:
            训练集: 好
            测试集: 不好
      解决办法:
        特征选择
        L2 正则化
    欠拟合:
      训练数据和此外的数据都不能获得很好的拟合     (模型过于简单)
      解决办法:
        增加数据的特征数量
线性:
  简单模型
非线性:
  复杂模型
    原因:
      数据的特征和目标值之间的关系不仅仅是线性关系
特征选择:
  过滤式:
    低方差特征
  嵌入式:
    决策树
    减少权重  >>> 0
    正则化:
      L2正则化:
    Ridge: (岭回归)
      alpha: 正则化力度  0~1 1~10
        网格搜索
        影响:
          力度越大, w >>> 0
      LinearRegression 与 Ridge 对比
        岭回归:
          回归系数更符合实际, 更可靠
    神经网络

分类算法-逻辑回归

逻辑回归:   (二分类)

  线性回归的式子作为逻辑回归的输入
  特点:
    得出概率值
  sigmoid函数:         (对数似然损失函数)
    特点:
      将输入的特征转换为 0~1 之间的值
  线性回归的输入 >>> 分类
损失函数:
  均方误差         (梯度下降求解)
    不存在多个局部最低点, 只有一个最小值
  对数似然损失      (梯度下降求解)
    多个局部最小值  (方法)  >>> 尽量改善
      1) 多次随机初始化, 多次比较最小值结果
      2) 调整学习率
正例:
  类别少的概率
反例:
  类别大的概率
优点:
  分类概率的场景, 简单, 速度快
缺点:
  不好处理多分类问题
    多分类:
softamx方法         无             先验概率: 总结历史数据概率信息
             逻辑回归(判别模型)          朴素贝叶斯(生成模型)
    解决问题       二分类                     多分类
    应用场景    癌症, 二分类                  文本分类
      参数       正则化力度                    没有
k-近邻, 决策树, 随机森林, 神经网络            隐马科夫模型

聚类算法-kmeans

非监督学习:
  k: 把数据划分成多少个类别
    知道类别的个数
      过程:
        假设 k=3
        1) 随机在数据当中抽取三个样本, 当做三个类别的中心点(k1, k2, k3)
        2) 计算其余的点分别到三个点的距离, 每一个样本有三个距离(a, b, c), 从中选择最近的点作为自己的标记形成三个族群
        3) 分别计算三个族群的平均值, 把三个平均值与之间的三个旧的中心点进行比较
            相同:
              结束聚类
            不同:
              三个平均值当做新的中心点, 重复第二步
    超参数
轮廓系数:   (每一个样本)
  原理:   [-1, 1]
    外部距离最大化
    内部距离最小化
特点分析:
  采用迭代算法
  缺点:
    容易收敛到局部最优解
  解决办法:
      多次聚类
内容概要:本文围绕“基于分布式模型预测控制的多个固定翼无人机一致性控制”展开,利用Matlab代码实现相关算法的仿真,旨在通过分布式控制策略实现多架固定翼无人机在复杂动态环境中的协同飞行与一致性控制。研究结合模型预测控制(MPC)方法,构建适用于多无人机系统的分布式优化框架,重点解决了通信受限、信息延迟及无中心化指挥条件下的协同稳定性问题。内容涵盖固定翼无人机的动力学建模、分布式MPC优化求解机制、一致性协议设计、通信拓扑结构分析以及仿真验证全过程,确保多机系统在保持队形一致的同时完成协同任务。; 适合人群:具备自动控制理论、无人机系统建模或多智能体协同控制基础,从事智能无人系统、集群控制、自动化与机器人等领域研究的研究生、科研人员及工程技术人员。; 使用场景及目标:①应用于多无人机协同编队飞行、集群侦察、分布式任务执行等实际工程场景;②为分布式MPC算法在多智能体系统中的一致性控制提供可复现的Matlab仿真案例,推动先进控制理论向工程实践转化;③服务于科研论文复现、算法验证、控制系统课程设计与毕业课题参考。; 阅读建议:建议读者结合文中提供的Matlab代码逐模块运行与调试,重点关注分布式MPC在不同通信拓扑下对一致性收敛性能的影响,并可通过调整预测时域、权重矩阵与噪声参数等方式深化对算法鲁棒性与适应性的理解。
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值