Task05:详读西瓜书+南瓜书第6章(4天)

微积分与线性代数在大模型中的作用与地位 这篇文阐述了从微积分到线性代数的关键跨越,以及线性代数在理解大模型(如Transformer)中的核心作用。作者指出,微积分擅长描述单变量连续变化,而真实世界和大模型涉及多变量、高维空间的复杂交互,这正是线性代数的领域。文重点解析了向量(代表状态)和矩阵(代表变换)在大模型中的核心应用:向量表征语义、特征和参数;矩阵实现空间变换、注意力匹配和参数优化。作者独创性地将微积分(梯度、海塞矩阵)与线性代数结合,揭示了大模型训练的数学本质——高维向量在矩阵规则下的迭代收敛。最后预告了后续学习路径,强调掌握线性代 阅读详情

Task05:详读西瓜书+南瓜书第6章(4天)

打卡截止时间:3月2日03:00 

学习建议:先预习,再看直播回放

 

支持向量机(3天)

预习:西瓜书6.1、6.2

直播回放:https://www.bilibili.com/video/BV1Mh411e7VU?p=8

 

软间隔与支持向量回归(1天)

预习:6.4、6.5

直播回放:https://www.bilibili.com/video/BV1Mh411e7VU?p=9

 

 

cee0237e2cd349089cdc07624c5e3ebb.png

 

Hermes深入理解及源码解析():Hermes的记忆机制 源码位置:tools/memory_tool.py存储内容为两个文件,放在 ~/.hermes/memories/:MEMORY.md:Agent 自己的笔记(环境事实、项目约定、工具坑、学到的东西)—— 上限 2200 字符USER.md:关于用户的画像(角色、偏好、沟通风格)—— 上限 1375 字符作为一个独立的工具注册在系统中(为了让智能体正确使用它,System Prompt()中明确下达了禁令存储目标存储位置数据类型持久偏好/事实MEMORY.md我是谁、我喜欢什么、环境配置。 阅读详情

相关推荐

14、OpenClaw(龙虾助手)Skill 开发完整规范(2026最新版)

OpenClaw Skill 开发指南摘要: Skill 是 OpenClaw AI 助手的核心扩展机制,支持声明式(SKILL.md)和原生代码(JS/TS/Python)两种开发模式。声明式 Skill 通过 Markdown 定义触发条件和执行流程,适合简单业务;原生代码 Skill 提供完整编程能力,适合复杂场景。开发需遵循标准化项目结构,包含 SKILL.md(元数据)、manifest.json(权限声明)等文件,并严格处理错误和多系统适配。新版要求原生 Skill 必须声明文件、网络等权限,确

欢迎光临~知1而N的博客 1127

Task05详读西瓜+南瓜6 支持向量机

目录支持向量机模型策略算法软间隔与正则化软间隔优化目标(策略)支持向量回归(SVR)策略邱恩杰 支持向量机 二分类学习最基本的想法就是基于训练集D在样本空间中找到一个划分超平面。 支持向量机 从集合几何角度来看,对于线性可分数据集,支持向量机就是找距离正负样本都最远的那个超平面。 相比于感知机:其解唯一,且泛化性能更好 模型 策略 我们希望找到具有“最大间隔”的划分超平面。 最后得到优化问题 算法 想要求解上述式子,得到最优解,以确定这个划分超平面所对应的模型 求解: 对于式子6.6的求解,这个优化问

weixin_45592399的博客 877

基于LightGBM模型的量化投资策略实现与回测分析

机器学习量化投资示例程序包.zip是一套教学性质的代码集合,旨在协助初学者迅速掌握运用机器学习技术进行证券投资分析的基本流程。本资源主要面向具备Python编程入门知识,但对证券市场交易及量化投资尚无接触的用户群体。操作流程说明如下:首先,执行以下指令安装运行所需的Python扩展库:pip install -r requirements.txt通过数据采集模块获取证券历史行情信息。各只证券的行情资料将存储于file/data文件夹内,证券品种清单记录在file/stock_list.txt文档中。作为示例,当前仅包含十只证券标的,实际应用时建议扩充更多品种以提升模型可靠性。python data.py基于基础行情数据构建机器学习模型所需的衍生特征指标。最终生成的特征数据以pickle二进制格式保存于file/feature目录。python feature.py使用lightGBM框架进行机器学习模型训练。生成的模型文件保存为file/model.lgb.txt。python model.py执行历史数据回测验证模型效能。程序将输出每日建议持仓证券及其对应收益,记录于file/record.csv文件,同时计算以下三项核心量化指标:累计投资收益率、最大资产回撤幅度及夏普比率。回测结果将生成可视化图表便于分析。python backtest.py注意事项:本示例程序侧重于演示机器学习在量化投资领域的应用流程,实际部署时需考虑交易成本、市场流动性等现实因素。建议使用者在充分理解代码逻辑与市场风险的前提下进行实践应用。资源来源于网络分享,仅用于学习交流使用,请勿用于商业,如有侵权请联系我删除!

Task05详读西瓜+南瓜6

前言 学习说明:预习,再看直播回放 支持向量机(3) 预习:西瓜6.1、6.2 直播回放:https://www.bilibili.com/video/BV1Mh411e7VU?p=8 1 算法原理 支持向量机和感知机都是找一个划分的超平面 感知机:找一个超平面分开 支持向量机:不近找一个超平面分开,而且是最优,其中解是唯一的 2 超平面 一条线,超平面就是一个点 一个面,超平面就是一条线 三维空间,超平面就是一个面 我太菜了! 上面是up主对公式的...

微信公众号(年更选手):数据闲逛人 | Github开源项目:数分/数挖study路线 https://github.com/jc-dian/python_data_analysis 305

task05: 详读西瓜+南瓜】第4——决策树【机器学习

本次笔记来源于学习的记录概要,纯私人记录,部分图片来源于其他帖子。

2301_79855500的博客 414

datawhale-吃瓜教程(西瓜+南瓜)-决策树

机器学习西瓜+南瓜决策树节学习

ego_grow的博客 824

机器学习-吃瓜教程(西瓜+南瓜)-神经网络

机器学习神经网络(感知机)学习笔记

ego_grow的博客 1273

datawhale-吃瓜教程(西瓜+南瓜)-支持向量机

支持向量机的基本公式及概念笔记

ego_grow的博客 623

机器学习入门实战:从模型评估到偏差方差,打通西瓜南瓜学习路径

机器学习作为人工智能的核心领域,其本质是基于数据自动改善任务性能的过程。其核心原理在于通过算法从数据中学习规律,并构建模型进行预测或决策。这项技术的价值在于能够处理复杂模式识别和预测问题,广泛应用于金融风控、医疗诊断、推荐系统等场景。在模型开发中,过拟合与欠拟合是常见挑战,需要通过交叉验证等方法来评估模型的泛化能力。性能度量指标如准确率、查准率、查全率和F1分数,帮助量化模型效果。理解偏差-方差分解则能有效诊断模型问题,指导调优方向。本文聚焦于机器学习入门中的模型评估与选择,结合西瓜南瓜的学习路径,为

ciya3282的博客 453

Datawhale 西瓜+南瓜 Task 05

本次学习是基于datawhale七月学习,教材是西瓜南瓜,根据datawhale的学习流程进行的开源学习。 间隔与支持向量: 在样本空间中,划分超平面可通过如下线性方程来描述: 其中 w = (w1;w2,... wd) 为法向量,决定了超平面的方向; b为位移项,决定了超平面与原点之间的距离. 对偶问题: 核函数: 几种常用核函数: 软间隔与正则化: 支持向量回归: ...

weixin_46350854的博客 189

五月份组队学习【吃瓜教程】Task04-05打卡笔记

本次吃瓜教程是Datawhale组织的组队学习 。 学习资料由开源学习组织Datawhale提供。 笔记部分内容来源于网络检索,如有侵权联系可删 本次学习针对的对象: 有高数、线代、概率论与数理统计基础的同学 内容说明:周志华老师的“西瓜”是机器学习经典入门教材,值得反复阅读,配合“南瓜”从本科数学基础的视角进行讲解,一起打好基础! 学习周期:18 Task03任务:详读西瓜+南瓜第5 视频教程链接: https://www.bilibili.com/video/BV1Mh411e7VU .

weixin_57171836的博客 195

人工智能、机器学习和深度学习到底是什么关系?

人工智能(AI)、机器学习(ML)和深度学习(DL)是三个层级嵌套的概念:DL⊂ML⊂AI。AI是最广泛的研究领域,关注机器完成智能任务的能力;ML是实现AI的一类方法,通过数据训练模型;DL则是ML的一个分支,使用多层神经网络自动学习特征表示。 具体区别体现在: AI包含规则系统和数据驱动方法,ML专注于从数据中学习规律 传统ML依赖人工特征工程,DL能自动提取多层次特征 DL在图像/语音/文本等非结构化数据上表现突出,但需要更多数据和算力 项目选择应基于任务特性:规则明确用编程,结构化小数据用传统ML(

Michael_Jay的博客 363

机器学习复习Day2——逻辑回归

**为什么不用 MSE**:①MSE 在逻辑回归上是**非凸**的(丘陵多坑,梯度下降会卡局部最优),交叉熵是**凸**的(大碗单底,保证全局最优);②**log 放大惩罚**,错得越离谱罚得越狠、改正越用力。- **损失用交叉熵**:y=1 时 **-log(ŷ)**,y=0 时 **-log(1-ŷ)**,合起来 = **-[y·log(ŷ) + (1-y)·log(1-ŷ)]**。- 逻辑回归是做**分类**的(虽然名字带"回归",是历史命名问题),输出是 [0,1] 的概率,不是连续值。

2503_94114317的博客 696

AI机器学习资源包:学习曲线与核心知识点

AI机器学习的学习曲线看似陡峭,但只要掌握核心概念,入门其实没那么难。今分享一份学习包,涵盖从基础到进阶的核心知识点。AI的核心目标是让机器表现出智能行为。从最初的图灵测试到现代的深度学习,AI经历了三次重大浪潮。第二次浪潮引入机器学习,让机器从数据中学习;第三次浪潮则通过深度学习实现了真正的突破,让机器能够自动提取特征并完成复杂任务。机器学习是AI的核心,主要分为三种范式: 1. 监督学习:需要标注数据,擅长分类和回归任务,如图像识别和房价预测。2. 无监督学习:无需标注,擅长发现数据中的隐藏模式。

2401_84458295的博客 219

武汉理工大学&华中科技大学联合 l 机器学习赋能金属增材制造

未来,随着标准化数据体系、物理信息学习、可解释人工智能、数字孪生、边缘计算和闭环控制持续发展,ML有望推动MAM由依赖经验和离线检验的工艺,逐步转向更可预测、更可靠、更可解释且能够实时调节的智能制造过程。然而,金属增材制造本质上是一个多物理场耦合、快速熔化与凝固并存的非平衡制造过程,激光功率、扫描速度、送粉或送丝速度、层厚及成形环境等因素会通过局部热历史影响凝固组织、相变行为、残余应力和最终性能,形成高度非线性的“工艺—组织—性能”(process–structure–property, PSP)关系;

3D科学谷 250

MLPACK 超完整实战|C++高性能机器学习、聚类分类、回归预测全能库

MLPACK是一款专注于高性能和轻量化的C++机器学习库,由佐治亚理工学院维护。其核心优势包括原生C++实现带来的极致推理速度、极低资源占用、全平台适配以及工业级算法完备性,特别适合嵌入式设备、边缘计算和高性能服务端场景。相比于Python框架,MLPACK无需解释器开销,仅依赖轻量级线性代数库,支持离线训练和本地推理。 本文详细介绍了MLPACK的编译配置方法、基础矩阵操作,并提供了KNN分类、K-Means聚类、线性回归和PCA降维等核心算法的实战代码。同时包含5个可直接商用的生产级Demo,涵盖工业设

踏板鞋的专栏 274

分位数预测提升销量不确定性量化

通过概率预测与分位数输出,可以将销量预测系统从单一的点估计升级为能够量化不确定性的决策支持工具。核心在于将预测输出从一个数值扩展为一个概率分布,并通过分位数(如P10、P50、P90)来表征该分布,从而为库存、定价、促销等决策提供风险边界。

wanghaiwen69的博客 221

基于 Python、计算机视觉 / 机器学习检测 与 PyQt5 构建的桌面端可视化系统——蘑菇种类识别与分类可视化大屏

基于与构建的桌面端可视化系统。支持图片与视频上传、多目标蘑菇检测与分割、识别前后对比、鼠标框选区域识别、操作日志、ECharts 图表统计、数据分析、界面主题定制、参数配置,以及按日期归档与 SQLite 持久化存储。界面采用、工业灰主题,全局紧凑排版,适配常见桌面分辨率。

weixin_66547608的博客 173

机器学习赋能复合材料细观力学:破解多尺度仿真困局|哈工大Composites Part A综述

引言复合材料凭借高比刚度、高比强度与优异的结构可设计性,广泛应用于航空航等高端制造领域。但其非均质结构、复杂界面行为与多物理场耦合损伤机制,让传统细观力学建模长期陷入精度与效率的双重困境。传统解析方法理想化假设过多、精度不足,有限元数值仿真精度高但计算成本高昂,难以满足快速材料迭代与工程优化需求。为突破这一瓶颈,机器学习凭借强大的非线性拟合与数据挖掘能力,成为复合材料细观力学研究的全新技术手段。

y2715163545的博客 325

机器学习】(43)—— AutoML 上手流程

AutoML 不能代替数据准备。导入前至少完成下面三类工作。任务说明标签完整每一行训练样本都有标签;缺失标签行应剔除或单独处理清洗与格式去明显错误值、统一单位;日期格式一致自定义变换工具不支持的衍生字段可预先算好再导入若对预测房价一类任务有帮助,而工具没有内置「字符串长度」变换,可以预先加列desc_len再导入。油耗表里,若只有「升/百公里」与「英里/加仑」混用,必须先统一单位,否则搜索只是在噪声上浪费预算。无代码工具的上手路径是:导入 → 分析摘要 → 语义修正 → 配置 → 启动。

qq_36245787的博客 481

人工智能机器学习系统班,人工智能深度学习系统班

异常值检测方面,3σ原则与四分位距法是常用工具,但业务层面的异常判定往往更为复杂,交易金额的合理范围、传感器读数的物理极限都需要领域知识的介入。类别特征的编码方式直接影响模型对特征的解释能力,高基数的类别特征在独热编码下将导致维度爆炸,目标编码与计数编码提供了有效的替代方案。嵌入式方法则将特征选择融入模型训练过程,L1正则化驱动的稀疏性使部分特征的权重收缩为零,实现了特征选择与模型训练的同步完成。从原始数据到可部署的模型,中间跨越了特征工程、模型训练与调优三大核心阶段,每一阶段都有其关键方法论与避坑指南。

2603_96681057的博客 339
上一篇: Task04:详读西瓜书+南瓜书第5章(3天)
下一篇: 西瓜书/南瓜书第七章 贝叶斯分类器 笔记
leiuser
博客等级 码龄3年 3粉丝 15原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值