UC伯克利的双足机器人,400米直接跑进了2分34秒,站立、跑步、跳高、跳远动作都丝滑

Cassie由HYBRIDROBOTICS团队研发,利用深度强化学习实现了快速跑步和无训练跳远,展示了通用控制框架在双足机器人运动技能上的潜力。同时,UC伯克利的研究也展示了人形机器人通过预测动作训练的进展,让机器人能适应真实世界任务。

UC伯克利的双足机器人,跑步又破纪录了!
最近,HYBRID ROBOTICS研究团队的Cassie,给我们来了一段惊艳的表演——
以2分34秒的成绩,跑完了400米!
随后,它又在不需要额外训练的情况下,完成了1.4米的跳远。
是的,相信你已经注意到了,它的外形十分独特——只有下半身!
没错,跑步什么的,要上半身干啥。
400米冲刺脚下生风

没有上半身意味着什么?当然是——速度就是一切!
一声令下,Cassie就开始跑400米了。
只见它两脚生风,脚步敏捷。
就是,不知道脚下这双跑鞋有没有速度加成?
在这里插入图片描述

可以看到,Cassie的跑步姿势十分标准,没有任何累赘的动作。
而研究人员则全程跟在后面陪跑。

现在,Cassie在做最后的冲刺,它集中精力一鼓作气,一跃而冲过了终点线。

它最后的成绩是——2分34秒!
这个成绩,或许已经超越了不少人类。
算起来,Cassie的步速是每分155.6米。
在21年,Cassie在中途不充电的条件下,完成了5公里的户外长跑,用时53分钟,这个步速是每分94.3米。
这个进步是肉眼可见的。
Cassie是利用神经网络强化学习进行训练的,因此,它可以从头掌握简单的技能,比如原地跳跃、向前走或跑而不摔倒。
它被鼓励模仿人体动捕的数据,和动作的演示动画。
最后,团队还测试了Cassie的跳远能力,注意,这是在它没有经过额外训练的情况下。
它的成绩是1.4米。
RL通用框架,跑步、跳高、跳远多才多艺

Cassie怎么这么强?
我们在这篇发表于1月底的论文中,找到了答案。

论文地址:https://arxiv.org/pdf/2401.16889.pdf
利用深度强化学习(RL),研究者为双足机器人创建了动态运动控制器。
他们开发出了一种通用控制解决方案,可用于一系列动态双足技能,比如周期性行走,跑步,以及非周期性的跳跃和站立。

这个通用控制框架,可以实现各种周期性和非周期性的双足运动技能
基于强化学习的控制器,他们采用了新颖的双历史架构,利用了机器人的长期和短期输入/输出(I/O)历史。
当通过端到端强化学习方法进行训练时,这种控制架构在模拟和现实世界中的各种技能上,都始终优于其他方法。
另外,RL系统还引入了适应性和鲁棒性。
可以证明,通过有效利用机器人的I/O历史记录,架构就可以适应各种变化,如接触事件。
在这里插入图片描述

鲁棒性的另一个关键来源,就是任务随机化。
因此,我们就看到了Cassie的各种运动技能。比如稳稳地站立,多才多艺地步行,快速跑步,以及各种跳高和跳远。

这个研究所基于RL的控制器架构如下图,它利用了机器人的输入和输出(I/O)的双重历史记录。
在这里插入图片描述

利用这个多阶段的训练框架,就可以获得零样本转移到现实世界的通用控制策略。
在这里插入图片描述

如下是基于RL的双足机器人运动控制策略架构各种基线的图示。
在这里插入图片描述

利用研究者开发的多功能跑步策略,Cassie成功完成了400米冲刺。
这个过程是使用单一跑步策略完成的。
它使得机器人能够从站立姿势转变为平均2.15m/s和峰值3.54m/s的快速跑步步态。
在这里插入图片描述

使用微调的跑步策略,Cssie还以快速的跑步步态完成了100米短跑。

用训GPT的方法,训出人形机器人

机器人接管旧金山?
在今年1月,UC伯克利的人形机器人显眼包「小绿」,就曾经大规模引起了人们的注意。
那时它长这样——

看着挺好,就是没脖子。
只见它在围观人群的惊叹声中,大摇大摆地走出UC伯克利校门。

在操场草坪上,跟大爷一样练习倒步走。

身影遍布UC伯克利校园的各个角落。

甚至引起网友惊呼:机器人接管旧金山了?
在这里插入图片描述

预测下一个动作,控制人形机器人行走
不久后,就在2月底,UC伯克利就发表了一篇重磅论文,介绍「小绿」是怎么训练出的。

论文地址:https://arxiv.org/pdf/2402.19469.pdf
在这篇论文中,他们介绍了训练人形机器人的方法——跟训练GPT的方法是一样的。
用这种训练GPT的方法,研究者成功地训练出了人形机器人的类人运动。
重点就是:通过预测下一个动作,来控制人形机器人的行走。
在这里插入图片描述

人体运动作为下一个token预测
在一系列模拟轨迹上,他们对模型进行了训练。
而这些轨迹,来自之前的神经网络策略。
在这里插入图片描述

使用不同数据源进行训练的通用框架
人形机器人所学习的,就是基于模型的控制器、动捕数据和YouTube上的人类视频。
在这里插入图片描述

训练数据集的4个来源
结果,这个模型能让全尺寸的人形机器人在完全未经训练的情况下,直接完成行走!
仅仅用了27个小时的训练,模型就能在现实世界中泛化了。
而训练过程中从未见过的指令,机器人也能应对。
从此,机器人可以学习真实世界的控制任务了。

内容概要:本文档是一份针对全国大学生电子设计竞赛(NUEDC)的“保姆级”实战指导手册,系统涵盖赛题解析与方案库、模块化代码与电路实现、以及测试报告范例三大核心部。手册深入剖析了电赛七大赛题类别及其命题规律,强调“基本要求+发挥部”的结构特点、指标逐年收紧趋势及测量与控制复合型题目的增加。通过数控直流电流源和频率特性测试仪两个典型案例,展示了从系统方案设计、关键器件选型到软硬件实现的完整路径。同时,提供了基于STM32 HAL库的ADC采样、PWM生成、OLED显示、无线通信等常用模块的详细电路原理与驱动代码,并辅以测试报告范例和评标准解析,帮助参赛者规范撰写高质量设计报告。; 适合人群:参加全国大学生电子设计竞赛的本科生及指导教师,尤其适合有一定单片机和电路基础、希望在短时间内高效备赛并提升获奖概率的团队。; 使用场景及目标:①帮助参赛者快速掌握电赛命题规律与主流技术方案,精准应对电源类、控制类、仪器仪表类等高频赛题;②提供可复用的模块化代码与电路设计,加速硬件搭建与软件开发进程;③指导撰写符合评审标准的设计报告,强化误差析与测试数据呈现,提升综合得。; 阅读建议:建议按照“赛题析→方案设计→模块实现→报告撰写”的流程顺序阅读,重点学习典型案例的整体设计思路与关键器件选型依据。对于代码与电路部,应在实际开发板上动手验证,结合示波器、逻辑析仪等工具进行调试。撰写报告时,务必参考文中测试表格与误差析模板,确保数据完整、析定量,避免因报告不规范而失。;
内容概要:本文系统介绍了基于投资组合CVaR(条件风险价值)对象的金融投资组合优化方法,重点阐述了利用Matlab代码实现CVaR风险度量下的资产配置优化过程。相较于传统VaR仅衡量特定置信水平下的最大损失,CVaR进一步评估超出该阈值的平均尾部损失,具有更好的数学性质如凸性和次可加性,更适用于构建可优化的数学模型。文中详细讲解了CVaR优化模型的理论基础、目标函数设计、约束条件设置以及Matlab金融工具箱中PortfolioCVaR类的具体应用步骤,并结合实证案例演示了如何加载资产数据、设定预期收益率与风险偏好、执行优化求解及析有效前沿,帮助投资者在控制极端下行风险的前提下实现最优资产配置。; 适合人群:具备一定金融工程、数量经济学或风险管理背景,熟悉Matlab编程环境,正在从事量化投资、资产配置建模、金融产品设计等相关工作的研究人员、高校师生及金融机构从业人员。; 使用场景及目标:①用于金融机构构建高阶风险管理导向的投资组合,提升对尾部风险的防控能力;②支持学术研究中对不同风险度量模型(如VaR与CVaR)在组合优化中表现差异的实证比较;③辅助教学实践中开展现代投资组合理论与高级风险控制技术相结合的编程实训课程。; 阅读建议:建议读者结合Matlab平台动手复现文中的代码示例,深入理解CVaR优化模型的构建逻辑与求解流程,并尝试调整资产数据、置信水平和约束条件以观察优化结果的变化,从而掌握其在真实投资决策中的灵活应用技巧。
标题基于SpringBoot的学生读书笔记共享平台设计研究AI更换标题第1章引言介绍学生读书笔记共享平台的研究背景、意义、国内外研究现状、论文方法以及创新点。1.1研究背景与意义阐述学生读书笔记共享平台在当前教育环境下的重要性。1.2国内外研究现状析国内外学生读书笔记共享平台的研究进展与现状。1.3研究方法及创新点概述本文的研究方法与平台设计的创新点。第2章相关理论总结和评述与SpringBoot及读书笔记共享平台相关的理论。2.1SpringBoot框架介绍阐述SpringBoot框架的特点、优势及其在Web开发中的应用。2.2读书笔记共享平台相关理论介绍读书笔记共享平台的设计原则、功能需求及用户体验理论。2.3数据库设计与优化理论简述数据库设计的基本原则及优化策略。第3章平台设计详细介绍基于SpringBoot的学生读书笔记共享平台的设计方案。3.1平台架构设计平台的整体架构,包括前端、后端及数据库的设计。3.2功能模块设计阐述平台的主要功能模块,如用户管理、笔记上传、笔记享等。3.3数据库设计介绍数据库的设计方案,包括表结构、索引及关系设计。第4章平台实现详细描述平台的具体实现过程,包括技术选型、开发环境搭建等。4.1技术选型与开发环境介绍开发平台所采用的技术栈及开发环境配置。4.2关键代码实现展示平台实现过程中的关键代码片段,如用户登录、笔记上传等功能的实现。4.3平台测试与优化平台的测试过程及优化策略,确保平台的稳定性和性能。第5章平台应用与析对平台的应用效果进行析,包括用户反馈、使用数据等。5.1用户反馈收集与析收集用户反馈,析用户对平台的满意度及改进建议。5.2使用数据析通过数据析工具,析平台的使用情况,如用户活跃度、笔记享量等。5.3对比方法析对比其他类似平台,析本平台的优势与不足。第6章结论与展望总结本文的研究成果,并对未来研究方向
上市公司人工智能技术应用水平主要用于衡量企业在人工智能技术研发、应用部署、业务融合以及战略布局方面的程度 学术界主要采用以下方法测度上市公司人工智能技术应用水平: 第一,人工智能专利测度法:基于企业技术创新产出视角,通过识别上市公司专利申请或授权信息中的人工智能相关专利,利用企业年度人工智能专利数量衡量其人工智能技术研发能力与技术积累水平 第二,年报文本析法:基于企业信息披露视角,通过构建人工智能关键词词典,提取上市公司年度报告、管理层讨论与析(MD&A)等文本中人工智能相关词汇出现频次,并对词频进行对数化处理,以衡量企业人工智能技术关注程度和应用水平 第三,机器人渗透度测度法:主要从智能化生产应用角度出发,利用行业层面的工业机器人安装密度,并结合企业所在行业特征、就业结构等信息,推算企业层面的自动化和人工智能技术渗透程度 第四,综合指数法:从人工智能投资、专利、关键词词频、机器人应用、人工智能项目等多维度构建指标体系,构建综合指数 第五,智能化投资测度法:基于人工智能软件投资额、人工智能硬件投资额之和占总资产的比例来衡量企业人工智能基础设施建设和技术应用水平 参考李果和白云朴(2024)、闫文影和陈雨生(2026)的研究思路,本文从企业人工智能技术实际投入角度衡量上市公司人工智能应用水平。具体而言,基于上市公司年度报告财务附注信息,通过关键词识别方法提取人工智能相关软件投资和硬件投资,并将二者加总形成企业人工智能投资规模,进一步以人工智能投资额占企业总资产的比例衡量企业人工智能技术应用水平 一、数据介绍 数据名称:上市公司人工智能技术应用水平 数据范围:上市公司企业 时间范围:2007-2025年 样本数量:78325条 数据来源:上市公司年报 二、数据指标 年份 股票代码 股票简称 行业名称 行业代码 省份
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值