模型案例:| 手机识别模型!

端到端图像分类算法开发实战:从 Arm 虚拟硬件到 Grove Vision AI Module V2 物理硬件 传统的嵌入式开发流程中,往往需要用到物理开发板才能进行相应的软件开发。但是,对于诸如:物理开发板运送途中、缺货或想要尝试一些新推出的处理器产品(例如:Arm®Cortex-M85Ethos™-U系列 NPU 等)但市场上硬件资源较为稀缺,或需要等待较长的时间(短至几个月,长至几年)才能拿到相应的物理开发板的情况下,是否有办法在相应的处理器平台上早早地进行软件开发呢?没有新型处理器平台的开发经验,又希望规避高昂的试错成本,有没有什么好的开发方式呢? 阅读详情

导读

2023年以ChatGPT为代表的大语言模型横空出世,它的出现标志着自然语言处理领域取得了重大突破。它在文本生成、对话系统和语言理解等方面展现出了强大的能力,为人工智能技术的发展开辟了新的可能性。同时,人工智能技术正在进入各种应用领域,在智慧城市、智能制造、智慧医疗、智慧农业等领域发挥着重要作用。

柴火创客2024年将依托母公司Seeed矽递科技在人工智能领域的创新硬件,与全球创客爱好者共建“模型仓”,通过“SenseCraft AI”平台可以让使用者快速部署应用体验人工智能技术!

本期介绍:模型案例:| 手机识别模型

RT-DETR

RT-DETR是基于DETR架构的端到端对象检测器,完全消除了对NMS的需求。通过这样做,RT-DETR显着减少了之前基于卷积神经网络(CNN)的对象检测器(如YOLO系列)的延迟。它结合了强大的主干、混合编码器和独特的查询选择器,可以快速准确地处理特征。

RT-DETR架构的关键组件

Backbone网络:通常采用高效的卷积神经网络(CNN)作为特征提取的基础,例如ResNet或EfficientNet,以获取图像的多尺度特征。从主干,RT-DETR提取三个级别的特征- S3,S4和S5,这些多尺度特征有助于模型理解图像的高级和细粒度细节。

Transformer编码器-解码器:RT-DETR中使用了Transformer的编码器-解码器结构,该混合编码器包括两个主要部分:基于注意力的尺度内特征交互(AIFI)和跨尺度特征融合(CCFF)。

基于注意力的尺度内特征交互(AIFI)

这个组件的核心思想是利用自注意力机制在同一尺度内进行特征交互。AIFI能够让模型有效地捕捉同一尺度特征图中各个位置之间的关系。

具体而言,AIFI通过计算特征的注意力权重,使得模型能够关注到重要的区域,并抑制冗余信息,从而增强对目标的定位和表征能力。

这种尺度内的交互有助于在相似尺寸的物体之间建立联系,提高对密集目标的检测能力。

跨尺度特征融合(CCFF)

CCFF负责整合来自不同尺度的特征,以便于模型能够从多层次的信息中获得更全面的上下文。这一过程通常涉及将来自不同尺度的特征图进行融合,通过卷积操作、上采样或下采样等方式,将这些特征进行对齐并结合在一起。

CCFF不仅允许模型综合不同尺度特征的优势,还能提高对各种大小目标的检测能力。

多尺度特征金字塔:RT-DETR通常会借助特征金字塔网络(FPN)来融合来自不同层次的特征,以加强对不同大小目标的检测能力。

目标查询(Object Queries):解码器使用的目标查询是关键组件,它们用于引导模型对目标的检测,允许模型在生成检测结果时关注不同的潜在目标。

类别和边界框回归:在解码器中,RT-DETR通过类别预测和边界框回归来输出目标的类别和位置。

高效的训练策略:RT-DETR往往结合了一些改进的训练策略,如动态图损失(Dynamic Loss)和图像增强技术,以提高模型的收敛速度和检测精度。

后处理:如NMS(非极大值抑制)处理步骤,以去除冗余的检测框和优化最终的检测结果。

手机识别模型

该 AI 模型由 Swift yolo 算法生成,专为 Seeed Studio Grove Vision AI (V2) 设备设计,能够高效识别和检测到手机。

应用场景

该模型适用于多种应用场景,包括零售、安全、公共空间监控和个人监督。

在零售业,该模型可以实时监控手机库存,帮助员工及时补货;

在安全方面,它可以帮助识别和跟踪丢失或被盗的手机;

在个人监督,很多大学学生上课玩手机,可以通过此模型进行监控。

在Grove - Vision AI V2模块上部署此模型

  1. 打开SenseCraft AI平台,如果第一次使用请先注册一个会员账号,还可以设置语言为中文。

平台地址:https://sensecraft.seeed.cc/ai/#/model

2、在顶部单击【预训练模型】菜单,在公共AI模型列表中找到【手机检测】模型,单击此模型图片,如下图所示。

3、进入【手机检测】模型介绍页面,单击右侧的“部署模型”按钮,如下图所示。

  1. 进入部署手机检测模型页面,按提示步骤先连接摄像头,再连接设备到电脑USB接口上,最后单击【连接设备】按钮,如下图所示。

5、弹出部署模型窗口,单击“确定”按钮,如下图所示。

6、弹出连接到串行端口窗口,选择端口号后单击“连接”按钮,如下图所示。

7、开始进行模型部署、固件下载、设备重启等过程,完成后在预览中即可看到当前摄像头视频内容,将摄像头对准手机图片查看预测效果,如下图所示。

原型设计

利用此手机识别模型,设计一个桌面手机监控装置,此装置在检测到有人用手机时会点亮led模块,也可改为蜂鸣器模块进行报警,这样就有了一个防沉迷手机检测装置。

下面是视频演示

手机识别模型

Grove Al视觉模块 V2套装介绍

Grove Al视觉模块 V2

OV5647-62摄像头

Grove - Vision Al Module V2是一款拇指大小的人工智能视觉模块, 配备Himax WiseEye2 HX6538处理器, 该处理器采用 ArmCortex-M55双核架构。

它具有标准的CSI接口, 并与树莓派相机兼容。它有一个内置的数字麦克风和SD卡插槽。它非常适用于各种嵌入式视觉项目。

有了SenseCraft Al算法平台, 经过训练的ML模型可以部署到传感器, 而不需要编码。它兼容XIAO系列和Arduino生态系统, 是各种物体检测应用的理想选择。

主要硬件配置

- 板卡基于WiseEye2 HX6538处理器, 采用双核ARM Cortex-M55架构

- 配备集成Arm Ethos-U55微神经网络加速单元, 兼容的树莓派相机

- 板载PDM麦克风, SD卡插槽, Type-C, Grove接口, 丰富的外设支持样机开发

- Seeed Studio XIAO的可扩展性, SenseCraft Al的现成AI模型用于无代码部署。

- 支持各种有效的模型, 包括MobilenetV1、MobilenetV2、 Eficientnet-Lite、Yolov5和Yolov8.

写在最后

SenseCraft-AI平台的模型仓数量还很少,但是好消息是它支持自定义模型上传并输出推理结果,平台会逐渐增加模型仓的数量,敬请关注!

模型案例| 水果识别分类模型 5、弹出“自定义AI模型”窗口,填写模型名称、添加下载的模型文件、单击“新增物体”设置三个水果标签(注意三个标签的名称顺序不能写错分别是APPLE、BANANA和GRAPES),填写完成后单击“发送模型”按钮,如下图所示。水果识别算法是一种利用计算机视觉和深度学习技术,通过对水果图像进行分析和特征提取,来识别和分类不同种类的水果的算法。6、等待一段时间的下载和烧录固件的过程,完成后将打开右侧的预览窗口,现在就可以将XIAO ESP32 S3(Sense)的摄像头对准苹果、香蕉和葡萄进行测试了,如下图所示。 阅读详情

相关推荐

模型案例| 奶牛识别模型

在开发以卷积神经网络(CNN)为核心的机器学习模型时,为了提供准确率最常见的方法是通过深度或宽度(其实也就是增加channels)来放大卷积网,或是使用分辨率更大的图像进行训练和评估。这种平衡的增长使模型能够在不需要不必要的计算的情况下提高准确性,并在不牺牲有效性的情况下最大限度地提高效率。它兼容XIAO系列和Arduino生态系统, 是各种物体检测应用的理想选择。SenseCraft-AI平台的模型仓数量还很少,但是好消息是它支持自定义模型上传并输出推理结果,平台会逐渐增加模型仓的数量,敬请关注!

x_factory的博客 1006

HX6538规格书 datasheet

介绍HX6538内部资源、接口、封装。

模型案例| 手势动作识别模型训练与应用!

模型案例推文中,介绍过通过摄像头进行视觉识别和通过麦克风进行声音识别,今天介绍第三种识别形式:利用多轴加速度传感器进行动作识别。 我们尝试利用手机自带的三轴加速度传感器来采集三种动作手势,包括左右晃动、上下晃动和静止不动

x_factory的博客 1431

NI_Vision_Builder_AI入门教程 ( ni 视觉概念手册.pdf )

NI_Vision_Builder_AI

Grove Vision AI V2介绍

Grove Vision AI V2开发板介绍。

professionalmcu的专栏 3211

模型案例| 安全栓目标监测模型

以猫狗的图片为例,这里输出有两个值,你可以理解成就是 Python 中的两个浮点值的 list [Y1, Y2], Y1是狗的概率,值∈[0, 1],Y2是猫的概率。模型就是一组数据结构,保存了一个网状的形状,以及里面的参数, 通常模型会被保存为不同格式的文件,比如.h5 .tflite .kmodel等文件,都是用来阐述这个模型的形状结构和参数。神经网络是一种网状结构,可以更好地记住图片的特征信息, 而这个网状结构又是多层的,也就是有深度的,所以称之为深度神经网络DNN。比如下面这张图识别出猫或者狗。

x_factory的博客 1297

模型案例| 石头、剪刀、布手势识别模型

边缘设备的存储空间有限,无法容纳大型模型,因此需要将模型进行压缩和优化。同时,也需要在边缘设备上进行模型训练与推理时权衡模型的偏差和方差,以获得适合边缘环境的模型性能。5、接着在“可用的AI模型”列表中选择模型,这里选择“Gesture Detection”,然后单击“发送”按钮,如下图所示。,通过将计算和智能移动到数据源附近,可以实现近乎实时的数据处理和决策,满足对实时性要求较高的应用场景。,边缘机器学习可以在本地处理数据,减少对云端的数据传输,降低了网络带宽的消耗。因此,嵌入式机器学习,也被称为。

x_factory的博客 1246

目标检测SSD模型移植到Android手机上+调用摄像头拍照进行目标识别

续我的6月15号的博客,原本准备将我自己训练的YOLO V3的模型移植到手机上,但是尝试了几次都不成功,发现自己训练的模型,在转换成.pb文件之后,创建tensorflow接口总是失败,估计时我模型保存时有其他的问题,故想先移植一个官方demo能够运行的SSD模型。 目录1.安卓手机显示的效果图2.移植步骤-添加依赖和配置2.1 将想要移植的模型放到指定位置2.2 添加.so和 .jar的依赖2.3 app\build.gradle(Module:app)配置3.移植步骤-模型调用3.1首先创建一个Clas

qq_28664681的博客 5855

DAMOYOLO手机检测模型应用案例:智能监控中的手机识别

本文介绍了如何在星图GPU平台自动化部署“实时手机检测-通用”镜像,实现高效智能监控。该方案基于DAMOYOLO模型,可实时识别手机设备,适用于考场防作弊、会议室保密管理等场景,提升监控自动化水平与准确性。

weixin_36300623的博客 768

DAMO-YOLO手机检测实战案例手机回收APP拍照自动识别型号

本文介绍了如何在星图GPU平台上自动化部署“实时手机检测-通用”镜像,快速构建手机识别服务。该方案基于DAMO-YOLO模型,能够高效、精准地检测图片中的手机,可广泛应用于手机回收APP等场景,实现用户拍照后自动识别手机型号,极大提升业务流程效率与用户体验。

weixin_42234168的博客 1073

Tensorflow object detection API 搭建属于自己的物体识别模型(3)——将自己的模型迁移到手机上运行

上一篇博客中介绍了如何使用Tensorflow object detection API 搭建属于自己的物体识别模型(https://blog.csdn.net/dy_guox/article/details/79111949),由于我们的模型是基于ssd_mobilenet训练,这个模型本身是相对较为轻量级的,也可以在手机上使用,因此,这篇博客将介绍如何将Tensorflow object de...

dy_guox的博客 1万+

人工智能导论》课设:基于 YOLO11 的手机型号识别系统实现教程

摘要:本文介绍了基于YOLO11算法的手机型号识别系统开发全过程。系统针对当前手机外观相似度高的问题,实现了对一加、OPPO、小米等7个品牌39种机型及配色的准确识别。内容包括:1) 环境搭建指南;2) 多角度、多光照条件下的数据收集与标注方法;3) 两种训练策略对比(迁移学习与联合训练);4) 完整的预测代码实现;5) 包含图片、视频和摄像头检测的可视化交互界面开发。实验表明,该系统在不同应用场景下均能有效识别手机型号,为市场调研、二手交易等场景提供了实用解决方案。

2302_80961196的博客 2199

OSHW-SenseCAP-Watcher:实时监控与智能交互

OSHW-SenseCAP-Watcher:实时监控与智能交互 项目介绍 OSHW-SenseCAP-Watcher 是一款基于 ESP32S3 开发的高性能智能设备,内置 Himax WiseEye2 HX6538 AI 芯片,具备强大的图像和向量数据处理能力。通过搭载的摄像头、麦克风和扬声器,SenseCAP Watcher 能够实现视觉识别、听觉感知和语音交互。结合 LLM(Language...

gitblog_00900的博客 1189

模型案例| SenseCraft Al平台模型训练与部署

嵌入式神经网络处理器(NPU)是一种特别设计用于执行神经网络计算的高效率处理器。它主要基于数据驱动并行计算架构,特别擅长处理视频、图像等大量的多媒体数据。NPU模仿了生物神经网络的架构,与CPU、GPU相比,它能够通过更少的指令(一条或几条)完成神经元的处理,因此在深度学习的处理效率方面具有明显优势。

x_factory的博客 1459

XIAO ESP32S3之SenseCraft 模型助手部署

鉴于我的电脑之前安装过esp-idf v4.3版本,而ESP32-S3需要v4.4及以上版本才支持,所以将esp-idf更新到最新5.1版本。esp-idf目录下创建projects目录。

professionalmcu的专栏 1895

【Vision AI v2开箱之SenseCraft AI猫狗识别Arduino教程】

首先非常高兴参加Seeed家的开发板测评活动,将通过本教程,我们可以使用Vision AI v2进行SenseCraft AI猫狗识别,然后与XIAO ESP32C3通讯打印实时检测的结果,大家可以自我发挥将识别结果进行自动喂喵咪逗喵啥的。SenseCraft AI 使用户能够毫不费力地将大量公开可用的 AI 模型库(包含目标检测,目标识别,姿态检测等人工智能算法)部署到他们的边缘设备上,它提供了无缝且用户友好的体验,只需单击几下即可将公共 AI 模型直接部署到边缘设备上。

vor234的博客 2452

SenseCraft 部署模型到Grove Vision AI V2图像处理模块

今天教大家快速上手Grove Vision AI V2 图像处理模块,我们将一起探讨如何利用 SenseCraft 部署 AI 模型,和如何通过XIAO ESP32C3调用这些模型,轻松实现智能视觉功能!

weixin_44719294的博客 1982

模型案例| 火源识别-灭火机器人装置

就类似于当初参加高考的你,训练数据就类比是你在刷题,当你刷了非常非常多的题,并学会他们的特征,那么你应对高考则是游刃有余了。在机器学习过程中,关于神经网络模型训练的准确度上有两个问题,过拟合(Overfitting)和欠拟合(Underfitting),它们是机器学习中常见的两种模型性能问题,分别表示模型在训练数据上表现得过于复杂或过于简单。过拟合形成的主要原因就是训练集的数据太少,导致无法学习到想要的模型,因此当发生过拟合时,首先应该考虑的就是增加训练集的数据量。它有一个内置的数字麦克风和SD卡插槽。

x_factory的博客 350
上一篇: 模型案例:| 辣椒炭疽病识别模型!
下一篇: 模型案例:| 奶牛识别模型!
Chaihuo x.factory
博客等级 码龄4年 548粉丝 47原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值