AI普及给嵌入式设计人员带来新挑战-EDN 电子技术设计

 探讨了人工智能（AI）的普及给嵌入式设计人员带来的新挑战。在创建“边缘机器学习（ML）”应用时，设计人员必须确保其能有效运行，同时最大限度地降低处理器和存储开销，以及物联网（IoT）设备的功耗。

从监控和访问控制到智能工厂和预测性维护，基于机器学习（ML）模型构建的人工智能（AI）在工业物联网边缘处理应用中已变得无处不在。随着这种普及，支持AI的解决方案的构建已经变得“大众化”——从数据科学家的专业领域转为嵌入式系统设计人员也需要了解的领域。这种大众化带来的挑战在于，设计人员并不一定具备定义要解决的问题以及以最恰当方式捕获和组织数据的能力。此外，与消费类解决方案不同，工业AI实现的现有数据集很少，通常需要用户从头开始创建自己的数据集。sLnednc

融入主流

AI已经融入主流，深度学习和机器学习（DL和ML）是我们现在习以为常的许多应用的背后力量，这些应用包括自然语言处理、计算机视觉、预测性维护和数据挖掘。早期的AI实现是基于云或服务器的，需要大量的处理能力和存储空间，以及AI/ML应用与边缘（终端）之间的高带宽连接。尽管生成式AI应用（如ChatGPT、DALL-E和Bard）仍然需要此类设置，但近年来已经出现了边缘处理的AI，即在数据捕获点实时处理数据。边缘处理极大减少了对云的依赖，使整体系统/应用更快、需要更少的功耗并且成本更低。许多人认为安全性得到了提高，但更准确地说，主要的安全重点从保护云与终端之间的通信转移到了使边缘设备更安全。sLnednc

边缘的AI/ML可以在传统的嵌入式系统上实现，这些系统的设计人员可以使用强大的微处理器、图形处理单元和丰富的存储器器件，即类似于PC的资源。然而，越来越多的商业和工业物联网设备需要在边缘具备AI/ML功能，这些设备通常硬件资源有限，而且在许多情况下由电池供电。sLnednc

在资源和功耗受限的硬件上运行的边缘AI/ML的潜力催生了“TinyML”这一术语。实际用例涵盖工业（如预测性维护）、楼宇自动化（环境监控）、建筑施工（监督人员安全）和安防等领域。sLnednc

数据流

AI（及其子集ML）需要从数据捕获/收集到模型部署的工作流程（见图1）。对于TinyML而言，由于嵌入式系统资源有限，因此每个工作流程阶段的优化至关重要。sLnednc

例如，TinyML的资源需求被认为是1 MHz到400 MHz的处理速度、2 KB到512 KB的RAM和32 KB到2 MB的存储空间（闪存）。此外，150 µW至23.5 mW的小功耗预算也常常带来挑战。sLnednc

sLnednc

图1——上图为简化的AI工作流程。虽然图中未显示，但模型部署本身必须将数据反馈回流程中，甚至可能影响数据的收集。sLnednc

此外，在将AI嵌入资源有限的嵌入式系统时，还有更重要的考虑因素或权衡。模型是系统行为的关键，但设计人员经常发现自己在模型质量/精度（影响系统可靠性/依赖性和性能，主要是运行速度和功耗）之间做出妥协。sLnednc

另一个关键因素是决定使用哪种类型的AI/ML。通常有三种算法可供使用：监督学习、无监督学习和强化学习。sLnednc

解决方案

即使是对AI和ML有良好理解的设计人员，可能也会在优化AI/ML工作流程的每个阶段并在模型精度与系统性能之间找到完美平衡方面遇到困难——那么缺乏以往经验的嵌入式设计人员如何应对这些挑战呢？sLnednc

首先，重要的是不要忽视一个事实：如果模型小且AI任务仅限于解决简单问题，那么部署在资源有限的物联网设备上的模型将会更有效。sLnednc

幸运的是，ML（特别是TinyML）进入嵌入式系统领域，带来了新的（或增强的）集成开发环境（IDE）、软件工具、架构和模型——其中许多都是开源的。例如，TensorFlow™ Lite for Microcontrollers（TF Lite Micro）是一个面向ML和AI的免费开源软件库，它专为在只有几KB存储器的器件上实现ML而设计。此外，程序可以用开源和免费的Python语言编写。sLnednc

关于IDE，Microchip的MPLAB^® X就是此类环境的一个示例。该IDE可与公司的MPLAB ML一起使用，MPLAB ML是专门开发的MPLAB X插件，用于构建优化的AI物联网传感器识别代码。MPLAB ML由AutoML提供支持，可将AI ML工作流程的每一步完全自动化，无需重复、繁琐和耗时的模型构建。特征提取、训练、验证和测试确保满足单片机和微处理器存储器限制的优化模型，使开发人员能够快速在基于Microchip Arm® Cortex®的32位MCU或MPU上创建和部署ML解决方案。sLnednc

流程优化

工作流程优化任务可以通过使用现成的数据集和模型来简化。例如，如果一个支持ML的物联网设备需要图像识别，从现有的标记静态图像和视频片段数据集开始进行模型训练（测试和评估）是合理的；需要注意的是，监督学习算法需要标记数据。sLnednc

许多图像数据集已经存在于计算机视觉应用中。然而，由于它们是为基于PC、服务器或云的应用设计的，通常都很大。例如，ImageNet包含超过1400万张标注图像。 sLnednc

根据ML应用的不同，可能只需要少量子集；例如，有很多人但只有少量静物的图像。例如，如果在建筑工地使用支持ML的摄像头，当有不戴安全帽的人进入其视野时，它们可以立即发出报警。ML模型需要训练，但可能只需要少量戴或不戴安全帽的人的图像。然而，对于帽子类型，可能需要更大的数据集和足够的数据集范围，以考虑不同的光照条件等各种因素。sLnednc

图1中第1步到第3步的内容分别是获得正确的实时（数据）输入和数据集、准备数据和训练模型。模型优化（第4步）通常是压缩，这有助于减少存储器需求（处理期间的RAM和用于存储的NVM）和处理延迟。sLnednc

在处理方面，许多AI算法（如卷积神经网络（CNN））在处理复杂模型时会遇到困难。一种流行的压缩技术是剪枝（见图2），剪枝有四种类型：权重剪枝、单元/神经元剪枝和迭代剪枝。 sLnednc

sLnednc

图2——剪枝减少了神经网络的密度。上图中，某些神经元之间的连接权重被设为零。但有时神经元也可以被剪掉（图中未显示）。sLnednc

量化是另一种流行的压缩技术。量化是将高精度格式（如32位浮点（FP32））的数据转换为低精度格式（如8位整数（INT8））的过程。量化模型（见图3）的使用可以通过以下两种方式之一纳入机器训练。sLnednc

训练后量化涉及使用FP32格式的模型，当训练完成后，再进行量化以便部署。例如，可以使用标准TensorFlow在PC上进行初始模型训练和优化。然后模型可以进行量化，并通过TensorFlow Lite嵌入到物联网设备中。
量化感知训练可仿真推断时量化，创建一个模型供下游工具用于生成量化模型。

sLnednc

图3——量化模型使用低精度，从而减少存储器和存储需求并提高能源效率，同时仍保留相同的形状。 sLnednc

虽然量化很有用，但不应过度使用，因为它类似于通过使用较少的位表示颜色和/或使用较少的像素来压缩数字图像——即，会存在一个图像变得难以解释的点。sLnednc

总结

正如我们在开头所提到的，AI现在已经深深融入嵌入式系统领域。然而，这种大众化意味着以前不需要了解AI和ML的设计工程师正面临将AI解决方案实现到其设计中的挑战。 sLnednc

尽管创建ML应用并充分利用有限硬件资源的挑战可能令人望而却步，但这对经验丰富的嵌入式系统设计人员来说并不是一个新挑战。好消息是，工程社区内有丰富的信息（和培训），以及像MPLAB X这样的IDE、MPLAB ML这样的模型构建工具以及各种开源数据集和模型。这种生态系统可帮助不同理解水平的工程师快速完成现在可以在16位甚至8位单片机上实现的AL和ML解决方案。 sLnednc

关于作者：

Yann LeFaou是Microchip触摸和手势业务部的副总监。在这个职位中，LeFaou领导一个团队开发电容式触摸技术，并推动公司在单片机和微处理器上的机器学习（ML）计划。他在Microchip担任过一系列连续的技术和市场职位，包括领导公司在电容式触摸、人机界面和家用电器技术方面的全球市场活动。LeFaou拥有法国电力机械专业学院（ESME Sudria）的学位。sLnednc

责编：Ricardo

阅读全文，请先

人工智能嵌入式系统安全与可靠性测试与测量人机交互模拟/混合信号/RF 操作系统工业电子汽车电子医疗电子智能硬件消费电子技术实例创新/创客/DIY 产业前沿工程师职业发展

上一篇： 使用示波器自动化测量电源开关损耗 下一篇： 准确的自恢复保险丝

微信扫一扫
一键转发
最前沿的电子设计资讯
请关注“电子技术设计微信公众号”

全自动手术机器人出现，缝合速度比医生还快30%？美国约翰霍普金斯大学和斯坦福大学的联合团队创造了一项前所未有的突破，他们首次对机器人进行了训练，使其能够像人类医生一样熟练地执行相同的手术程序···
其实CPU才是最适合AI推理的？因为这五大理由本文将具体介绍CPU成为AI推理工作负载最佳目标的五大理由···
人工智能前沿｜2025 年影响工程的顶级趋势想要在人工智能竞赛中保持领先的工程领导者应该关注四个关键领域的进步：生成式人工智能、验证和确认、降阶模型（ROM）和控制系统设计···
人工智能对数据中心基础设施带来了哪些挑战在加密货币和人工智能/机器学习（AI/ML）等新兴应用的驱动下，数据中心的能耗巨大，并将快速增长以满足用户需求···
以极致能效破解人工智能背后的“能源危机” 电力正在成为威胁人工智能（AI）进步的最新瓶颈，而人工智能迅猛增长的算力背后，攀升的能源占用也正在大量挤占正常的社会用能需求···
新一代MCU向着边缘AI和实时控制发展在工业和汽车领域，电机驱动和数字电源转换是典型的实时控制系统，要求处理器具有高实时性和强大的数学计算与处理能力。这些应用需要优质的ADC和PWM功能，并通过联动机制，形成高效、有机的实时控制系统。
Arm年度技术大会：2025年底预计将有1,000亿台具备AI能力近日，作为 Arm 一年一度的技术盛会，2024 年度技术大会（Arm Tech Symposia 2024）在上海和深圳成功举办。这次的大会十分特殊，以往 Arm 年度技术大会往往会专注于特定的应用市场，而今年的大会只聚焦于一个领域——AI···
Arm Tech Symposia 年度技术大会顺利收官，继续构建作为当今时代最重大的技术变革之一，AI 极有潜力成为人类毕生最重要的技术。Arm 不仅提供了应用广泛的通用计算平台，还通过将 IP 与开源软件和工具乃至广泛的行业领先生态系统相结合，让全球 2,000 万开发者都能够使用 Arm 计算平台作为 AI 创新基础···
优傲推出UR AI加速器，为协作机器人注入人工智能新动力 UR AI加速器。这是一套即插即用的硬件与软件解决方案，旨在促进AI赋能型协作机器人应用的创新进程···
继联网传输视频、图片之后，现在连气味也能远程传送了？这是一家名为Osmo的“数字嗅觉”公司推出的技术，该公司在最近成功利用 AI 技术分析一个位置的气味，并在无需人工干预的情况下在其他地方复制它，实现了气味的远程传送···
AI 大模型迈向多模态，助力具身智能与机器人实现创新你听过莫拉维克悖论 (Moravec's paradox) 吗？该悖论指出，对于人工智能 (AI) 系统而言，高级推理只需非常少的计算能力，而实现人类习以为常的感知运动技能却需要耗费巨大的计算资源···
2024诺贝尔奖公布，竟然有两项都颁给了AI？诺贝尔奖被普遍认为是在世界范围内，所有颁奖领域内能够取得的最高荣誉，最近，2024年的诺贝尔奖获奖名单也陆续公布了出来，而在目前公布的奖项中竟然有两项都与人工智能相关···

机器人所需要的传感器有哪些？随着机器人技术的迭代升级，传感器的重要性将持续提升，其功能性、精度和适配性也将得到显著改进，作为机器人不可
2024年墨西哥市场分析，中国品牌崛起 2024年，墨西哥汽车市场以近10%的增长率展现了强劲的复苏势头，中国品牌的崛起为市场注入了新活力，当然现在的政
2025，大众汽车集团在中国如何转型？ 2024 年，大众汽车集团（中国）在复杂多变的市场环境中成功达成销量目标，向客户交付超过 290 万辆汽车，新能源汽车领
国产射频芯片公司汇总对于射频芯片这项卡脖子技术，国内很多公司在这方面努力，而且也做出了不错的成绩。一些射频芯片公司无论从研发
拆解报告：松下电器1200W电吹风松下EH-NW90电吹风内置10万转高速无刷电机，并具备三档风速和四档风温可选。电吹风内置纳诺怡技术，为秀发提供
拆解报告：白牌电动工具电池多功能放电转换器这款白牌多功能放电转换器适配得伟电动工具电池使用，将电动工具电池和放电转换器组装起来，即可组成移动电源和
拆解报告：MOMA猛玛LARK M2无线麦克风 MOMA猛玛LARK M2无线麦克风在外观方面，采用了极富创新的设计，提供了轻盈舒适的佩戴使用体验。发射器采用了夹
阿根廷2024年：销量下滑，北汽增长240.1%。 2024年阿根廷汽车市场在整体销量下滑的背景下，依然展现出多元化的发展趋势···
2025年第3周：全球最快四足机器人发布 2025年将成为机器人产业的关键时间点，业内预期27年人形机器人出货量可达50~100万台。从技术进步到供应链成熟
欧洲2024年汽车市场：微弱复苏和电动化加速并存 2024年，欧盟新车注册量小幅增长0.8%，达到约1060万辆，欧盟+英国+北欧国家的销量为1296.4万台，同比增长0.9%，整个欧
射频微波领域有哪些高质量期刊？今天我们结合网络上的资料一起整理一份射频微波领域的期刊列表，以便同学们投稿时可以选择···
拆解报告：Portal智能屏幕24W电源适配器 Portal智能屏幕电源适配器采用黑色直板机身，外观整洁，配有2米长黑色输出线。适配器采用美规固定插脚，支持100-2

性能飞跃！升级电流传感器NSM201x-P系列赋能汽车三电和光伏逆变器纳芯微推出全新车规级集成电流路径霍尔传感器NSM201x-P系列。该系列产品是对纳芯微已量产的NSM201x系列的完
意法半导体推出STSPIN32G0新列电机驱动器，满足工业自动化和家电市意法半导体STSPIN32系列集成化电机驱动器新增八款产品，满足电动工具、家用电器、工业自动化等应用的低成本、
Melexis推出性能先进的温度传感器，以红外技术创新实现电磁炉智能全球微电子工程公司Melexis宣布，推出专为电磁炉设计的非接触式红外温度传感器芯片MLX90617···
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC模块基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
为汽车安全保驾护航，纳芯微推出基于AMR技术的ABS轮速传感器纳芯微宣布推出全新基于AMR（各向异性磁阻技术）的轮速传感器NSM41xx系列。该系列产品通过集成先进的磁性传感敏
Microchip推出全新Switchtec™ PCIe® 4.0 16通道交换机系列 PCI100x系列器件可为任何需要加速或专用计算的应用提供高性能和成本效益···
RK3576有多强？实测三屏八摄像头轻松搞定-米尔米尔基于他们推出的MYD-LR3576开发板开发了一个3屏异显，8路摄像头输入的DEMO，实测下来，RK3576轻松搞定了该任
SynQor®推荐先进的军用级三相输入UPS（UPS-1500-S-1U-T） SynQor的三相输入UPS电源能使单相负载在电源端呈现出符合MIL-STD-1399-300B标准的清洁、表现良好且几乎零反
村田开发超小尺寸、超低功耗的Type 2GQ GNSS模块，以匠心品质助在几年前，定位系统充斥于生活方方面面的情节还仅见于各式的科幻影片，而今具备这一功能的产品已经以各种形态步
瑞萨推出性能卓越的新型MOSFET 瑞萨全新晶圆技术可以帮助MOSFET实现导通电阻降低30%、栅漏电荷减少40%、封装尺寸缩小50%的目标···
加特兰集成 Cadence Tensilica ConnX 220 DSP 全面升级汽 ConnX 220 DSP 集成至基于下一代 Andes SoC 的加特兰雷达解决方案后，将带来显著优势，包括提高灵活性、

热门评论
最新评论

换一换

杂志声明

AI普及给嵌入式设计人员带来新挑战

融入主流

数据流

解决方案

流程优化

总结

关于作者：