利用音频边缘处理器实现感知情境的音频体验-EDN 电子技术设计

 专用音频边缘处理器将定义下一代音频和语音设备，创造更多情境感知、沉浸式和无缝的音频通迅体验。它们能够高效地实现低功耗和低延迟的语音通讯、降噪、情境感知和传感器输入端的加速ML推理，使人机交互界面新式用户体验的爆发成为可能。

具有机器学习功能的专用音频边缘处理器将提供越来越好的通讯体验。J4sednc

在过去的十年中，尤其是在2020年，疫情造成越来越多的人居家办工，于是对于视频通话和语音设备的需求大幅增加。除了Zoom会议，我们还会使用视频通话进行教学、上锻炼课程、体验现场音乐、进行会议互动等等。这种虚拟形式的参与常通过笔记本电脑、智能手机、平板电脑、智能家庭助理以及其他物联网设备(例如Amazon Echo Show、Facebook Portal、Peloton、Tempo Studio等)进行。J4sednc

在音频、视频通话或家庭助理应用中，要保证愉快和投入的体验，音质不能受到噪音和其他干扰因素的影响。设备对声音处理的智能程度决定了通讯的顺畅程度。J4sednc

日益增加的音频和语音复杂性需要新技术

音频智能(产品制造商也称之为“智能声音”)是设备处理声音以提供最佳用户体验的能力。随着语音优先设备在通信、娱乐和健康管理领域的使用越来越多，更多的功能需要实现无缝、顺滑的体验。J4sednc

用户现在期望的不仅仅是简单的设备唤醒或关键字捕捉(例如Alexa)，还期望无论是在专业会议还是个人娱乐方面，能够实现设备与应用之间的切换并拥有卓越的音质，从而为用户提供身临其境的无缝体验。设备应该能够将你的语音和/或语音命令与你的个人偏好和环境数据结合起来，以便根据特定情况对你的声音进行处理。这即是情境感知。J4sednc

何为情境感知？

情境感知设备包含特定用户的信息，例如位置、偏好和环境传感器数据，因此可以更好地了解用户的需求，从而更加准确地对特定命令或触发做出响应并实现相应的功能。J4sednc

持续监听(always-listening)设备使用的是结合了机器学习(ML)的信号处理技术，常用于区分自然声音、人声、背景干扰等多种声音。这些声音通常被分为“场景”和“事件”。“场景”是用户所处的环境，例如嘈杂的机场航站楼或安静的工作空间，而“事件”包括：人说话、玻璃破碎或狗吠。情境感知设备可以处理这些声音，确保无论是视频通话还是语音命令，用户都能获得最佳体验。J4sednc

J4sednc

图1：情境感知系统示意图。(图片来源：Knowles公司)J4sednc

为什么要使用专用音频边缘处理器？

专用音频边缘处理器搭载了ML优化内核和音频保真，是支持情境感知和高质量音频通信设备的关键。这些处理器可以提供足够的算力，通过使用传统算法和ML算法来处理音频，而耗费的能量只有通用数字信号处理实现的一小部分。J4sednc

虽然云端处理的优点可能很多，但边缘处理不需要高带宽网络连接，因此用户随时都可以使用设备的全部功能。例如，边缘音频处理器可以对包含情境感知数据的音频进行低延迟处理，同时将感知数据安全地保存在本地，从而让用户有卓越的虚拟通讯体验。J4sednc

专用音频边缘处理器需满足哪些特性？

音频边缘处理器必须满足多项性能要求才能提供卓越的音频和语音命令体验。J4sednc

噪声和距离J4sednc

采用信号处理算法的波束成形可将声音聚集或引导到特定方向，从而提高音质、抑制噪声，实现日常使用场景中的对话。监听设备用于确定语音和噪声源的方向；ML分类技术用于确定哪些波束中含有语音或噪声。J4sednc

随后，DSP对只包含语音内容的波束进行下一步的语音UI处理。例如，在会议系统中，设备必须能够识别声音的方向，且须始终360度追踪多个发言者。噪声源也可以被归类为音频事件检测，如玻璃破碎、火警等，从而进一步应用在音频感知智能家居系统。J4sednc

接近检测对于动态的听说体验也是必不可少的。设备通过检测用户与麦克风的接近程度来调整麦克风的增益，从而为演讲、锻炼和学习环境提供有效的视频功能。这些功能是高级视频会议设备设计的核心，例如亚马逊新推出的Echo Show，其屏幕会随着用户移动而旋转，从而使屏幕始终面向用户。J4sednc

延迟J4sednc

人们在通话之前，通常可以容忍最多200ms的端到端延迟。因此，边缘处理器中的低延迟处理是确保高质量语音通讯的关键。J4sednc

功耗J4sednc

音频边缘处理器采用了专有架构、硬件加速器和特殊的指令集，因而可以运行最优的音频和ML算法。在音频密集的用例(例如视频会议)中，这些优化有助于降低功耗。J4sednc

集成J4sednc

音频边缘处理器的架构和开发环境已经公开，用于研发新设备和应用的工具和支持也已经提供给应用程序开发人员，从而加速创新。未来的音频设备会是协作努力的成果。J4sednc

安全性J4sednc

边缘处理可以最大程度地减少对云连接的需求，且有着其他许多好处，包括提高数据的安全性。例如，大多数消费者会介意将个人智能家居设备的数据频繁传输到云端进行处理。过去几年，几家知名设备制造商的重大违规行为证明了消费者的这些担忧不无道理。J4sednc

在本地设备上处理个人数据并进行分析或推理可以让人安心。这里有一个很好的例子：智能家居安全设备经过训练可以听懂特定事件的声音(例如玻璃破碎)，以此来提醒人们。声音和警报都由边缘处理器进行处理，而不需要持续连接到云端，从而增强了系统的安全性。J4sednc

结论

专用音频边缘处理器将定义下一代音频和语音设备，创造更多情境感知、沉浸式和无缝的音频通迅体验。它们能够高效地实现低功耗和低延迟的语音通讯、降噪、情境感知和传感器输入端的加速ML推理，使人机交互界面新式用户体验的爆发成为可能。J4sednc

（原文刊登于EDN姐妹网站Electronic Products，参考链接：Audio edge processors deliver context-aware audio experiences，由Jenny Liao编译。）J4sednc

阅读全文，请先

处理器/DSP 产业前沿

上一篇： “无接触”时代，新技术催生新应用、新业态 下一篇： 新计算机芯片设计套件为下一代芯片打开大门

微信扫一扫
一键转发
最前沿的电子设计资讯
请关注“电子技术设计微信公众号”

毫米波雷达与音频技术重塑汽车驾乘新体验汽车行业的发展正由两大创新领域主导：更为精准可靠的车内感知系统和高质量音频系统。传统方法如增加传感器或音频设备数量，虽可提升性能但会带来成本上升和复杂性增加的问题。
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC 基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
再拆沃尔玛的FHD流媒体棒：“UHD”和“FHD”的区别在哪？在我于2024年7月拆解沃尔玛第一代onn. Android TV 4K UHD流媒体设备的介绍中，我还提到了一个FHD“棒”，它“在我右手边的书架上排队等着拆解”，现在是时候了···
英伟达或推中国特供RTX 5090 D，硬件与5090完全相同？据外媒曝光的消息，英伟达即将推出的50系显卡也会推出专门的中国特供版本，名称为GeForce RTX 5090 D···
兆易创新推出EtherCAT®从站控制芯片，工业自动化的卓越业界领先的半导体器件供应商兆易创新GigaDevice（股票代码 603986）宣布，正式推出EtherCAT®从站控制芯片···
瑞萨率先推出采用车规3nm制程的多域融合SoC 第五代R-Car SoC为集中式E/E架构，带来面向未来的多域融合解决方案，并支持Chiplet扩展···
艾迈斯欧司朗Belago红外LED，助力Supernode打造高精度避 Supernode与艾迈斯欧司朗携手，通过Belago红外LED实现精准扫地机器人避障；得益于Belago出色的红外补光功能，使扫地机器人能够大大提升其识别物体的能力，实现精准避障；Belago点阵照明器采用迷你封装，兼容标准无铅回流工艺，适用于各种3D传感平台，包括移动设备、物联网设备和机器人。
Nordic Semiconductor推出nRF54L15、nRF54L10 和 n 新型先进低功耗蓝牙SoC 带来更高效率和超强处理能力，为广泛物联网应用提高性能和灵活性···
AMD 宣布推出第二代 Versal Premium 系列，实现全新以业界首款采用 CXL 3.1 及 PCIe Gen6 并支持 LPDDR5 的 FPGA 器件扩展第二代 Versal 产品组合，助力快速连接、更高效数据迁移并释放更多内存···
AMD 以全球极快的纤薄尺寸电子交易加速卡扩展 Alveo AMD Alveo UL3422 加速卡为高频交易员在争夺最快交易执行的竞争中提供了优势，同时降低了进入门槛···
瑞萨推出高能效第四代R-Car车用SoC引领ADAS产品创新全新的R-Car V4M和R-Car V4H SoC产品面向大规模L2及L2+ADAS市场，同时保持现有R-Car产品的可扩展性与软件复用性···

机器人所需要的传感器有哪些？随着机器人技术的迭代升级，传感器的重要性将持续提升，其功能性、精度和适配性也将得到显著改进，作为机器人不可
2024年墨西哥市场分析，中国品牌崛起 2024年，墨西哥汽车市场以近10%的增长率展现了强劲的复苏势头，中国品牌的崛起为市场注入了新活力，当然现在的政
2025，大众汽车集团在中国如何转型？ 2024 年，大众汽车集团（中国）在复杂多变的市场环境中成功达成销量目标，向客户交付超过 290 万辆汽车，新能源汽车领
国产射频芯片公司汇总对于射频芯片这项卡脖子技术，国内很多公司在这方面努力，而且也做出了不错的成绩。一些射频芯片公司无论从研发
拆解报告：松下电器1200W电吹风松下EH-NW90电吹风内置10万转高速无刷电机，并具备三档风速和四档风温可选。电吹风内置纳诺怡技术，为秀发提供
拆解报告：白牌电动工具电池多功能放电转换器这款白牌多功能放电转换器适配得伟电动工具电池使用，将电动工具电池和放电转换器组装起来，即可组成移动电源和
拆解报告：MOMA猛玛LARK M2无线麦克风 MOMA猛玛LARK M2无线麦克风在外观方面，采用了极富创新的设计，提供了轻盈舒适的佩戴使用体验。发射器采用了夹
阿根廷2024年：销量下滑，北汽增长240.1%。 2024年阿根廷汽车市场在整体销量下滑的背景下，依然展现出多元化的发展趋势···
2025年第3周：全球最快四足机器人发布 2025年将成为机器人产业的关键时间点，业内预期27年人形机器人出货量可达50~100万台。从技术进步到供应链成熟
欧洲2024年汽车市场：微弱复苏和电动化加速并存 2024年，欧盟新车注册量小幅增长0.8%，达到约1060万辆，欧盟+英国+北欧国家的销量为1296.4万台，同比增长0.9%，整个欧
射频微波领域有哪些高质量期刊？今天我们结合网络上的资料一起整理一份射频微波领域的期刊列表，以便同学们投稿时可以选择···
拆解报告：Portal智能屏幕24W电源适配器 Portal智能屏幕电源适配器采用黑色直板机身，外观整洁，配有2米长黑色输出线。适配器采用美规固定插脚，支持100-2

性能飞跃！升级电流传感器NSM201x-P系列赋能汽车三电和光伏逆变器纳芯微推出全新车规级集成电流路径霍尔传感器NSM201x-P系列。该系列产品是对纳芯微已量产的NSM201x系列的完
意法半导体推出STSPIN32G0新列电机驱动器，满足工业自动化和家电市意法半导体STSPIN32系列集成化电机驱动器新增八款产品，满足电动工具、家用电器、工业自动化等应用的低成本、
Melexis推出性能先进的温度传感器，以红外技术创新实现电磁炉智能全球微电子工程公司Melexis宣布，推出专为电磁炉设计的非接触式红外温度传感器芯片MLX90617···
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC模块基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
为汽车安全保驾护航，纳芯微推出基于AMR技术的ABS轮速传感器纳芯微宣布推出全新基于AMR（各向异性磁阻技术）的轮速传感器NSM41xx系列。该系列产品通过集成先进的磁性传感敏
Microchip推出全新Switchtec™ PCIe® 4.0 16通道交换机系列 PCI100x系列器件可为任何需要加速或专用计算的应用提供高性能和成本效益···
RK3576有多强？实测三屏八摄像头轻松搞定-米尔米尔基于他们推出的MYD-LR3576开发板开发了一个3屏异显，8路摄像头输入的DEMO，实测下来，RK3576轻松搞定了该任
SynQor®推荐先进的军用级三相输入UPS（UPS-1500-S-1U-T） SynQor的三相输入UPS电源能使单相负载在电源端呈现出符合MIL-STD-1399-300B标准的清洁、表现良好且几乎零反
村田开发超小尺寸、超低功耗的Type 2GQ GNSS模块，以匠心品质助在几年前，定位系统充斥于生活方方面面的情节还仅见于各式的科幻影片，而今具备这一功能的产品已经以各种形态步
瑞萨推出性能卓越的新型MOSFET 瑞萨全新晶圆技术可以帮助MOSFET实现导通电阻降低30%、栅漏电荷减少40%、封装尺寸缩小50%的目标···
加特兰集成 Cadence Tensilica ConnX 220 DSP 全面升级汽 ConnX 220 DSP 集成至基于下一代 Andes SoC 的加特兰雷达解决方案后，将带来显著优势，包括提高灵活性、

热门评论
最新评论

换一换

杂志声明

利用音频边缘处理器实现感知情境的音频体验

日益增加的音频和语音复杂性需要新技术

何为情境感知？

为什么要使用专用音频边缘处理器？

专用音频边缘处理器需满足哪些特性？

结论