AI推动着存储器互连的不断演进-EDN 电子技术设计

 为了满足人工智能（AI）和机器学习应用的需求，位置这个词被越来越多地应用于数据存储。但解决这种位置的挑战不只是存储器供应商应做的工作，与AI相关的供应商也扮演着重要角色。尽管存储距离计算越来越近，但解决方案的很大一部分在于存储互连。

位置、位置、位置，这并不只是房地产界的核心词。为了满足人工智能（AI）和机器学习应用的需求，这个词被越来越多地应用于数据存储，如数据存储的位置以及存放数据的存储器。CsLednc

但解决这种位置的挑战不只是存储器供应商应做的工作，与AI相关的供应商也扮演着重要角色。尽管存储距离计算越来越近，但解决方案的很大一部分在于存储互连。Rambus研究员Steve Woo最近在AI硬件峰会上主持了一次在线圆桌论坛，讨论了存储器互连的挑战和解决方案，他说：“我们都在为AI的不同方面而工作。”CsLednc

Marvell的ASIC事业部CTO Igor Arsovski在17年前曾经做过SRAM设计工程师。他说，慕尼黑啤酒节（Oktoberfest）因为新冠肺炎疫情取消了，而把存储互连比做啤酒很合适。参加啤酒节，可以很容易喝到啤酒。“而SRAM就好像近在身边的啤酒一样。它随手可得，不需要耗费多少能量，而且只要您需要，它就在那儿，就像拥有一个不错的高性能加速器。”但是，如果没有足够的存储空间，就需要走远一点，同时也需要花费更多能量来获取它，就好像必须走更远才能买到大桶啤酒一样。CsLednc

Arsovski 说，对存储器而言，大桶啤酒就好像高带宽存储器（HBM），它正越来越多地被AI所采用。“访问这种存储器需要花费约60倍的能量。那里容量虽然大得多，但访问它的带宽却很少。”将啤酒类比扩展到LPDDR之类的技术，这种技术比SRAM更先进。他说：“LPDDR功耗明显更高，但容量更大。这就像沿着那条路走到您最喜爱的酒吧，在那里有几桶啤酒等着您。”CsLednc

Arsovski表示，下一代加速器的发展方向是将那些存储器放在加速器正上方，让存储离计算更近。MLCommons执行董事David Kanter补充说，这个啤酒类比概述了不同的封装途径以及在何处安放不同的硅片。MLCommons是一个提供机器学习标准和AI推理基准的组织，其成员涵盖学术界和工业界。他说道：“这使我们对不同的工作负载有非常全面的了解。MLCommons正在开始采取一些措施，其中重点之一就是建立咨询委员会，以吸收特定应用领域的一些资深专家。”CsLednc

Kanter说，对存储器而言，整个系统环境至关重要。“您必须考虑系统要实现什么，这将决定要考虑的问题。”他说，当涉及到存储器的位置和连接时，芯片、封装和电路板都是必须考虑的要素。“在阵列结构、单元类型以及距离方面，有很多地方可以优化。”CsLednc

Kanter说，明白哪里需要带宽以及非易失性也是关键的考量因素。“希望这将引导做出正确的选择。”CsLednc

对于那些传统上并不属于存储系统构建流程的公司而言，这些考量因素至关重要。Google软件工程师Sameer Kumar花费大量时间在编译器和可扩展系统上，这些系统的网络和存储带宽对不同的机器学习模型非常重要，包括其大规模批量操作的能力。他说：“人工智能训练涉及许多存储方面的优化，”这是在编译器中获得极高效率的最关键步骤，它意味着存储也需要更加智能。CsLednc

Woo认为，数据移动实际上已经开始主宰AI应用的某些阶段，所以存储互连变得越来越重要。“性能和能效成为日益重要的问题”，提高数据速率极具挑战性，因为所有人都希望将数据移动速度加倍，能效也加倍。“我们以前所依赖的许多技巧和技术都已不再适用，或者正在被慢慢淘汰。我们有极好的机会来思考新的体系架构，并在移动数据的方式上进行创新。”CsLednc

Woo表示，创新不仅在存储器件本身上，而且还包括封装，以及堆叠等新技术。在创新的同时，还要确保数据的安全性，这是Rambus目前越来越关注的。CsLednc

Rambus感受到业界对3D堆栈的极大兴趣，但如果带宽不随堆栈容量增加而相应增加的话，其可用性会受到限制。（图片来源：Rambus）CsLednc

Arsovski表示，Marvell花费了大量时间为客户建立AI系统，为客户提供带宽相关信息，如每个芯片边缘有多少带宽可以用于数据移动，以及有多少带宽可以用于访问存储器。他说：“到目前为止，我们已经可以看到，客户需要更多的存储带宽和更多的I / O带宽。如果看看封装级别的互连，可以看到存在很大的不匹配。我们现在已经到达瓶颈，高端芯片-芯片连接的需求压力持续增大。”CsLednc

Arsovski表示，从存储器的角度来看，对于那些无法在裸片上直接构建AI模型的设计师来说，其下一步考虑应该是HBM或GDDR。但是也有很多转而采用3D堆叠，以尝试获得更大的带宽，因为在芯片边缘移动数据的容量有限。“客户希望得到越来越多的I/O带宽，而我们在边缘数据移动上遇到了瓶颈。”CsLednc

Kanter说，即使在机器学习的世界中，也存在着“很大的多样性”，这对生态系统既有制约，也有促进，记住这一点很重要。对于常规DRAM来说，随机查找庞大的数据结构不适合单个节点，这意味着如果您想将数据真正保存在存储器中，则需要构建一个非常大的系统集群。他说：“与传统的面向视觉的模型相比，其特征和属性完全不同。在存储方面要牢记这一多样性，这一点非常重要。”CsLednc

Kanter说，当需要将大量存储和计算整合在一起时，就需要互连了。“要进行大规模训练，迫切需要既适合客户又适合要解决问题的互连方案。”他说，对于前沿应用来说，互连将特别重要。“如果您只想为一个小型网络训练一个GPU，那么关键因素可能就是存储带宽。”CsLednc

Kumar说，更多的存储带宽可以实现不同种类的优化，但是如果模型特别受存储限制，就有必要引入更多的计算。“如果有更多的存储吞吐量可用，甚至有更多的互连吞吐量可用，将可能会使模型设计更加灵活，而且可以启用新功能，并一起构建各种类型的模型。”CsLednc

Woo表示，Rambus感受到大家对3D堆栈兴趣浓厚，但随着堆栈越来越高，增加进出堆栈的带宽也变得越来越困难。“如果只是增加堆栈容量，但没有增加相应的带宽，那方案的实用性就成问题了。”CsLednc

他说，关键点在于寻找合适的方案，既能保持填充频率，又能利用堆叠能效方面的优势，从而使带宽与容量和堆叠之间具有相对恒定的比率。CsLednc

Kumar和Arsovski都认为需要一个平衡、可扩展的系统，这种系统具有精心设计的软件堆栈。 Arsovski说，“我们所说的是一种可以良好扩展的类脑结构。”它必须低功耗且具有大量连接，而现在，3D堆叠是我们能做到最接近的结构，但仍然存在功耗、封装和机械结构方面的挑战。 “我们需要研究出一个高度并行的系统，其每个层级的功耗都极低，而不必担心要为冷却耗费数千瓦的功率。”CsLednc

他说，是时候开始寻找适合AI系统的下一个基本构建模块了。“一直以来，我们都采用晶体管作为基本单元，迄今为止，它们都发挥出色。我们通常会依赖我们所知道和喜爱的技术，并且希望它持续发展。但现在我们需要重头开始设计了。”CsLednc

(参考原文: AI Drives Memory Interconnect Evolution)CsLednc

责编：Amy GuanCsLednc

阅读全文，请先

Gary Hilson

EE Times特约编辑。Gary Hilson是一位自由撰稿人和编辑，曾为北美地区的印刷和电子出版物撰写过大量稿件。他感兴趣的领域包括软件、企业级和网络技术、基础研究和教育市场，以及可持续交通系统和社会新闻。他的文章发表于Network Computing，InformationWeek，Computing Canada，Computer Dealer News，Toronto Business Times，Strategy Magazine和Ottawa Citizen。

进入专栏

人工智能缓存/存储技术产业前沿

上一篇： 三星的6亿像素传感器计划及ISOCELL技术 下一篇： IoT设备安全性设计的八项原则

微信扫一扫
一键转发
最前沿的电子设计资讯
请关注“电子技术设计微信公众号”

创新的FPGA技术实现低功耗、模块化、小尺寸USB解决方本文总结了业界用于高性能 USB 3 设备的一些典型解决方案，并介绍了一种新的架构，这种架构既能节省功耗和面积，又能提高灵活性和易用性···
盘点CES 2025上基于Arm架构的AI创新和技术亮点近期在美国拉斯维加斯举行的 CES 2025 再次彰显了其作为展示最新科技创新的重要平台。今年展会上所呈现的众多前沿产品和新的发布将推动各个行业的变革与发展···
芯耀辉：从传统IP到IP2.0，AI时代国产IP机遇与挑战齐飞 2024年，集成电路行业在变革与机遇中持续发展。面对全球经济的新常态、技术创新的加速以及市场需求的不断变化，集成电路企业如何在新的一年里保持竞争力并实现可持续发展？
Arm 技术预测：2025 年及未来的技术趋势 Arm 对 2025 年及未来的技术发展做出了预测，范围涵盖技术的各个方面，从 AI 的未来发展到芯片设计，再到不同技术市场的主要趋势···
该如何设计PCB以保证恶劣环境下的信号完整性在现代电子设计中，保持PCB信号完整性是一项越来越具有挑战性的任务···
CES 2025：洞察汽车创新未来从CES 2025的汽车方案展示可以看到，汽车OEM正从黑盒解决方案转变为区域架构为主的处理主干，传感器功能也逐渐优化，结合多模态输入数据与情境感知的 ML...
CES 2025：Edge AI硬件加速再掀热潮边缘计算/边缘人工智能(Edge AI)一直是热门话题，在CES 2025也不例外。然而，实现边缘计算/智能的底层硬件是什么？又是如何实现与应用的呢？
英伟达50系列显卡发布，RTX 5090D近乎“零提升”？ 1月6日的CES展会上，英伟达正式发布了备受期待的RTX 50系列显卡···
全自动手术机器人出现，缝合速度比医生还快30%？美国约翰霍普金斯大学和斯坦福大学的联合团队创造了一项前所未有的突破，他们首次对机器人进行了训练，使其能够像人类医生一样熟练地执行相同的手术程序···
2024是AI MCU元年？ 2024年开启了MCU领域的AI时代，2025年可望见证更多轻量化AI模型在MCU上的进一步突破...
探索工业应用中边缘连接的未来我们的世界正变得更加智能且紧密相连，楼宇和工厂正以前所未有的方式实现自动化。为了确保这些新系统有效运行，可靠的信息通信至关重要···
其实CPU才是最适合AI推理的？因为这五大理由本文将具体介绍CPU成为AI推理工作负载最佳目标的五大理由···

机器人所需要的传感器有哪些？随着机器人技术的迭代升级，传感器的重要性将持续提升，其功能性、精度和适配性也将得到显著改进，作为机器人不可
2024年墨西哥市场分析，中国品牌崛起 2024年，墨西哥汽车市场以近10%的增长率展现了强劲的复苏势头，中国品牌的崛起为市场注入了新活力，当然现在的政
2025，大众汽车集团在中国如何转型？ 2024 年，大众汽车集团（中国）在复杂多变的市场环境中成功达成销量目标，向客户交付超过 290 万辆汽车，新能源汽车领
国产射频芯片公司汇总对于射频芯片这项卡脖子技术，国内很多公司在这方面努力，而且也做出了不错的成绩。一些射频芯片公司无论从研发
拆解报告：松下电器1200W电吹风松下EH-NW90电吹风内置10万转高速无刷电机，并具备三档风速和四档风温可选。电吹风内置纳诺怡技术，为秀发提供
拆解报告：白牌电动工具电池多功能放电转换器这款白牌多功能放电转换器适配得伟电动工具电池使用，将电动工具电池和放电转换器组装起来，即可组成移动电源和
拆解报告：MOMA猛玛LARK M2无线麦克风 MOMA猛玛LARK M2无线麦克风在外观方面，采用了极富创新的设计，提供了轻盈舒适的佩戴使用体验。发射器采用了夹
阿根廷2024年：销量下滑，北汽增长240.1%。 2024年阿根廷汽车市场在整体销量下滑的背景下，依然展现出多元化的发展趋势···
2025年第3周：全球最快四足机器人发布 2025年将成为机器人产业的关键时间点，业内预期27年人形机器人出货量可达50~100万台。从技术进步到供应链成熟
欧洲2024年汽车市场：微弱复苏和电动化加速并存 2024年，欧盟新车注册量小幅增长0.8%，达到约1060万辆，欧盟+英国+北欧国家的销量为1296.4万台，同比增长0.9%，整个欧
射频微波领域有哪些高质量期刊？今天我们结合网络上的资料一起整理一份射频微波领域的期刊列表，以便同学们投稿时可以选择···
拆解报告：Portal智能屏幕24W电源适配器 Portal智能屏幕电源适配器采用黑色直板机身，外观整洁，配有2米长黑色输出线。适配器采用美规固定插脚，支持100-2

性能飞跃！升级电流传感器NSM201x-P系列赋能汽车三电和光伏逆变器纳芯微推出全新车规级集成电流路径霍尔传感器NSM201x-P系列。该系列产品是对纳芯微已量产的NSM201x系列的完
意法半导体推出STSPIN32G0新列电机驱动器，满足工业自动化和家电市意法半导体STSPIN32系列集成化电机驱动器新增八款产品，满足电动工具、家用电器、工业自动化等应用的低成本、
Melexis推出性能先进的温度传感器，以红外技术创新实现电磁炉智能全球微电子工程公司Melexis宣布，推出专为电磁炉设计的非接触式红外温度传感器芯片MLX90617···
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC模块基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
为汽车安全保驾护航，纳芯微推出基于AMR技术的ABS轮速传感器纳芯微宣布推出全新基于AMR（各向异性磁阻技术）的轮速传感器NSM41xx系列。该系列产品通过集成先进的磁性传感敏
Microchip推出全新Switchtec™ PCIe® 4.0 16通道交换机系列 PCI100x系列器件可为任何需要加速或专用计算的应用提供高性能和成本效益···
RK3576有多强？实测三屏八摄像头轻松搞定-米尔米尔基于他们推出的MYD-LR3576开发板开发了一个3屏异显，8路摄像头输入的DEMO，实测下来，RK3576轻松搞定了该任
SynQor®推荐先进的军用级三相输入UPS（UPS-1500-S-1U-T） SynQor的三相输入UPS电源能使单相负载在电源端呈现出符合MIL-STD-1399-300B标准的清洁、表现良好且几乎零反
村田开发超小尺寸、超低功耗的Type 2GQ GNSS模块，以匠心品质助在几年前，定位系统充斥于生活方方面面的情节还仅见于各式的科幻影片，而今具备这一功能的产品已经以各种形态步
瑞萨推出性能卓越的新型MOSFET 瑞萨全新晶圆技术可以帮助MOSFET实现导通电阻降低30%、栅漏电荷减少40%、封装尺寸缩小50%的目标···
加特兰集成 Cadence Tensilica ConnX 220 DSP 全面升级汽 ConnX 220 DSP 集成至基于下一代 Andes SoC 的加特兰雷达解决方案后，将带来显著优势，包括提高灵活性、

热门评论
最新评论

换一换

杂志声明

AI推动着存储器互连的不断演进