NVIDIA：超级算力，赋能整车中央计算-EDN 电子技术设计

 由全球电子技术领域知名媒体集团AspenCore主办的“中国国际汽车电子高峰论坛”于2023年2月23日正式拉开帷幕。会上，NVIDIA中国区软件解决方案总监卓睿分享了题为“超级算力，赋能整车中央计算”的主题演讲。

由全球电子技术领域知名媒体集团AspenCore主办的“中国国际汽车电子高峰论坛”于2023年2月23日正式拉开帷幕。会上，NVIDIA(英伟达)中国区软件解决方案总监卓睿分享了题为“超级算力，赋能整车中央计算”的主题演讲。6Tiednc

6Tiednc

在无人驾驶或者说整车域控制器的演变过程中，整车域控制器的数量在逐渐减少，随着大算力芯片的出现，用单独的ECU(电子控制单元，又称“行车电脑”)就可以处理从前需要多个ECU才能实现的功能，例如行泊一体，以前ADAS(车辆高级驾驶的辅助系统)功能和泊车功能需要单独的控制器进行控制，而今只需要一个控制器就可实现。随着大算力芯片时代的到来，也许在将来我们只需要一个或两个中央处理器就可以覆盖整车所需的大部分功能。6Tiednc

Orin芯片

如今Orin芯片正在被国内大部分的车厂、Tierl-1合作伙伴所使用，广泛应用在无人驾驶或者智能驾驶领域。跟前一代30TOPS算力的Xavier相比，Orin芯片拥有254TOPS的算力，算力提升了八倍多。对于车厂和Tierl-1来说算力更大的芯片可以让他们集成更多的功能降低各种成本，比如传感器成本、研发成本、OTA成本、BOM成本等。6Tiednc

6Tiednc

例如，如果需要实现驾驶员监控、停车、标准的ADAS、环视等多个功能，往往需要将4-5个ECU集成在一起，同时每个ECU还有不同的传感器，每个ECU还需要单独做OTA的升级。现在由于Orin拥有足够的算力，可以把所需的传感器全部接在Orin上，可以大大降低BOM的成本、功耗研发成本、OTA成本。可以说大算力的Orin芯片为域控制器带来了翻天覆地的改变。6Tiednc

6Tiednc

Orin在无人驾驶领域的成功不只是因为有254TOPS的算力，更是因为它是异构的处理器，有着非常平衡的算力均衡，比如有强大的CPU能力、GPU能力，还有其他针对CV算法处理的能力，因而可以为开发者或者OEM赋能，开发均衡且能满足现在L2、L2++需求的平台。6Tiednc

THOR芯片

THOR是一款性能十分强劲的芯片，有770亿颗晶体管，算力达到2000TOPS，且具有8位浮点(FP8)功能。目前Transformer(一种神经网络，通过跟踪序列数据中的关系来学习上下文并因此学习含义)在NLP(自然语言处理)非常流行，业界也把Transformer引入到了CV (计算机视觉)之中，THOR中的FP8格式主要就是为了支持Transformer。6Tiednc

6Tiednc

而除了标准的ADAS支持，THOR更多的是想支持中央处理大脑(CCC方案），英伟达通过MIT技术把GPU进行物理隔离，比如芯片有200TOPS算力，可以通过该技术将一部分给无人驾驶域做无人驾驶，另一部分给座舱域去做渲染。同时英伟达的软件也做了进一步的虚拟化，用NVlink接口连接两个芯片传输，该接口比P+1速度更快，性能更高。 6Tiednc

6Tiednc

当然仅仅只有芯片是没有办法实现量产的，不同的芯片厂商需要提供完善的软件解决方案，让开发者可以更容易的做开发工作。目前的Orin方案已经比较成熟，包括提供标准API访问硬件资源，支持不同的OS如LINUX、Android，功能安全、信息安全等方面也比较完善。6Tiednc

6Tiednc

而对于THOR的软件架构，因为英伟达的虚拟化和SOI做的比较完善，可以在芯片上运行自己的Hypervisor，因此可以对CPU，GPU或者其他IO进行虚拟化。在这基础上，如果针对CCC方案，THOR可以支持座舱部分使用Android，仪表部分支持LINUX或者QNX，无人驾驶部分也可以支持LINUX或者QNK，可选择不同的configure进行针对配置。6Tiednc

深度学习

对于深度学习领域，英伟达认为即使两家公司的产品拥有一样的TOPS，但并不意味着这两家公司的产品就拥有相同的性能，因为不同的架构会带来不同的作用。现在AI芯片有几大架构，GPU、ASIC、DSP。GPU是最灵活的，可以编程，DSP相对灵活一些。ASIC则完全固化。加之无人驾驶行业的算法还在不停的演进，之前传统的CNN算法如果跟现在的Transformer比已经落后了，算法在不停的迭代，所以一个可以编程的AI芯片在现阶段是非常有用的。6Tiednc

6Tiednc

AI芯片的可编程，一方面是要可以编程，另一方面是要确定用什么样的接口进行编程。英伟达从2006年开始开发了CUDA SDK，无论是DGPU、大卡，还是Orin芯片，CUDA的接口基本上是一致的，所以熟悉CUDA的开发人员可以很容易的在英伟达嵌入式平台上进行开发。6Tiednc

6Tiednc

CUDA作为一个对GPU底层的SDK接口，不论是Transformer还是传统的CNN算法，这些大模型通过CUDA都可以很容易的传输到平台上面。从性能的角度出发，从内存使用的角度来看，对于嵌入式，Framework更多的是做训练，在这上面可以支持不同的训练平台，而这些都可以非常容易的在英伟达平台落地。6Tiednc

6Tiednc

最后卓睿表示，相较于算力，实际性能更具有说服力。英伟达具有多种SDK包括编译器，除了深度学习相关的SDK以外，英伟达还有NVmedia，此外不管是要搭建pipeline，还是要获取数据，或者需要跨线程、跨进程、跨VM之间的数据传输，英伟达提供了一系列生态的SDK，可以做到非常快速的迁移。6Tiednc

责编：Ricardo

本文为电子技术设计原创文章，未经授权禁止转载。请尊重知识产权，违者本司保留追究责任的权利。

阅读全文，请先

谢宇恒

原机加工行业工程师，现Aspencore编辑，专注电子，关注未来。

进入专栏

上一篇： 提升自主可控能力，保障产业供应安全——上汽集团汽车芯片国产化工作思考 下一篇： 新思科技报告：构建全面的软件物料清单是保卫软件供应链安全的最佳防御

微信扫一扫
一键转发
最前沿的电子设计资讯
请关注“电子技术设计微信公众号”

谷歌Willow芯片5分钟完成10亿亿亿年计算，突破量子纠错3 近日，谷歌宣布了其新一代量子处理器Willow的诞生，这款量子计算芯片采用105个量子比特的设计，完成了全球量子计算历史上一个难以企及的里程碑，让长达近30年的“量子纠错”难题成为过去···
天玑9400详解：AI时代，旗舰芯拿什么引领？联发科将最近刚刚发布的天玑9400称为旗舰5G“智能体AI芯片”——所谓的“智能体”究竟是什么意思？对手机又有什么价值？本文详细剖析了天玑9400的关键技术，来尝试一探究竟...
超英特尔12.5%？AMD锐龙9 9950X跑分48011功耗只有309W AMD的最新旗舰处理器锐龙9000系列也将在7月31日解禁上市，相关爆料显示AMD锐龙9 9950X 处理器在160W功耗的情况下性能就可以媲美英特尔的14900KS···
高通骁龙X Elite产品上市：跑分不敌苹果，兼容还有问题？前不久，首批搭载高通骁龙X Elite的笔记本产品陆续上市，那么这颗已经发布大半年的骁龙处理器在实际使用中的表现到底有没有宣传的那么强？
高通骁龙X笔记本实测结果曝光？成本低一半、续航长98% 根据相关消息的预测，搭载骁龙X系列处理器的PC预计将在2024年年中才会上市，而在最近有关于搭载该系列处理器的产品的更多细节被曝光出来···
Arm云服务器处理器测试排行，第一是中国的芯片新加坡国立大学的研究团队对市面上所有可用的Arm服务器处理器进行了测试，测试结果显示在超大规模云中处理数据库相关任务方面，2021年由阿里云开发的倚天710是当前速度最快的Arm服务器处理器···
高通又发骁龙X Plus芯片，要用AI PC挑战英特尔和苹果？ 4月24日，高通再次推出一款新的AI PC处理器平台——骁龙X Plus···
苹果M系列芯片被曝硬件架构漏洞，无法直接修复安全专家在苹果M系列芯片中发现了一个新的安全漏洞，使用该漏洞的攻击方式被命名为GoFetch，这种攻击方式使用的应用程序不需要root访问权限，只需要与macOS系统上安装的大多数第三方应用程序所需的相同用户权限，黑客就可窃取用户数据。
英特尔i9-14900KS超频至9117MHz，发布就打破4项世界纪录五年前英特尔发布了第一颗采用KS后缀的处理器酷睿i9-9900KS，虽然在10代和11代停更了两代，但之后基本保持了一年一颗的频率，也就是12代的酷睿i9-12900KS，以及后续13代的酷睿i9-13900KS，而今酷睿i9-14900KS也来了···
苹果最新MacBook Air“翻车”？M3处理器最高飙到114℃ 新款MacBook Air在运行3DMark Wild Life Extreme、CineBench 2024等测试项目时，M3处理器在测试中温度多次达到惊人的114℃，在CPU测试中即使降频后最高温度也有107℃，而机身最高达到了46℃···
骁龙8 Gen 4发布时间提前，高通或采用自研Nuvia架构？在2月举办的2024巴塞罗那世界移动通信大会（MWC 2024）上，高通高级副总裁兼首席营销官Don McGuire就宣布了2024年的骁龙峰会的举办时间，也就是今年10月，届时高通将发布旗舰产品骁龙8 Gen 4平台···
Meta展示3D芯片AR系统：双手跟踪比单手跟踪能耗还少40% 在2024年的IEEE国际固态电路会议(ISSCC)上，Meta展示了其AR系统上所使用的原型3D芯片，该芯片系统能够同时跟踪两只手，而所消耗的能量比单个芯片仅跟踪一只手的能量还要少40%，并且速度提高了40%···

机器人所需要的传感器有哪些？随着机器人技术的迭代升级，传感器的重要性将持续提升，其功能性、精度和适配性也将得到显著改进，作为机器人不可
2024年墨西哥市场分析，中国品牌崛起 2024年，墨西哥汽车市场以近10%的增长率展现了强劲的复苏势头，中国品牌的崛起为市场注入了新活力，当然现在的政
2025，大众汽车集团在中国如何转型？ 2024 年，大众汽车集团（中国）在复杂多变的市场环境中成功达成销量目标，向客户交付超过 290 万辆汽车，新能源汽车领
国产射频芯片公司汇总对于射频芯片这项卡脖子技术，国内很多公司在这方面努力，而且也做出了不错的成绩。一些射频芯片公司无论从研发
拆解报告：松下电器1200W电吹风松下EH-NW90电吹风内置10万转高速无刷电机，并具备三档风速和四档风温可选。电吹风内置纳诺怡技术，为秀发提供
拆解报告：白牌电动工具电池多功能放电转换器这款白牌多功能放电转换器适配得伟电动工具电池使用，将电动工具电池和放电转换器组装起来，即可组成移动电源和
拆解报告：MOMA猛玛LARK M2无线麦克风 MOMA猛玛LARK M2无线麦克风在外观方面，采用了极富创新的设计，提供了轻盈舒适的佩戴使用体验。发射器采用了夹
阿根廷2024年：销量下滑，北汽增长240.1%。 2024年阿根廷汽车市场在整体销量下滑的背景下，依然展现出多元化的发展趋势···
2025年第3周：全球最快四足机器人发布 2025年将成为机器人产业的关键时间点，业内预期27年人形机器人出货量可达50~100万台。从技术进步到供应链成熟
欧洲2024年汽车市场：微弱复苏和电动化加速并存 2024年，欧盟新车注册量小幅增长0.8%，达到约1060万辆，欧盟+英国+北欧国家的销量为1296.4万台，同比增长0.9%，整个欧
射频微波领域有哪些高质量期刊？今天我们结合网络上的资料一起整理一份射频微波领域的期刊列表，以便同学们投稿时可以选择···
拆解报告：Portal智能屏幕24W电源适配器 Portal智能屏幕电源适配器采用黑色直板机身，外观整洁，配有2米长黑色输出线。适配器采用美规固定插脚，支持100-2

性能飞跃！升级电流传感器NSM201x-P系列赋能汽车三电和光伏逆变器纳芯微推出全新车规级集成电流路径霍尔传感器NSM201x-P系列。该系列产品是对纳芯微已量产的NSM201x系列的完
意法半导体推出STSPIN32G0新列电机驱动器，满足工业自动化和家电市意法半导体STSPIN32系列集成化电机驱动器新增八款产品，满足电动工具、家用电器、工业自动化等应用的低成本、
Melexis推出性能先进的温度传感器，以红外技术创新实现电磁炉智能全球微电子工程公司Melexis宣布，推出专为电磁炉设计的非接触式红外温度传感器芯片MLX90617···
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC模块基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
为汽车安全保驾护航，纳芯微推出基于AMR技术的ABS轮速传感器纳芯微宣布推出全新基于AMR（各向异性磁阻技术）的轮速传感器NSM41xx系列。该系列产品通过集成先进的磁性传感敏
Microchip推出全新Switchtec™ PCIe® 4.0 16通道交换机系列 PCI100x系列器件可为任何需要加速或专用计算的应用提供高性能和成本效益···
RK3576有多强？实测三屏八摄像头轻松搞定-米尔米尔基于他们推出的MYD-LR3576开发板开发了一个3屏异显，8路摄像头输入的DEMO，实测下来，RK3576轻松搞定了该任
SynQor®推荐先进的军用级三相输入UPS（UPS-1500-S-1U-T） SynQor的三相输入UPS电源能使单相负载在电源端呈现出符合MIL-STD-1399-300B标准的清洁、表现良好且几乎零反
村田开发超小尺寸、超低功耗的Type 2GQ GNSS模块，以匠心品质助在几年前，定位系统充斥于生活方方面面的情节还仅见于各式的科幻影片，而今具备这一功能的产品已经以各种形态步
瑞萨推出性能卓越的新型MOSFET 瑞萨全新晶圆技术可以帮助MOSFET实现导通电阻降低30%、栅漏电荷减少40%、封装尺寸缩小50%的目标···
加特兰集成 Cadence Tensilica ConnX 220 DSP 全面升级汽 ConnX 220 DSP 集成至基于下一代 Andes SoC 的加特兰雷达解决方案后，将带来显著优势，包括提高灵活性、

热门评论
最新评论

换一换

杂志声明

NVIDIA：超级算力，赋能整车中央计算

Orin芯片

THOR芯片

深度学习