比GPT-3参数量高出三倍多，谷歌发布史上最大“通才”AI模型-EDN 电子技术设计

 3月7日，在接连推出AI聊天机器人Bard、发布通用语音模型(USM)API与研究成果之后，谷歌和柏林工业大学的团队重磅推出了史上最大的视觉语言模型——PaLM-E，参数量高达5620亿(GPT-3的参数量为1750亿)。

3月7日，在接连推出AI聊天机器人Bard、发布通用语音模型(USM)API与研究成果之后，谷歌和柏林工业大学的团队重磅推出了史上最大的视觉语言模型——PaLM-E，参数量高达5620亿(GPT-3的参数量为1750亿)。fbhednc

在市场形势利好的背景下，全球机器人的基础技术和前沿技术也在不断进步。小型机器人看重MCU的成本与功耗，通用型机器人看重MCU精准的电机控制，高端机器人更需要MCU兼顾算力与拓展性，MCU作为机器人核心主控芯片中的第一大类别，必将受惠于机器人市场的快速增长。fbhednc

3月30日，AspenCore将在上海举办国际集成电路展览会暨研讨会（IIC Shanghai 2023），同期举办的“MCU技术与应用论坛”邀请到国内外多家优秀MCU设计和系统方案商，欢迎感兴趣的朋友到场交流，大家可以点击这里报名参会。fbhednc

fbhednc

PaLM-E的应用示意。fbhednc

PaLM-E是PaLM-540B语言模型与ViT-22B视觉Transformer模型的结合体，也是迄今为止已知的最大VLM(视觉语言模型)。它主要基于谷歌现有的PaLM大语言模型，并添加了感官信息和机器人控制。PaLM-E会将图像信息、传感器数据等编码为一系列与语言标记大小相同的向量，从而以与处理语言相同的方式“理解”感官信息。换言之，PaLM-E证明了，在视觉、文本等多模态输入下，大型语言模型也可作出具体决策，并执行复杂任务。fbhednc

作为一种多模态具身VLM，它不仅可以理解图像，还能理解、生成语言，执行各种复杂的机器人指令而无需重新训练。它还展示出了强大的涌现能力(模型有不可预测的表现)，如具备多模态思维链推理(允许模型分析包括语言和视觉信息的一系列输入)、只接受单图像提示训练的多图像推理(使用多个图像作为输入来做出推理或预测)等。fbhednc

据谷歌介绍，当得到一个高级命令，如“把抽屉里的薯片拿给我”，PaLM-E可以为带有手臂的移动机器人平台生成一个行动计划，并自行执行这些行动。而这一过程无需对场景进行预处理，PaLM-E可以通过分析来自机器人相机的数据来实现这一点。这消除了人类预处理或注释数据的需要，并可实现更为自主的机器人控制。fbhednc

而更重要的一点是它的行动计划还具有弹性，可以对环境做出反应。例如，在谷歌的演示视频中，研究人员从机器人手中抓取薯片并移动它们，但机器人找到薯片并再次抓取它们。PaLM-E模型不但可以引导机器人从厨房取薯片袋，而且通过将PaLM-E集成到控制回路中，它可以抵抗任务期间可能发生的中断。fbhednc

fbhednc

机器人抓取薯片过程fbhednc

除此之外，PaLM-E也是一种“有效的视觉语言模型”，不但可以识别分析图象，还可以针对带有手写数字的图像，执行数学运算。例如，它可以识别图中的篮球明星科比·布莱恩特，并可以生成关于他的文本信息，比如他赢得了多少次冠军。或者根据手写的餐馆菜单图片，PaLM-E可直接算出2份披萨的价钱。fbhednc

fbhednc

更加令人振奋的是，得益于PaLM-E的大型语言模型核心，PaLM-E表现出了“正迁移”能力，即可以将一项任务中学到的知识和技能迁移到另一项任务中，从而与单任务机器人模型相比具有“显着更高的性能”。fbhednc

fbhednc

还有一点非常值得关注，灾难性遗忘常常是预学习模型必须面对的一大挑战，即当一个训练好的模型被进一步训练时，现有任务性能便将显著下降。在本次研究中研究人员观察到：“语言模型越大，在视觉语言和机器人任务训练时就越能保持其语言能力——从数量上讲，562B PaLM-E模型几乎保留了其所有的语言能力。”同时，他们也证明了冻结语言模型是通向完全保留其语言能力的通用具身多模态模型的可行之路。fbhednc

谷歌研究人员计划在未来将探索PaLM-E在现实世界中有更多应用，例如家庭自动化或工业机器人，也希望PaLM-E能够激发更多关于多模态AI的应用。fbhednc

在市场形势利好的背景下，全球机器人的基础技术和前沿技术也在不断进步。小型机器人看重MCU的成本与功耗，通用型机器人看重MCU精准的电机控制，高端机器人更需要MCU兼顾算力与拓展性，MCU作为机器人核心主控芯片中的第一大类别，必将受惠于机器人市场的快速增长。fbhednc

3月30日，AspenCore将在上海举办国际集成电路展览会暨研讨会（IIC Shanghai 2023），同期举办的“MCU技术与应用论坛”邀请到国内外多家优秀MCU设计和系统方案商，欢迎感兴趣的朋友到场交流，大家可以点击这里或扫码报名参会。fbhednc

fbhednc

责编：Ricardo

阅读全文，请先

无人机/机器人嵌入式系统安全与可靠性测试与测量人机交互操作系统模拟/混合信号/RF 通信传感器/MEMS 工业电子汽车电子智能硬件医疗电子消费电子人工智能新品技术实例产业前沿 EDN原创

上一篇： 曦智研究院发布光电混合计算系列白皮书，以大规模光电集成构建算力网络新范式 下一篇： 荣耀射频增强芯片猜想

微信扫一扫
一键转发
最前沿的电子设计资讯
请关注“电子技术设计微信公众号”

全自动手术机器人出现，缝合速度比医生还快30%？美国约翰霍普金斯大学和斯坦福大学的联合团队创造了一项前所未有的突破，他们首次对机器人进行了训练，使其能够像人类医生一样熟练地执行相同的手术程序···
打造下一代家用机器人：精心构建智能化、集成化和电源优今天的家用机器人不仅仅是工具，它们已经成为人们的生活伙伴，为日常生活增添了便利性和互动性。设计这些结构紧凑、功能强大的机器需要克服连接性、电源和外形尺寸等方面的严峻挑战，每一次突破都使我们更接近全面集成的智能家居体验···
美国无人机监管政策收严，为了远程ID广播我不得不这样做无论您是否以娱乐性为目的飞行，您通常都需要注册您的无人机，您将收到一个ID号，然后需要将其打印出来并贴在无人机的可见位置。而且，从2023年9月中旬开始，每架无人机还需要支持该ID的广播···
无需电力即可操控的机器人你见过吗？最近，伦敦国王学院的研究团队取得了一项突破性进展，他们开发了一种无需电力即可向机器人发出复杂指令的新方法···
你见过蘑菇机器人吗？用真菌菌丝充当机器人的“大脑” 最近，康奈尔大学的研究团队利用真菌菌丝体开发了一种新型“生物混合”机器人，这项研究发表在《科学机器人》杂志上，展示了如何通过菌丝体的电信号控制机器人，使其能够更好地响应环境变化···
FarmBot能全自动种植蔬菜的机器人，靠种菜六个月就能回 FarmBot是一个可以在任意指定区域种植蔬菜的全能机器人，它最大的亮点就是无需人工管理，便可全自动完成播种、浇水、除草等种植工作···
56g的无人机自动导航100m只需1.16kB数据，蚂蚁立大功？最近荷兰代尔夫特理工大学（TU Delft）的研究团队从蚂蚁等昆虫的导航模式中获得了灵感，发明了一种新型的微型机器人自动导航方式···
可用于月球探索的跳跃机器人，怎么做到一跳40层楼高的？最近，英国曼彻斯特大学的研究团队找到了一种方法，可以让机器人跳跃超过120米，也就是40层楼左右···
什么是“蜗牛”机器人？靠水移动，甚至能倒挂在天花板上英国布里斯托大学机器人实验室的研究团队受到蜗牛特性的启发，提出了一种名为“滑动吸力”的机构，并开发出了一款滑动能力可以与蜗牛相媲美的机器人，这款机器人能够使用单个吸盘攀爬陡峭表面，甚至倒挂在天花板上···
未来的机器人也许要用活体肌肉组织提供动力最近，在《高级智能系统》上发表的一篇论文中，麻省理工学院的研究团队展示了他们如何将活体肌肉组织集成到机器人的设计中，为开发下一代生物混合机器人的稳健、可重复和预测性设计及制造奠定了基础···
多核一芯、一芯多系统！机器人主控选米尔D9350核心板芯驰D9350这款国产多核异构SoC，正适合应用到机器人场景，米尔作为嵌入式处理器模组厂商，也推出了基于芯驰D9350的核心板和开发板，助力开发者赋能智能机器人应用。
特斯拉展示2代Optimus，明年机器人或许就能穿针引线？最近，特斯拉悄然在YouTube上发布了其最新一代人形机器人Optimus Gen 2的演示视频，展示了这款机器人的全新改进和功能···

机器人所需要的传感器有哪些？随着机器人技术的迭代升级，传感器的重要性将持续提升，其功能性、精度和适配性也将得到显著改进，作为机器人不可
2024年墨西哥市场分析，中国品牌崛起 2024年，墨西哥汽车市场以近10%的增长率展现了强劲的复苏势头，中国品牌的崛起为市场注入了新活力，当然现在的政
2025，大众汽车集团在中国如何转型？ 2024 年，大众汽车集团（中国）在复杂多变的市场环境中成功达成销量目标，向客户交付超过 290 万辆汽车，新能源汽车领
国产射频芯片公司汇总对于射频芯片这项卡脖子技术，国内很多公司在这方面努力，而且也做出了不错的成绩。一些射频芯片公司无论从研发
拆解报告：松下电器1200W电吹风松下EH-NW90电吹风内置10万转高速无刷电机，并具备三档风速和四档风温可选。电吹风内置纳诺怡技术，为秀发提供
拆解报告：白牌电动工具电池多功能放电转换器这款白牌多功能放电转换器适配得伟电动工具电池使用，将电动工具电池和放电转换器组装起来，即可组成移动电源和
拆解报告：MOMA猛玛LARK M2无线麦克风 MOMA猛玛LARK M2无线麦克风在外观方面，采用了极富创新的设计，提供了轻盈舒适的佩戴使用体验。发射器采用了夹
阿根廷2024年：销量下滑，北汽增长240.1%。 2024年阿根廷汽车市场在整体销量下滑的背景下，依然展现出多元化的发展趋势···
2025年第3周：全球最快四足机器人发布 2025年将成为机器人产业的关键时间点，业内预期27年人形机器人出货量可达50~100万台。从技术进步到供应链成熟
欧洲2024年汽车市场：微弱复苏和电动化加速并存 2024年，欧盟新车注册量小幅增长0.8%，达到约1060万辆，欧盟+英国+北欧国家的销量为1296.4万台，同比增长0.9%，整个欧
射频微波领域有哪些高质量期刊？今天我们结合网络上的资料一起整理一份射频微波领域的期刊列表，以便同学们投稿时可以选择···
拆解报告：Portal智能屏幕24W电源适配器 Portal智能屏幕电源适配器采用黑色直板机身，外观整洁，配有2米长黑色输出线。适配器采用美规固定插脚，支持100-2

性能飞跃！升级电流传感器NSM201x-P系列赋能汽车三电和光伏逆变器纳芯微推出全新车规级集成电流路径霍尔传感器NSM201x-P系列。该系列产品是对纳芯微已量产的NSM201x系列的完
意法半导体推出STSPIN32G0新列电机驱动器，满足工业自动化和家电市意法半导体STSPIN32系列集成化电机驱动器新增八款产品，满足电动工具、家用电器、工业自动化等应用的低成本、
Melexis推出性能先进的温度传感器，以红外技术创新实现电磁炉智能全球微电子工程公司Melexis宣布，推出专为电磁炉设计的非接触式红外温度传感器芯片MLX90617···
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC模块基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
为汽车安全保驾护航，纳芯微推出基于AMR技术的ABS轮速传感器纳芯微宣布推出全新基于AMR（各向异性磁阻技术）的轮速传感器NSM41xx系列。该系列产品通过集成先进的磁性传感敏
Microchip推出全新Switchtec™ PCIe® 4.0 16通道交换机系列 PCI100x系列器件可为任何需要加速或专用计算的应用提供高性能和成本效益···
RK3576有多强？实测三屏八摄像头轻松搞定-米尔米尔基于他们推出的MYD-LR3576开发板开发了一个3屏异显，8路摄像头输入的DEMO，实测下来，RK3576轻松搞定了该任
SynQor®推荐先进的军用级三相输入UPS（UPS-1500-S-1U-T） SynQor的三相输入UPS电源能使单相负载在电源端呈现出符合MIL-STD-1399-300B标准的清洁、表现良好且几乎零反
村田开发超小尺寸、超低功耗的Type 2GQ GNSS模块，以匠心品质助在几年前，定位系统充斥于生活方方面面的情节还仅见于各式的科幻影片，而今具备这一功能的产品已经以各种形态步
瑞萨推出性能卓越的新型MOSFET 瑞萨全新晶圆技术可以帮助MOSFET实现导通电阻降低30%、栅漏电荷减少40%、封装尺寸缩小50%的目标···
加特兰集成 Cadence Tensilica ConnX 220 DSP 全面升级汽 ConnX 220 DSP 集成至基于下一代 Andes SoC 的加特兰雷达解决方案后，将带来显著优势，包括提高灵活性、

热门评论
最新评论

换一换

杂志声明

比GPT-3参数量高出三倍多，谷歌发布史上最大“通才”AI模型