GPT-4终于上线，看看它到底有多聪明？-EDN 电子技术设计

 3月14日，ChatGPT的开发机构OpenAI正式发布其里程碑之作GPT-4。据介绍，GPT-4是一个多模态大模型（接受图像和文本输入，生成文本）。相比上一代的GPT-3，GPT-4可以更准确地解决难题，具有更广泛的常识和解决问题的能力。

3月14日，ChatGPT的开发机构OpenAI正式发布其里程碑之作GPT-4。据介绍，GPT-4是一个多模态大模型（接受图像和文本输入，生成文本）。相比上一代的GPT-3，GPT-4可以更准确地解决难题，具有更广泛的常识和解决问题的能力，能够处理超过25000个单词的文本，编写更大型的代码，允许长文内容创建、扩展对话以及文档搜索和分析等用例。此外，OpenAI还承诺GPT-4相比之前的模型，包括ChatGPT此前应用的GPT-3.5，将更加安全且具协调性。5vzednc

3月29日，Aspencore将在IIC Shanghai(2023国际集成电路展览会暨研讨会)同期举办第二届 “碳中和暨绿色能源”电子产业可持续发展高峰论坛，欢迎大家点击这里报名参会，共同探寻可持续发展新道路。5vzednc

5vzednc

无敌的考试机器

那GPT-4实际的表现到底有多强呢？简单来说光论考试已经与人类相当，甚至超过了不少普通人。根据OpenAI的评估，GPT-4已经能轻松通过美国的律师考试，且考进了前10%的排名。相比之下，它的上一代模型GPT-3.5倒数10%只能吊个车尾。5vzednc

除了律师考试，GPT-4还在美国大学入学测试SAT阅读写作中拿下710分、数学700分（满分800），虽然分数不高，但已经够上美国大学的录取水平。更重要的是，GPT-4能在大学的基础微积分课程中获得4的成绩（5分为满分），这证明了该模型已经掌握了高等数学大部分的概念。5vzednc

5vzednc

另外，GPT-4在不同语种上的能力表现：中文的准确度大概在80%左右，已经要优于GPT-3.5的英文表现了。因为许多现有的ML基准测试都是用英语编写的，为了初步了解GPT-4其他语言的能力，研究人员使用Azure翻译将MMLU基准（一套涵盖57个主题的14000个多项选择题）翻译成多种语言。在测试的 26 种语言的 24 种中，GPT-4 优于 GPT-3.5 和其他大语言模型（Chinchilla、PaLM）的英语语言性能：5vzednc

5vzednc

小编要失业了？

除了优秀的考试和语言能力，强大的识图能力和显著提高的回答准确性，以及文字输入长度限制的增加，也让GPT-4的文书处理变得更加简洁高效，大大扩展了GPT-4的实用性。有网友直接把整篇论文截图发给它，GPT-4可以按像素处理其中的文字和图片，并给出对整篇论文的总结摘要。5vzednc

5vzednc

当提供来自《纽约时报》的文章时，新的聊天机器人几乎每次都能对故事进行精确和准确的总结。如果在摘要中添加一个随机句子并询问机器人摘要是否不准确，它会指向那个被添加的句子。5vzednc

5vzednc

发布会直播上，OpenAI总裁Gregman还现场表演了一次GPT-4给代码修Bug，直接把1万字的程序文档粘贴给GPT-4，最后再附上出现的问题，就可以在几秒钟内得到解决办法。以目前GPT-4的速度来看，以后不光小编要失业，程序员也不远了。5vzednc

5vzednc

冷笑话收割机

以人类千奇百怪的笑点来说，其实大多数笑话都是很难其笑点原因的。而GPT-4的出现给爱讲冷笑话的朋友带来了福音，它已经可以轻松理解网友心照不宣的冷笑话，即便是表情包，它也能说个子丑寅卯来。比如下面的这张图，GPT-4可以按顺序描述出每一格的内容，并总结笑点：用巨大的过时VGA接口给小巧的现代智能手机充电。5vzednc

5vzednc

而除了分析笑点，GPT-4还能分析要点，它可以通过用户的简单需求直接生成代码，甚至网站。即便用户只是在餐巾纸上画了个简单界面，GPT-4都能直接搞出一个可运行的网站。5vzednc

5vzednc

仍有不足

根据OpenAI的内部测试，GPT-4仍有GPT-3.5的老毛病，就是胡言乱语。专业地讲，GPT-4仍会产生幻觉，生产错误答案，并出现推理错误。比如当被要求提供描述最新癌症研究的网站地址时，它有时会生成不存在的互联网地址。这一点也困扰着所有领先的聊天机器人，因为系统不了解什么是真什么是假，它们可能会生成完全错误的文本。5vzednc

另一方面，GPT-4仍缺乏对数据截至日期后新进展的了解能力，即其无法在训练学习后，追踪新的信息来补足对某件事认知。比如当问及NLP（自然语言处理）中需要解决的重要问题是什么？未来十年的研究？它无法提出全新的想法。此外，它也无法从经验中学习，并可能一直轻信人类。5vzednc

3月29日，Aspencore将在IIC Shanghai(2023国际集成电路展览会暨研讨会)同期举办第二届 “碳中和暨绿色能源”电子产业可持续发展高峰论坛，欢迎大家点击这里或扫码报名参会，共同探寻可持续发展新道路。5vzednc

5vzednc

责编：Ricardo

阅读全文，请先

人工智能安全与可靠性人机交互通信物联网无人机/机器人新品技术实例产业前沿历史上的今天 EDN原创

上一篇： 一种高性能半导体材料可以帮助减少热量排放 下一篇： 蓝牙传输范围须知

微信扫一扫
一键转发
最前沿的电子设计资讯
请关注“电子技术设计微信公众号”

其实CPU才是最适合AI推理的？因为这五大理由本文将具体介绍CPU成为AI推理工作负载最佳目标的五大理由···
人工智能前沿｜2025 年影响工程的顶级趋势想要在人工智能竞赛中保持领先的工程领导者应该关注四个关键领域的进步：生成式人工智能、验证和确认、降阶模型（ROM）和控制系统设计···
人工智能对数据中心基础设施带来了哪些挑战在加密货币和人工智能/机器学习（AI/ML）等新兴应用的驱动下，数据中心的能耗巨大，并将快速增长以满足用户需求···
以极致能效破解人工智能背后的“能源危机” 电力正在成为威胁人工智能（AI）进步的最新瓶颈，而人工智能迅猛增长的算力背后，攀升的能源占用也正在大量挤占正常的社会用能需求···
Arm年度技术大会：2025年底预计将有1,000亿台具备AI能力近日，作为 Arm 一年一度的技术盛会，2024 年度技术大会（Arm Tech Symposia 2024）在上海和深圳成功举办。这次的大会十分特殊，以往 Arm 年度技术大会往往会专注于特定的应用市场，而今年的大会只聚焦于一个领域——AI···
Arm Tech Symposia 年度技术大会顺利收官，继续构建作为当今时代最重大的技术变革之一，AI 极有潜力成为人类毕生最重要的技术。Arm 不仅提供了应用广泛的通用计算平台，还通过将 IP 与开源软件和工具乃至广泛的行业领先生态系统相结合，让全球 2,000 万开发者都能够使用 Arm 计算平台作为 AI 创新基础···
继联网传输视频、图片之后，现在连气味也能远程传送了？这是一家名为Osmo的“数字嗅觉”公司推出的技术，该公司在最近成功利用 AI 技术分析一个位置的气味，并在无需人工干预的情况下在其他地方复制它，实现了气味的远程传送···
AI 大模型迈向多模态，助力具身智能与机器人实现创新你听过莫拉维克悖论 (Moravec's paradox) 吗？该悖论指出，对于人工智能 (AI) 系统而言，高级推理只需非常少的计算能力，而实现人类习以为常的感知运动技能却需要耗费巨大的计算资源···
2024诺贝尔奖公布，竟然有两项都颁给了AI？诺贝尔奖被普遍认为是在世界范围内，所有颁奖领域内能够取得的最高荣誉，最近，2024年的诺贝尔奖获奖名单也陆续公布了出来，而在目前公布的奖项中竟然有两项都与人工智能相关···
无处不在的 Arm 软硬件生态赋能开发者 AI 创新人工智能 (AI) 是当今最重大的技术变革之一，并正以前所未有的速度推动着各行各业的发展···
AI普及给嵌入式设计人员带来新挑战探讨了人工智能（AI）的普及给嵌入式设计人员带来的新挑战。在创建“边缘机器学习（ML）”应用时，设计人员必须确保其能有效运行，同时最大限度地降低处理器和存储开销，以及物联网（IoT）设备的功耗。
自制一个能拍照、能回答问题的智能眼镜，只要180块？在Meta近日举办的Llama 3 hackathon黑客马拉松活动中，一项名为“Open Glass AI”的开源项目仅花费了20美元（约144元人民币）的物料成本就将一副普通的眼镜改装成了智能眼镜，成功斩获了比赛第一名···

机器人所需要的传感器有哪些？随着机器人技术的迭代升级，传感器的重要性将持续提升，其功能性、精度和适配性也将得到显著改进，作为机器人不可
2024年墨西哥市场分析，中国品牌崛起 2024年，墨西哥汽车市场以近10%的增长率展现了强劲的复苏势头，中国品牌的崛起为市场注入了新活力，当然现在的政
2025，大众汽车集团在中国如何转型？ 2024 年，大众汽车集团（中国）在复杂多变的市场环境中成功达成销量目标，向客户交付超过 290 万辆汽车，新能源汽车领
国产射频芯片公司汇总对于射频芯片这项卡脖子技术，国内很多公司在这方面努力，而且也做出了不错的成绩。一些射频芯片公司无论从研发
拆解报告：松下电器1200W电吹风松下EH-NW90电吹风内置10万转高速无刷电机，并具备三档风速和四档风温可选。电吹风内置纳诺怡技术，为秀发提供
拆解报告：白牌电动工具电池多功能放电转换器这款白牌多功能放电转换器适配得伟电动工具电池使用，将电动工具电池和放电转换器组装起来，即可组成移动电源和
拆解报告：MOMA猛玛LARK M2无线麦克风 MOMA猛玛LARK M2无线麦克风在外观方面，采用了极富创新的设计，提供了轻盈舒适的佩戴使用体验。发射器采用了夹
阿根廷2024年：销量下滑，北汽增长240.1%。 2024年阿根廷汽车市场在整体销量下滑的背景下，依然展现出多元化的发展趋势···
2025年第3周：全球最快四足机器人发布 2025年将成为机器人产业的关键时间点，业内预期27年人形机器人出货量可达50~100万台。从技术进步到供应链成熟
欧洲2024年汽车市场：微弱复苏和电动化加速并存 2024年，欧盟新车注册量小幅增长0.8%，达到约1060万辆，欧盟+英国+北欧国家的销量为1296.4万台，同比增长0.9%，整个欧
射频微波领域有哪些高质量期刊？今天我们结合网络上的资料一起整理一份射频微波领域的期刊列表，以便同学们投稿时可以选择···
拆解报告：Portal智能屏幕24W电源适配器 Portal智能屏幕电源适配器采用黑色直板机身，外观整洁，配有2米长黑色输出线。适配器采用美规固定插脚，支持100-2

性能飞跃！升级电流传感器NSM201x-P系列赋能汽车三电和光伏逆变器纳芯微推出全新车规级集成电流路径霍尔传感器NSM201x-P系列。该系列产品是对纳芯微已量产的NSM201x系列的完
意法半导体推出STSPIN32G0新列电机驱动器，满足工业自动化和家电市意法半导体STSPIN32系列集成化电机驱动器新增八款产品，满足电动工具、家用电器、工业自动化等应用的低成本、
Melexis推出性能先进的温度传感器，以红外技术创新实现电磁炉智能全球微电子工程公司Melexis宣布，推出专为电磁炉设计的非接触式红外温度传感器芯片MLX90617···
康佳特SMARC模块更新: 全新英特尔酷睿3处理器低功耗 SMARC 模块AI 加速和图形处理性能再次提升···
康佳特针对要求苛刻的实时应用推出新型高性能COM-HPC模块基于英特尔酷睿 Bartlett Lake S处理器的模块性能全面提升···
为汽车安全保驾护航，纳芯微推出基于AMR技术的ABS轮速传感器纳芯微宣布推出全新基于AMR（各向异性磁阻技术）的轮速传感器NSM41xx系列。该系列产品通过集成先进的磁性传感敏
Microchip推出全新Switchtec™ PCIe® 4.0 16通道交换机系列 PCI100x系列器件可为任何需要加速或专用计算的应用提供高性能和成本效益···
RK3576有多强？实测三屏八摄像头轻松搞定-米尔米尔基于他们推出的MYD-LR3576开发板开发了一个3屏异显，8路摄像头输入的DEMO，实测下来，RK3576轻松搞定了该任
SynQor®推荐先进的军用级三相输入UPS（UPS-1500-S-1U-T） SynQor的三相输入UPS电源能使单相负载在电源端呈现出符合MIL-STD-1399-300B标准的清洁、表现良好且几乎零反
村田开发超小尺寸、超低功耗的Type 2GQ GNSS模块，以匠心品质助在几年前，定位系统充斥于生活方方面面的情节还仅见于各式的科幻影片，而今具备这一功能的产品已经以各种形态步
瑞萨推出性能卓越的新型MOSFET 瑞萨全新晶圆技术可以帮助MOSFET实现导通电阻降低30%、栅漏电荷减少40%、封装尺寸缩小50%的目标···
加特兰集成 Cadence Tensilica ConnX 220 DSP 全面升级汽 ConnX 220 DSP 集成至基于下一代 Andes SoC 的加特兰雷达解决方案后，将带来显著优势，包括提高灵活性、

热门评论
最新评论

换一换

杂志声明

GPT-4终于上线，看看它到底有多聪明？

无敌的考试机器

小编要失业了？

冷笑话收割机

仍有不足