现场直击GTC大会|黄仁勋与九个人形机器人同台,新一代平台推理能力提升30倍 现场直击GTC大会|黄仁勋与九个人形机器人同台,新一代平台推理能力提升30倍
admin
2024-03-19 10:14:19
0

美国当地时间3月18日下午,全球瞩目的英伟达2024GTC大会在加州圣何塞SAP球场开幕。英伟达创始人CEO黄仁勋在主题演讲开场时风趣地说道:“这不是演唱会,这是开发者大会,我们会谈论很多计算机科学的话题。”

当黄仁勋一身皮衣走向舞台时,观众立刻沸腾。此前,有人把黄仁勋演讲的受关注程度与顶流歌星Taylor Swift的演唱会相提并论。

“我们正在以从未有过的方式来创建软件。”黄仁勋在演讲中强调,“这就需要构建更大的GPU。”

黄仁勋演讲时,英伟达的股价没有太大变化,竞争对手AMD股价大跌超过3%。

在演讲结束时,黄仁勋与正在使用英伟达软硬件平台开发的九款人形机器人共同登台,还与两个该公司正在测试的小型机器人进行互动。


大模型推理性能可提升45

在整场发布会上,最受关注的是英伟达基于下一代计算架构Blackwell超级芯片而构建的AI超级计算机。黄仁勋曾在多个场合表示,英伟达已经成为了一家平台公司。

黄仁勋率先发布了一款搭载英伟达GB200 Grace Blackwell超级芯片的DGX SuperPOD计算机,可以用于处理万亿参数模型,保证超大规模生成式AI训练和推理工作负载的持续运行。

这款新型的AI超级计算机采用新型高效液冷机架级扩展架构,在FP4精度下可提供11.5exaflops的AI超级计算性能和240TB的快速显存,且可通过增加机架来扩展性能。

据介绍,每个DGX GB200系统搭载36个NVIDIA GB200超级芯片,共包含36颗NVIDIA Grace CPU和72颗NVIDIA Blackwell GPU,这些超级芯片通过第五代NVIDIA NVLink连接成一台超级计算机。与上一代NVIDIA H100 Tensor Core GPU相比,GB200超级芯片在大语言模型推理工作负载方面的性能提升了高达30倍。

基于Grace Blackwell架构的DGX SuperPOD由8个或以上DGX GB200系统构建而成,这些系统通过NVIDIA Quantum InfiniBand网络连接,可扩展到数万个GB200超级芯片。用户可通过NVLink连接8个DGX GB200系统中的576颗 Blackwell GPU,从而获得海量共享显存空间,赋能下一代AI模型。

黄仁勋表示: “NVIDIA DGX AI超级计算机是推进AI产业变革的工厂。新一代DGX SuperPOD集英伟达加速计算、网络和软件方面的最新进展于一体,能够帮助每一个企业、行业和国家完善并生成自己的AI。”

与此同时,英伟达还发布了用于AI模型训练、微调和推理的通用AI超级计算平台NVIDIA DGX B200系统。该系统同样基于全新的Blackwell架构系统,包含8颗NVIDIA B200 Tensor Core GPU和2颗英特尔处理器。DGX B200系统在FP4精度下可提供高达144petaflops的 AI 性能、1.4TB的GPU显存和64TB/s的显存带宽,该系统的万亿参数模型实时推理速度比上一代产品提升了15倍。

英伟达表示,全球合作伙伴预计将在今年晚些时候提供基于DGX GB200 和DGX B200系统构建而成的NVIDIA DGX SuperPOD。


构建更友好软件生态,降低GPU使用门槛

英伟达同时还宣布了多个软件方面的更新布局。其中最重要的一项更新是推出生成式AI微服务NVIDIA NIM,供开发者在已安装NVIDIA CUDA GPU的系统中创建和部署生成式AI助手。

据介绍,由GPU加速NVIDIA NIM微服务和云端端点目录,适用于经过优化的预训练的AI模型,可以在云、数据中心、工作站和PC等支持CUDA的数亿设备的GPU上运行。

一位国内芯片公司技术负责人对第一财经记者表示:“英伟达的软件进行了重要的功能升级,把以前开发者要干的事情都便利化了,提供更友好的算力环境,使得开发者更加依赖。”

上述人士表示,构建更友好的软件生态是英伟达的重要战略。“也就是以后使用GPU的门槛会越来越低,英伟达生态的粘性越来越高。”他说道。

英伟达还宣布将以API的形式提供Omniverse Cloud,从而使开发者能够更方便地将Omniverse的核心技术直接集成到现有的数字孪生设计与自动化软件应用中,或是集成到用于测试和验证机器人或自动驾驶汽车等自主机器的仿真工作流中。

一些全球大型工业软件制造商正在将Omniverse Cloud API加入到其软件组合中,包括Ansys、Cadence、达索系统旗下3DEXCITE品牌、Hexagon、微软、罗克韦尔自动化、西门子和Trimble等。

黄仁勋表示:“所有制造出来的产品都将拥有数字孪生。Omniverse是一个可以构建并操作物理真实的数字孪生的操作系统。Omniverse和生成式AI都是将价值高达50万亿美元的重工业市场进行数字化所需的基础技术。”

Omniverse Cloud API将于今年晚些时候在微软云Azure上以NVIDIA A10 GPU上的自托管API,或是部署在NVIDIA OVX上的托管服务的形式提供。

英伟达还宣布推出一个硬件和软件平台,用于构建包含生成人工智能功能的类人机器人。据黄仁勋介绍,新平台将包括一个为机器人和人工智能提供动力的计算机系统,以及包括生成式AI和其他工具在内的一套软件,以构建能与人进行交互的人形机器人。

相关内容

热门资讯

2025年全国经营主体发展向新... 来源:中国金融信息网 新华财经北京2月26日电(记者王悦阳)记者2月26日从市场监管总局获悉,202...
光明日报|通关便利化持续赋能外... 通关便利化持续赋能外贸发展 光明日报记者 张 翼 今年是“十五五”开局之年,为确保外贸开好局起好步,...
原创 明... 2026年2月26日,黄金市场出现了一个极其罕见的信号:国际金价和国内金价正在“分道扬镳”。 就在昨...
金银狂飙 直播间“锁价券”锁住... 来源:滚动播报 (来源:北京商报) 春节假期结束,黄金、白银价格盘中再度走强。截至2月26日20时3...
王剑锋周伟率队赴上海开展经贸交... 王剑锋周伟率队赴上海开展经贸交流活动 深化对接合作 共谋发展新篇 2月26日,2026年常州—上海经...
出售水井坊?帝亚吉欧最新回应:... 【导读】帝亚吉欧管理层表示不会贱卖资产,从未讨论过出售水井坊 中国基金报记者 郑俊婷 在日前召开的2...
原创 几... 几块钱包邮背后的商业逻辑:淘宝、拼多多不亏的秘密 打开淘宝、拼多多,五块九的发卡、九块九的数据线、十...
侃股:AH股溢价有望持续收缩 据报道,公募基金不断买入高折价的AH股中的港股,这有助于降低AH股溢价率。从价值投资的角度看,同股、...
连任仅三个多月,八一钢铁董事长... 柯善良、刘文壮先生因工作原因,辞去公司董事长、总经理职务。公司于2026年2月26日召开第九届董事会...
宇树科技、西门子能源…默茨中国... 来源:澎湃新闻 2月26日下午,正在访华的德国总理默茨在浙江杭州率团参访宇树科技。澎湃新闻(www....
原创 中... 细察商务部新闻:中美经贸沟通的“温度”与“深度” 初春二月,乍暖还寒,北京城弥漫着料峭春意,然而,中...
原创 今... 今日金价:大家要有心理准备了,2月26日,金价或将重现15年历史 2026年2月26日,国内金价行情...
海量财经 | 金美信消费金融增... 海报新闻记者 周凌峰 报道 国家金融监管总局厦门监管局2月24日公告称,批复同意金美信消费金融增加...
华尔街“SaaS末日”论沸反盈... 来源:21世纪经济报道 21世纪经济报道记者骆轶琪 报道 软件厂商看起来正持续遭遇来自AI的冲击。 ...
当初摩根放开QD额度坚持了一天... 来源:市场资讯 来源:投基摸狗 之前摩根放开QD基金额度,结果只坚持了一天。 昨天下午三点以后(在...
A股上市银行最年轻董事长来了!... 本文时代周报 作者:黄宇昆 宁波银行迎来重要人事变动。 2月26日晚间,宁波银行发布公告,当日,该行...
港股,突然大变局!什么情况? 2026年开年,港股科技股经历了一轮从狂欢到骤冷的极端行情。1月13日还在年内高点,短短一个多月,恒...
三只羊否认借壳上市传闻 【#三只羊否认借壳上市传闻#】#三只羊声明没有借壳上市#2月26日,三只羊网络发布声明。全文如下: ...
原创 散... 为什么有人在春节前夜割肉离场,而有钱人在同一时刻悄然加仓,这是偶然还是必然,是情绪失控还是制度安排,...
Stellantis去年首次亏... IT之家 2 月 26 日消息,今天晚间,Stellantis 集团公布了 2025 年全年财务业绩...