您当前的位置:首页 > 新闻资讯 > 科技

英伟达“算力核弹”强在哪里?

时间:2024-03-20 11:15:37  来源:中国电子报  作者:

训练万亿参数级别的大模型,需要多大规模的算力?在今日凌晨进行的Nvidia GTC 2024主旨演讲中,英伟达创始人兼首席执行官黄仁勋在现场做了一道数学题。以AI target=_blank class=infotextkey>OpenAI最先进的1.8万亿参数大模型为例,该模型需要几万亿的Token进行训练。万亿参数与数万亿的Token相乘,就是训练OpenAI最先进大模型所需的计算规模。黄仁勋现场估算的计算规模为3×1025,如果用一颗petaflop(每秒钟进行1千万亿次运算)量级的GPU进行运算,需要1000年的时间才能完成。

另外需要注意的是,在Transformer发明后,大模型的规模正在以惊人的速度扩展,平均每6个月就会翻倍,这意味着万亿级别参数并不是大模型的上限。

在这种趋势下,黄仁勋相信,生成式AI的迭代和发展,需要更大的GPU、更快的GPU互连技术、更强大的超级计算机内部连接技术,以及更庞大的超级计算机巨型系统。

本次GTC 2024发布的Blackwell GPU,被黄仁勋描述为“非常非常大的GPU”,在物理意义上,它确实是当前面积最大的GPU,由两颗Blackwell裸片拼接而成,采用台积电4nm工艺,拥有2080亿晶体管, AI性能达到20 petaflops。相比英伟达Hopper,Blackwell GPU的AI性能提升5倍,片上存储提升4倍。

黄仁勋展示Blackwell GPU(左)和Hopper GPU(右)

除了更大的GPU,Blackwell架构还包含多项计算加速和安全防护技术。

Blackwell采用的第二代Transformer引擎,可以对AI运算的浮点数精度进行动态缩放,目前覆盖了FP6和FP4。在这两种精度下,Blackwell相较Hopper的算力分别实现了2.5倍和5倍的提升。

在大量GPU共同工作时,需要保证GPU之间的信息能够进行同步和共享,这就需要GPU之间的高速连接。为此,英伟达将NVLink技术更新至第五代,为每块GPU提供了1.8TB/s的双向吞吐量,确保GPU之间的高速通信。

在大规模部署AI的过程中,由于组件众多,持续运行的能力变得至关重要。为保证运行周期能够延续更久,Blackwell架构包含了可靠性引擎RAS,该引擎通过AI对可靠性、安全性等相关问题进行预测和预先诊断,在稳固运行的同时进一步降低运营成本。“这就像每个芯片都配备了高级测试仪一样。”黄仁勋比喻道。

同时,英伟达也在Blackwell架构中增加了机密计算功能来强化AI的安全性。在医疗、金融服务等高度重视数据隐私的行业中保护AI模型和客户数据,“我们现在有能力对数据进行加密,使它们被计算时处在一个可信的引擎环境中。”黄仁勋表示。

考虑到在高速计算中数据的转移效率,Blackwell架构设置了解压缩引擎。据了解,该高线速压缩引擎将数据移入和移出计算机的速度提升了20倍,有效减少计算机运算时的算力闲置。

英伟达Blackwell架构所使用的六种技术

基于以上技术,英伟达Blackwell相比前代产品Hopper,能以更少的芯片、更低的功耗完成对OpenAI 1.8万亿参数大模型的一次训练。据黄仁勋测算,如果用Hopper进行训练,需要约8000颗GPU,耗时约90天,产生约15兆瓦的功耗。而用Blackwell进行训练,仅需2000颗GPU,耗时同样为90天,产生约4兆瓦的功耗。

另一个值得关注的点,是Blackwell架构的拓展性。从一颗GPU到超级芯片、系统再到超级计算机——基于英伟达网络、全栈 AI 软件和存储技术,计算集群中的超级芯片数量可扩展至数万个。

与Hopper架构类似,Blackwell支持通过NVLink技术与CPU互联构建超级芯片。将2颗Blackwell GPU与1颗Grace CPU通过NVlink连接,就构成了GB200超级芯片。与英伟达H100 Tensor Core GPU 相比,GB200在大语言模型推理工作负载方面的性能提升了约30倍。

GB200的性能是H100的30倍

若进一步拓展,36块GB200加速卡——包含72颗Blackwell GPU和36颗Grace CPU,将构成DGX GB200系统。

若将8个或以上DGX GB200通过英伟达Quantum InfiniBand 网络连接,就组成了DGX SuperPOD人工智能超级计算机(包含至少576块Blackwell GPU和288颗Grace CPU),在FP4精度下可提供11.5 exaflops(每秒进行1018次运算)的 AI 计算性能和 240 TB 的快速显存。

英伟达超级AI计算机DGX SuperPOD

有意思的是,英伟达与OpenAI结缘,就始于第一代DGX人工智能超级计算机,黄仁勋表示,至今还记得将DGX-1拎在手里递给OpenAI团队的重量。

“2016年,我们发明了一种全新类型的计算机,并称之为DGX-1。我将第一台DGX-1亲手交给一家初创公司,它位于旧金山,名为OpenAI。”黄仁勋说。彼时,DGX-1由8块GPU连接在一起,拥有170teraflops的算力。而今年2月,英伟达揭晓的基于DGX Super POD架构的AI超级计算机EOS,由10752块英伟达H100 GPU连接在一起,提供总共18.4 exaflops的FP8 AI效能。

除了基于GPU的架构迭代和集群拓展应对算力挑战,英伟达还在尝试从芯片制造环节入手,提升芯片制造效率并助力芯片微缩工艺的发展。黄仁勋在主旨演讲中表示,英伟达推出了计算光刻软件库cuLitho,为了更好地制造芯片,需要将光刻技术推向极限,台积电已经宣布将cuLitho投入生产。据悉,EDA厂商新思科技正在将cuLitho集成到软件、制造工艺和系统中,台积电也将cuLitho投入到生产中,以推动半导体微缩工艺的发展。记者了解到,cuLitho计算光刻平台能够帮助设备和制造厂商调整、优化光刻过程中的参数,以实现更高的制造精度。Synopsys 总裁兼首席执行官 Sassine Ghazi 表示,与台积电、英伟达围绕计算光刻的合作,对于实现埃米级微缩至关重要。

作者丨张心怡 王信豪

编辑丨赵晨

美编丨马利亚

监制丨连晓东



Tags:英伟达   点击:()  评论:()
声明:本站部分内容及图片来自互联网,转载是出于传递更多信息之目的,内容观点仅代表作者本人,不构成投资建议。投资者据此操作,风险自担。如有任何标注错误或版权侵犯请与我们联系,我们将及时更正、删除。
▌相关推荐
英伟达CEO黄仁勋预测:十年内AI将能实时生成游戏中的所有像素
IT之家 3 月 21 日消息,在英伟达 GTC 2024 大会上发布了全新 Blackwell GPU 架构之后,黄仁勋在问答环节中对游戏领域的 AI 未来做出了大胆预测。据 Tom's Hardware 报道,这...【详细内容】
2024-03-21  Search: 英伟达  点击:(16)  评论:(0)  加入收藏
英伟达“算力核弹”强在哪里?
训练万亿参数级别的大模型,需要多大规模的算力?在今日凌晨进行的Nvidia GTC 2024主旨演讲中,英伟达创始人兼首席执行官黄仁勋在现场做了一道数学题。以OpenAI最先进的1.8万亿参...【详细内容】
2024-03-20  Search: 英伟达  点击:(16)  评论:(0)  加入收藏
英伟达发布机器人基础模型,具身智能离现实又进了一步?
·英伟达发布人形机器人通用基础模型Project GR00T和新型计算机 Jetson Thor,希望能让机器人拥有更聪明的大脑。·上海机器人产业技术研究院副院长周梅杰分析认...【详细内容】
2024-03-20  Search: 英伟达  点击:(9)  评论:(0)  加入收藏
世界首款!英伟达重磅发布人形机器人模型
3月19日,在备受瞩目的GTC 2024大会上,英伟达CEO黄仁勋带来了一项震撼人心的发布:世界首款人形机器人模型正式亮相。这一创新成果不仅标志着英伟达在人工智能领域的又一重大突破...【详细内容】
2024-03-19  Search: 英伟达  点击:(15)  评论:(0)  加入收藏
英伟达抛出年度AI杀器:史上最强芯片,还有机器人大模型
作者丨邱晓芬、景霖编辑丨苏建勋3月18日-21日期间,英伟达在美国圣何塞召开GTC大会。作为英伟达一年一度的技术发布会, GTC大会也被誉为AI行业的风向标。创始人黄仁勋在GTC大会...【详细内容】
2024-03-19  Search: 英伟达  点击:(15)  评论:(0)  加入收藏
“我是GR00T”,英伟达放大招
作 者丨赵云帆编 辑丨骆一帆图 源丨图虫、资料图在社交平台“预热”人形机器人的新进展之后,英伟达果然放了一个大招。美国当地时间3月18日,英伟达GTC发布会中,该公司发布了“P...【详细内容】
2024-03-19  Search: 英伟达  点击:(9)  评论:(0)  加入收藏
英伟达、微软等巨头“抱团”,AI有望助推6G时代到来 国内产业如何接招?
新一代信息技术的加速演进,为行业发展带来前所未有的机遇,也推动数据、算力、人工智能成为社会生产力发展的重要支撑。随着5G技术的不断演进,下一轮更替已经蓄势待发。当地时间...【详细内容】
2024-02-28  Search: 英伟达  点击:(22)  评论:(0)  加入收藏
详解AI芯片参数,英伟达凭啥不能被替代?
文 | 产业象限,作者 | 山茶,编辑 | 钱江2月22日,英伟达发布2024财年四季报,营收221亿美元,同比增长265%,净利润123亿美元,同比激增769%,双双大超市场预期。然后,英伟达就杀疯了。一夜...【详细内容】
2024-02-28  Search: 英伟达  点击:(32)  评论:(0)  加入收藏
英伟达市值一夜涨了2万亿,约等于一个茅台三个宁德时代,黄仁勋身家超越中国首富钟睒睒
在英伟达靓丽财报的带动下,美股三大指数高开高走,道指、标普双双刷新高,纳指也接近历史最高收盘价。截至当地时间2月22日收盘,英伟达报785.38美元涨16.4%,创历史新高,市值逼近2万...【详细内容】
2024-02-23  Search: 英伟达  点击:(41)  评论:(0)  加入收藏
扎克伯格谈愿景:元宇宙AI 两手抓,预估年底有35万片英伟达 H100
IT之家 1 月 19 日消息,Meta 公司首席执行官马克・扎克伯格(Mark Zuckerberg)近日在 Threads 上发布视频,表示正扩大 AI 团队阵容,推动元宇宙和人工智能发展。IT之家附上视频如下...【详细内容】
2024-01-19  Search: 英伟达  点击:(47)  评论:(0)  加入收藏
▌简易百科推荐
谷歌搜索史上最大变革!考虑对AI搜索收费
快科技4月7日消息,据国外媒体报道,谷歌正计划对由生成式人工智能驱动的新高级功能收费,这将是谷歌搜索业务历史上最大的一次变革。自2000年以来,谷歌的搜索产品一直依靠广告盈利...【详细内容】
2024-04-08    快科技  Tags:谷歌搜索   点击:(5)  评论:(0)  加入收藏
为训练AI,OpenAI等科技巨头花式淘数据
[环球时报特约记者 甄翔]《纽约时报》6日披露了科技公司训练人工智能的秘密——利用语音识别工具转录视频网站YouTube上的视频,形成对话文本数据,供其最新的AI学习...【详细内容】
2024-04-08    环球网  Tags:AI   点击:(5)  评论:(0)  加入收藏
当“机器人”有了“AI大脑” 人形机器人时代来了吗
数智风向标当“机器人”有了“AI大脑”​人形机器人时代来了吗简单明了的口令下达后,机器人便开始搬箱子、运小球,在各类不同的地形行走……这些身上布满芯片和传...【详细内容】
2024-04-08    中国青年报  Tags:机器人   点击:(2)  评论:(0)  加入收藏
报告称 OpenAI 采集了超一百万小时的 YouTube 视频来训练 GPT-4
IT之家 4 月 7 日消息,本周早些时候,《华尔街日报》报道称 AI 公司在收集高质量训练数据方面遇到了困难。今天,《纽约时报》详细介绍了 AI 公司处理此问题的一些方法,其中涉及到...【详细内容】
2024-04-07    IT之家  Tags:OpenAI   点击:(4)  评论:(0)  加入收藏
量子计算会和经典计算一样融入人们的日常生活
作为2024中国网络媒体论坛打造的创新活动之一,“技术赋能·八点见”创新项目发布会于3月30日晚在云南昆明举行。活动现场,本源量子计算科技(合肥)股份有限公司(以下简称“...【详细内容】
2024-04-03    人民网  Tags:量子计算   点击:(8)  评论:(0)  加入收藏
ChatGPT官宣免注册,全球互联网变天!OpenAI将取代谷歌搜索?
新智元报道编辑:编辑部【新智元导读】OpenAI这份愚人节礼物,实在是太大了:今天起,ChatGPT不用注册,可以直接使用。用户狂欢,竞品颤抖,我们仿佛已经听到,谷歌搜索引擎这位巨人轰然倒...【详细内容】
2024-04-02    新智元  Tags:ChatGPT   点击:(7)  评论:(0)  加入收藏
谷歌为了结集体诉讼,同意删除 Chrome 无痕模式下收集的用户数据
IT之家 4 月 2 日消息,根据华尔街日报报道,谷歌为了结追溯到 2020 年的集体诉讼案,近日同意删除通过 Chrome 浏览器“无痕(Incognito)模式”下收集的用户数据。这起诉讼原告认为,...【详细内容】
2024-04-02    IT之家  Tags:Chrome   点击:(7)  评论:(0)  加入收藏
哥伦比亚大学华人开发「人脸机器人」,照镜子自主模仿人类表情超逼真
【新智元导读】OpenAI 机器人理解力虽强,却无法进行非语言交流。最近,哥伦比亚大学华人团队打造了全新的机器人 Emo,不仅可以提前预测和模拟人类表情,还可以进行眼神交流。此前,...【详细内容】
2024-04-01    IT之家  Tags:哥伦比亚   点击:(17)  评论:(0)  加入收藏
谷歌服务现已支持使用 Windows Hello 人脸和指纹解锁登录
IT之家 3 月 28 日消息,谷歌近日对其账户登录页面进行了重大更新,现在能够在用户登录谷歌账户时,使用 Windows Hello 作为身份验证方法。使用通行密钥,用户将不再局限于使用密码...【详细内容】
2024-03-29    IT之家  Tags:谷歌服务   点击:(15)  评论:(0)  加入收藏
GPT商店热度不尽人意 仅用在写论文和炒股票上较受欢迎
财联社3月28日讯(编辑 赵昊)今年1月,OpenAI推出了定制聊天机器人商店“GPTs”,以期为业务增添新的动力。但两个多月后,GPTs的吸引力仍然有限,很难达到公司CEO山姆·奥尔特曼...【详细内容】
2024-03-29    财联社  Tags:GPT   点击:(13)  评论:(0)  加入收藏
站内最新
站内热门
相关头条
  • · 谷歌搜索史上最大变革!考虑对AI搜索收费
  • · ChatGPT官宣免注册,全球互联网变天!OpenAI将取代谷歌搜索?
  • · 马斯克脑机接口再造奇迹:瘫痪小伙意念玩赛车击败正常人
  • · Kimi引燃大模型“长文本竞赛”,阿里360百度急出手
  • · 瘫痪8年小哥植入马斯克脑机接口,狂打8小时「文明6」!Neuralink首个人类植入者直播来了
  • · 英伟达“算力核弹”强在哪里?
  • · AI大模型之争远未落幕
  • · 世界首款!英伟达重磅发布人形机器人模型
  • · 全程回顾黄仁勋GTC演讲:Blackwell架构B200芯片登场
  • · 真“Open ” AI?马斯克旗下大模型Grok宣布开源:参数量全球最大
  • · 全球首位AI程序员诞生 人类程序员会失业吗?
  • · 谷歌宣布更新搜索算法:打击AI生成内容,提高搜索结果质量
  • · 英伟达、微软等巨头“抱团”,AI有望助推6G时代到来 国内产业如何接招?
  • · OpenAI Sora已开放对外申请 网友爆料:可能还有其它重磅产品发布
  • · 周鸿祎再谈Sora:真正给人工智能补上了“眼睛”
  • · Sora爆火超100小时:美国狂“卷”算力,国内则卖 AI 课程“捞金”一年5000万|钛媒体AGI
  • · 爆火Sora参数规模仅30亿?谢赛宁等大佬技术分析来了
  • · “AI女友”霸占GPT商店,OpenAI苦不堪言:开发者也难出头!
  • · 从居家到工作,CES 2024上演 AI硬件大秀
  • · OpenAI新年头号重磅!GPT Store上线,企业客户新品也来了
  • 站内头条