写点什么

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍

  • 2021-04-13
  • 本文字数:1590 字

    阅读完需:约 5 分钟

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍

当今最大的 AI 模型包括数十亿个参数,并且每两个半月就会翻一番。训练它们需要一个新的 CPU,可以与 GPU 紧密结合,以消除系统瓶颈。


北京时间 4 月 13 日凌晨,英伟达在 GCT 2021 大会上宣布了 Grace、BlueField-3 DPU,还有用于自动驾驶的汽车 SoC 芯片三款处理器,均基于 Arm 架构打造。


其中最引人瞩目的当属名为 Grace 的 CPU 产品,这款产品主要为现代数据中心设计。这是英伟达首款服务器 CPU。英伟达认为,AI 模型的数据量和规模正在成倍增长。当今最大的 AI 模型包括数十亿个参数,并且每两个半月就会翻一番。训练它们需要一个新的 CPU,可以与 GPU 紧密结合,以消除系统瓶颈。

Grace 名字来自于计算机科学家 Grace Hopper,她曾是哈佛首批 Mark 1 程序员,并且发明了第一个链接器。据了解,Grace 芯片基于 Arm 打造,内置 Arm Neoverse 核心。


Grace 整个 SoC 由多个芯片组合构成,它主要有三个部分,分别是 CPU、GPU 和内存 /IO 子系统。英伟达表示,Grace CPU 将能够在 SPECrate2017_Int_base 中提供 300 分以上的成绩。对于这样的跑分,英伟达宣称 Grace 的性能基础是第四代 NVIDIA NVLink 互连技术,该技术在 Grace 和 NVIDIA GPU 之间连接速度超过 900GB/s,相当于目前服务器 14 倍的带宽;从 CPU 到 CPU 的速度超过 600GB/s。


据英伟达官方透露,Grace 还将采用 LPDDR5x 内存子系统,与 DDR4 内存相比,可提供两倍的带宽和 10 倍的能效,也就意味着,如果服务器使用这款 CPU,那么整套系统可以提供相较于 x86 CPU 的最新 NVIDIA DGX 快 10 倍的性能。此外,新的架构提供了统一的缓存一致性和单一的内存地址空间,将系统和 HBM GPU 内存结合在一起,简化了可编程性。


在 Grace 发布尾声,英伟达透露,Grace 将得到 NVIDIA HPC 软件开发包和全套 CUDA 和 CUDA-X 库的支持,这些库可以加速超过 2000 个 GPU 应用,加快科学家和研究人员对世界上最重要挑战的发现。

GraceCPU 预计将于 2023 年初上市,瑞士国家超级计算机中心(CSCS)和美国能源部的洛斯阿拉莫斯国家实验室(Los Alamos National Laboratory)将率先建造 NVIDIA CPU 驱动的超级计算机。


两大 AI 框架应对网络安全和语音对话需求

如今,网络安全已经成为每个企业乃至国家安全的重要防线。为了促进网络安全合作伙伴拥有检测和缓解网络安全攻击的 AI 技能,英伟达发布了一个“云原生”应用框架—Morpheus。Morpheus 运行时可以让网络中的计算节点充当传感器,对网络安全威胁进行监测,以作出自主响应。


Morpheus 内置机器学习模块,开发者可以使用深度学习模型创建自己的 Morpheus 技能,以此为基础,Morpheus 可以更加智能地识别、捕获威胁和异常情况,包括敏感数据的泄露、网络钓鱼企图和恶意软件,并对其采取行动。与传统网络安全框架相比,Morpheus 可以在同等投入下分析更多安全数据,且不会影响其性能。


除了 Morpheus,同样引人瞩目的 AI 框架还有 Jarvis。

在疫情大背景下,语音消息成为企业间相互联系,甚至是生活中线上沟通最常用的方式。为了应对日益增长的语音消息传递需求,英伟达宣布对话式 AI 框架 Jarvis 开始提供对手机和消息的普遍适用性。


简单来说,Jarvis 为开发人员提供预先训练的 AI 模型和软件工具,以创建交互式对话体验。据了解,Jarvis 模型的预览版在 2020 年 5 月首次推出,可为对话代理提供自动语音识别,语言理解、实时语言翻译和文本转换语音功能。


与此前相比,此次发布新版本的主要特性在于,该框架为更多开发人员开放了预先训练的开发模型和软件工具。据了解,Jarvis 的模型训练投入了超过 10 亿页的文本和超过 6 万小时的语音,如今,这些模型可以通过自定义数据进行调整、优化、微调,同时还能根据不同的任务、行业和系统进行定制,具有更优秀的普适性。


参考链接:

https://www.cnbeta.com/articles/tech/1113887.htm

https://www.cnbeta.com/articles/tech/1113901.htm

https://www.cnbeta.com/articles/tech/1113891.htm


2021-04-13 17:153878
用户头像

发布了 74 篇内容, 共 31.6 次阅读, 收获喜欢 83 次。

关注

评论

发布
暂无评论
发现更多内容

HarmonyOS实践之应用状态变量共享

HarmonyOS开发者

HarmonyOS

中粮、中交、云投等众多央国企携手用友打造世界一流人才管理体系

用友BIP

人才管理

测试开发 | 人工智能与分布式计算:驱动智能时代的强力结合

测吧(北京)科技有限公司

测试

用友BIP全球司库助力央国企统一资金结算,更可控更高效

用友BIP

全球司库 资金结算

官答|初始化GreatSQL报错无法找到数据目录或初始化数据字典失败

GreatSQL

故障排查 greatsql 官答

Excel可编辑PDF转化软件 PDF to Excel 最新激活版

胖墩儿不胖y

Mac软件 好用的办公软件推荐

测试开发 | 人工智能在大规模数据分析中的崭新征程

测吧(北京)科技有限公司

测试

模块一作业

大鹏

#架构实战营

QCA9880: A multi-dimensional engine driving wireless communications

wallysSK

Havenask分布式索引构建服务--Build Service

阿里技术

分布式 Havenask 分布式索引 Build Service

治理要从数据建模抓起 | 京东云技术团队

京东科技开发者

方太厨电,在创新科技中看见烟火人间

脑极体

方太

顺丰科技:打造智慧物流数据管理平台

新消费日报

以数据指标穿透企业经营,优化业务流程,加速企业运转

用友BIP

人才管理

低代码平台:多引擎、多应用,灵活构建企业数字化生态

天津汇柏科技有限公司

低代码

从 Linux Crontab 到 K8s CronJob,定时任务正在经历怎样的变革

阿里巴巴云原生

阿里云 云原生 可观测

朋友们注意啦!破解脱壳接单了

Geek_7f3f61

小程序开发 定制开发 破解脱壳

数栈UI5.0设计实战|B端表单这样设计,不仅美观还提效

袋鼠云数栈

数据中台 设计 表单 表单设计

湖南等保测评3家叫什么名字?分别在哪里?

行云管家

等级保护 等保测评 湖南

淘宝商品评论数据接口(Taobao.item_review)

tbapi

天猫商品评论接口 天猫评论接口 淘宝商品评论数据接口 淘宝评论接口 淘宝评论API接口

概念回顾:REST API 和 GraphQL

NGINX开源社区

微服务 Rest API graphql REST API

堡垒机的类型分类

尚思卓越

运维 堡垒机

鞍钢集团共和国钢铁工业长子的财务转型之路

用友BIP

财务数智化

软件测试/测试开发丨Pytest测试框架-跳过用例或预期用例失败

测试人

软件测试 测试开发

2023云栖大会精彩内容集锦:《云原生核心技术与最佳实战指南》电子书重磅上线

阿里巴巴云原生

阿里云 云原生

用 Tekton 来构建镜像并推送到极狐GitLab 私有仓库

极狐GitLab

深入探索服装网商品详情API:实时数据获取、安全与隐私保护及商业价值实践

Noah

一起学Elasticsearch系列-索引管理

Java随想录

Java 大数据 Elastic Search

Java多线程系列9:读写锁

BigBang!

Java多线程

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍_硬件_施尧_InfoQ精选文章