写点什么

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍

  • 2021-04-13
  • 本文字数:1590 字

    阅读完需:约 5 分钟

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍

当今最大的 AI 模型包括数十亿个参数,并且每两个半月就会翻一番。训练它们需要一个新的 CPU,可以与 GPU 紧密结合,以消除系统瓶颈。


北京时间 4 月 13 日凌晨,英伟达在 GCT 2021 大会上宣布了 Grace、BlueField-3 DPU,还有用于自动驾驶的汽车 SoC 芯片三款处理器,均基于 Arm 架构打造。


其中最引人瞩目的当属名为 Grace 的 CPU 产品,这款产品主要为现代数据中心设计。这是英伟达首款服务器 CPU。英伟达认为,AI 模型的数据量和规模正在成倍增长。当今最大的 AI 模型包括数十亿个参数,并且每两个半月就会翻一番。训练它们需要一个新的 CPU,可以与 GPU 紧密结合,以消除系统瓶颈。

Grace 名字来自于计算机科学家 Grace Hopper,她曾是哈佛首批 Mark 1 程序员,并且发明了第一个链接器。据了解,Grace 芯片基于 Arm 打造,内置 Arm Neoverse 核心。


Grace 整个 SoC 由多个芯片组合构成,它主要有三个部分,分别是 CPU、GPU 和内存 /IO 子系统。英伟达表示,Grace CPU 将能够在 SPECrate2017_Int_base 中提供 300 分以上的成绩。对于这样的跑分,英伟达宣称 Grace 的性能基础是第四代 NVIDIA NVLink 互连技术,该技术在 Grace 和 NVIDIA GPU 之间连接速度超过 900GB/s,相当于目前服务器 14 倍的带宽;从 CPU 到 CPU 的速度超过 600GB/s。


据英伟达官方透露,Grace 还将采用 LPDDR5x 内存子系统,与 DDR4 内存相比,可提供两倍的带宽和 10 倍的能效,也就意味着,如果服务器使用这款 CPU,那么整套系统可以提供相较于 x86 CPU 的最新 NVIDIA DGX 快 10 倍的性能。此外,新的架构提供了统一的缓存一致性和单一的内存地址空间,将系统和 HBM GPU 内存结合在一起,简化了可编程性。


在 Grace 发布尾声,英伟达透露,Grace 将得到 NVIDIA HPC 软件开发包和全套 CUDA 和 CUDA-X 库的支持,这些库可以加速超过 2000 个 GPU 应用,加快科学家和研究人员对世界上最重要挑战的发现。

GraceCPU 预计将于 2023 年初上市,瑞士国家超级计算机中心(CSCS)和美国能源部的洛斯阿拉莫斯国家实验室(Los Alamos National Laboratory)将率先建造 NVIDIA CPU 驱动的超级计算机。


两大 AI 框架应对网络安全和语音对话需求

如今,网络安全已经成为每个企业乃至国家安全的重要防线。为了促进网络安全合作伙伴拥有检测和缓解网络安全攻击的 AI 技能,英伟达发布了一个“云原生”应用框架—Morpheus。Morpheus 运行时可以让网络中的计算节点充当传感器,对网络安全威胁进行监测,以作出自主响应。


Morpheus 内置机器学习模块,开发者可以使用深度学习模型创建自己的 Morpheus 技能,以此为基础,Morpheus 可以更加智能地识别、捕获威胁和异常情况,包括敏感数据的泄露、网络钓鱼企图和恶意软件,并对其采取行动。与传统网络安全框架相比,Morpheus 可以在同等投入下分析更多安全数据,且不会影响其性能。


除了 Morpheus,同样引人瞩目的 AI 框架还有 Jarvis。

在疫情大背景下,语音消息成为企业间相互联系,甚至是生活中线上沟通最常用的方式。为了应对日益增长的语音消息传递需求,英伟达宣布对话式 AI 框架 Jarvis 开始提供对手机和消息的普遍适用性。


简单来说,Jarvis 为开发人员提供预先训练的 AI 模型和软件工具,以创建交互式对话体验。据了解,Jarvis 模型的预览版在 2020 年 5 月首次推出,可为对话代理提供自动语音识别,语言理解、实时语言翻译和文本转换语音功能。


与此前相比,此次发布新版本的主要特性在于,该框架为更多开发人员开放了预先训练的开发模型和软件工具。据了解,Jarvis 的模型训练投入了超过 10 亿页的文本和超过 6 万小时的语音,如今,这些模型可以通过自定义数据进行调整、优化、微调,同时还能根据不同的任务、行业和系统进行定制,具有更优秀的普适性。


参考链接:

https://www.cnbeta.com/articles/tech/1113887.htm

https://www.cnbeta.com/articles/tech/1113901.htm

https://www.cnbeta.com/articles/tech/1113891.htm


2021-04-13 17:153725
用户头像

发布了 74 篇内容, 共 30.9 次阅读, 收获喜欢 83 次。

关注

评论

发布
暂无评论
发现更多内容

盘点2020|多线程的遥感大数据行业产品经历

老壳有点爽

大数据 盘点2020 InSAR

几款Java开发者必备常用的工具,准点下班不在话下

华为云开发者联盟

Java 工具 开发

90分钟10个手写案例,从源码底层给你讲解7种线程池创建方式

996小迁

Java 源码 架构 资料 笔记

OpenKruise v0.7.0 版本发布:新增周期任务分发控制器

阿里巴巴云原生

阿里云 容器 开发者 运维 云原生

盘点2020 | 微服务架构下该如何技术选型呢?

xcbeyond

微服务 技术选型 盘点2020 选型原则

从阿里离职后人虚了,头也秃了,就剩这份Java性能优化的PDF了

Java架构追梦

Java 架构 面试 性能优化 并发

架构师训练营 1 期 -- 第十三周总结

曾彪彪

极客大学架构师训练营

干货丨如何使用Redash连接DolphinDB数据源

DolphinDB

数据处理 时序数据库 DolphinDB 数据库开发 redash

程序员因重复记录日志撑爆ELK被辞退!

Java架构师迁哥

扩招1W人,字节跳动内部公开12月份Java岗71道面试题

比伯

Java 编程 架构 面试 程序人生

智能微卡口监控系统搭建,智慧平安小区建设解决方案

t13823115967

智慧城市

Tufin联合Cisco,将网络安全自动化进行到底

Geek_448e23

网络安全 自动化管理 云安全

边缘计算和5G:我们从何而来?

VoltDB

云计算 大数据 5G 物联网 边缘计算

985研究生熬夜23天吃透845页架构宝典 终收割腾讯Java岗offer!再也不用怀疑人生了

比伯

Java 编程 架构 面试 程序人生

forsage以太坊矩阵系统软件开发|forsage以太坊矩阵APP开发

系统开发

女朋友突然问我DNS是个啥....

乱敲代码

计算机网络 DNS DNS服务器

从面试角度分析LinkedList源码

Java旅途

Java List 集合 linkedlist

DAPP软件系统开发

系统开发

PostgreSQL高可用:多主复制解决方案

PostgreSQLChina

数据库 postgresql 开源

建议收藏,mybatis插件原理详解

田维常

mybatis

架构师 3 期 3 班 -week4- 作业

zbest

作业 week4

阿里华为等大厂如何处理数值精度/舍入/溢出问题

Java架构师迁哥

等保数据备份和恢复关键点,这些你该知道!

华为云开发者联盟

数据 容灾 恢复

Mysql中,1=1和 1=1=1 和 -1=-1 和 -1=-1=-1 和 5=5 和 5=5=5 有什么区别

Geek_de9857

MySQL sql 返回值 1=1=1 -1=1=1

5张图搞懂Java引用拷贝、深拷贝、浅拷贝

bigsai

Java 浅拷贝和深拷贝

盘点2020 | 一个三线程序员的2020年,不卑不亢

沉默王二

程序员 盘点2020 沉默王二

架构师训练营第 13 周学习总结

netspecial

极客大学架构师训练营

LeetCode题解:127. 单词接龙,双向BFS,JavaScript,详细注释

Lee Chen

算法 大前端 LeetCode

flink 使用curl,通过RESTful api,上传和删除jar包

Geek_de9857

flink RESTful curl 上传jar 删除jar

架构师训练营第 1 期第 13 周作业

业哥

《O2O实战:他们是如何利用互联网的》.pdf

田维常

互联网

英伟达推出首个 CPU,基于 ARM 架构主攻巨型 AI,性能超 x86 十倍_硬件_施尧_InfoQ精选文章