阿里云「飞天发布时刻」2024来啦!新产品、新特性、新能力、新方案,等你来探~ 了解详情
写点什么

英伟达 A100 和 H100 已被禁止向中国供货

  • 2022-09-01
    北京
  • 本文字数:2086 字

    阅读完需:约 7 分钟

英伟达A100和H100 已被禁止向中国供货

2022 年 9 月 2 日最新消息:


在事件发酵一天之后,英伟达方面表示:已经获得美国政府批准,可以在明年 3 月前继续向美国客户出口(到中国)的产品提供 A100,可以在明年 9 月前继续履行 A100 和 H100 的订单。


具体包括如下三点:


1.授权英伟达继续开发 H100 芯片所需的出口、再出口和国内转移;

2.授权允许英伟达在 2023 年 3 月 1 日前进行必要的出口以向 A100 的美国客户提供支持;

3.授权英伟达在 2023 年 9 月 1 日之前通过其香港办事处履行 A100 和 H100 订单和物流;

英伟达 A100 和 H100 已被禁止向中国供货



根据美国证券交易委员会(下文简称:SEC)的最新通知,英伟达将需要获得许可才能向中国和俄罗斯出口任何基于最新架构的 A100 GPU 或 DGX/HGX 等系统。新规定的要求也适用于即将推出的 H100(Hopper)GPU 或实现类似性能的产品。


美国政府认为,需要此类许可来限制此类产品被两国用于某些领域。需要注意的是,英伟达不对俄罗斯的客户销售产品。这一决定可能会影响英伟达 Hopper 架构的开发,因为这一新要求或许会让英伟达将“某些业务”转移出中国。


英伟达则可能会因为该规定损失约 4 亿美元的潜在销售收入,前提是没有其他选择或 SEC 未按时授予出口许可证。


通知全文如下:


2022 年 8 月 26 日,美国政府(USG) 通知英伟达,已对本公司未来向中国和俄罗斯的所有出口实施一项新的许可要求,立即生效。A100 和即将推出的 H100 集成电路,DGX 或包含 A100、H100、A100X 的所有系统均在新的许可要求中。本次发布的许可要求同样适用于 NVIDIA 未来一切性能等于或大于 A100 的产品,以及包括这些芯片的任何系统。USG 表示,新的许可要求将解决其中的产品用于或转用于中国和俄罗斯某些用途的风险。该公司不向俄罗斯客户出售商品。


新的许可要求可能会影响公司及时完成 H100 开发或支持 A100 现有客户的能力,并可能要求公司将某些业务转移到中国以外。该公司与美国政府合作,并正在为公司的内部开发和支持活动寻求豁免。


此外,公司正在与中国的客户接触,并寻求满足他们计划或未来购买公司数据中心产品的需求(注意:这里提到的产品是指不受新许可要求约束的产品)。如果客户需要新许可要求涵盖的产品,公司可能会为客户寻求许可,但不能保证 USG 会及时同意授予许可。


公司于 2022 年 8 月 24 日提供的第三季度财报展望中提到了中国市场约 4 亿美元的潜在销售额。


据集微网报道,英伟达方面也告知收到如下通知,英伟达中国区已收到总部要求,暂停对中国区所有客户所有代理商的数据中心 GPU 卡 A100 和 H100 的发货,其它 GPU 卡不受影响;各服务器 OEM 的现有库存 A100 GPU 卡,目前可以对各自的行业客户继续交付, 英伟达中国区目前也没有对 OEM 发任何 Letter。据悉,英伟达总部还在分析美国政府的政策要求,预计还需要 2~3 天才会有对中国区客户与合作伙伴的沟通口径。


除此之外,业内也有媒体报道称 AMD 收到了类似的要求,对中国区客户断供高端 GPU 芯片,但目前尚未得到 AMD 方面的官方回应。


消息来源:https://www.sec.gov/ix?doc=/Archives/edgar/data/1045810/000104581022000146/nvda-20220826.htm

A100 和 H100 有多强悍?


相比于英伟达前一代的 Volta GPU,A100 的性能提升了 20 倍,非常适合于人工智能、数据分析、科学计算和云图形工作负载。该芯片由 540 亿个晶体管组成,打包了第三代 Tensor 核心,并具有针对稀疏矩阵运算的加速功能,对于 AI 推理和训练来说特别有用。此外,每个 GPU 可以划分为多个实例,执行不同的推理任务,采用 Nvidia NVLink 互连技术可以将多个 A100 GPU 用于更大的 AI 推理工作负载。


然而,这些在 H100 出现之后显得略有不足了。在今年春季的发布会中,黄仁勋发布了面向高性能计算(HPC)和数据中心的下一代 Hopper 架构,搭载新一代芯片的首款加速卡被命名为 H100,它就是 A100 的替代者。


H100 是一款针对大模型专门优化过的芯片,使用台积电 5nm 定制版本制程(4N)打造,单块芯片包含 800 亿晶体管。同时也是全球首款 PCI-E 5 和 HBM 3 显卡,一块 H100 的 IO 带宽就是 40 terabyte 每秒。


Transformer 类预训练模型是当前 AI 领域最热门的方向,英伟达以此为目标专门优化 H100 的设计,提出了 Transformer Engine,集合了新的 Tensor Core、FP8 和 FP16 精度计算,以及 Transformer 神经网络动态处理能力,可以将此类机器学习模型的训练时间从几周缩短到几天。


针对服务器应用,H100 也可以虚拟化为 7 个用户共同使用,每个用户获得的算力相当于两块全功率的 T4 GPU。此外,H100 还实现了业界首个基于 GPU 的机密计算。


基于 Hopper 架构的 H100,英伟达还推出了机器学习工作站、超级计算机等一系列产品。8 块 H100 和 4 个 NVLink 结合组成一个巨型 GPU——DGX H100,一共有 6400 亿晶体管,AI 算力 32 petaflops,HBM3 内存容量高达 640G。


与此同时,得益于与 Equinix(管理全球 240 多个数据中心的全球服务提供商)的合作, A100 和 H100 的新型 GPU 通过水冷方式来节省用户的能源成本。使用这种冷却方法最多可以节省 110 亿瓦时,可以在 AI 和 HPC 推理工作中实现 20 倍的效率提升。


今年 5 月份,英伟达曾开源了 Linux GPU 内核模块代码,未来是否还会有更多开源计划,暂未可知。

公众号推荐:

跳进 AI 的奇妙世界,一起探索未来工作的新风貌!想要深入了解 AI 如何成为产业创新的新引擎?好奇哪些城市正成为 AI 人才的新磁场?《中国生成式 AI 开发者洞察 2024》由 InfoQ 研究中心精心打造,为你深度解锁生成式 AI 领域的最新开发者动态。无论你是资深研发者,还是对生成式 AI 充满好奇的新手,这份报告都是你不可错过的知识宝典。欢迎大家扫码关注「AI前线」公众号,回复「开发者洞察」领取。

2022-09-01 09:3018593
用户头像
赵钰莹 InfoQ 主编

发布了 874 篇内容, 共 604.9 次阅读, 收获喜欢 2671 次。

关注

评论

发布
暂无评论
发现更多内容

一个奇怪的 Elasticsearch 节点

escray

elasticsearch elastic 28天写作 死磕Elasticsearch 60天通过Elastic认证考试

Java Optimizing 读书笔记(一)

绝影-大数据

BI项目失败?看看是不是缺少了这几项闭环!

博文视点Broadview

量化交易系统开发

威掂l8929545452

区块链 系统开发 量化交易系统 交易所

比特币矿机工作原理

v16629866266

比特币 比特币区块链

如何利用策略模式避免冗长的if-else/switch分支判断代码?

码农架构

Java 学习 设计模式

浅析Mysql数据库优化设计规范的“度”

三石

MySQL 28天写作

【HTML】已经废弃的align(图像对齐方式)

德育处主任

html html5 Web html/css 28天写作

TypeScript 渐进迁移指南

LeanCloud

JavaScript typescript nodejs

红牛交易所app系统开发

威掂l8929545452

区块链 系统开发 APP开发 红牛交易所

Serverless 架构到底要不要服务器?

Serverless Devs

Java 云计算 Serverless 运维 云原生

区块链双仓合约交易所系统开发

需求条目化:一个让用户故事有效落地的套路

华为云开发者联盟

敏捷 项目 需求条目化

解决Windows2012 R2下安装PostgreSQL报错的问题

PostgreSQLChina

数据库 postgresql 开源

即构微信小程序直播组件是什么?有哪些功能?哪些小程序类目可以使用?

ZEGO即构

量化策略交易软件开发|量化策略交易系统APP开发

系统开发

Intel首次公布11代酷睿桌面处理器性能:8核i9斩落锐龙12核

科技新消息

百度智能小程序打造购票观影一站式体验,影视宣发新玩法助力行业复苏

DT极客

区块链轻节点:“身”轻,责任重

华为云开发者联盟

区块链 数据 数据隐私 轻节点

开发老人笔记:Git 常用命令清单

华为云开发者联盟

git 代码 bug

OpenYurt v0.3.0 重磅发布:全面提升边缘场景下应用部署效率

阿里巴巴云原生

阿里巴巴 开源 容器 云原生 k8s

开发更便捷 阿里云推出一站式应用研发平台EMAS 2.0

移动研发平台EMAS

阿里云 Serverless AI 低代码 移动研发平台

避免短信接口被黑客刷取的方法

香芋味的猫丶

短信防刷 接口安全 短信验证码 短信防轰炸 短信防火墙

GaussDB(DWS)性能调优系列实现篇六:十八般武艺Plan hint运用

华为云开发者联盟

数据库 性能优化 sql GaussDB 算子

数据库表数据量大读写缓慢如何优化(2)「查询分离」

我爱娃哈哈😍

数据库 大数据 架构 后端 优化

流行的后台管理系统模板总结

老魚

程序员 建站 web全栈

Redis 学习笔记 03:字典

架构精进之路

redis 七日更 28天写作

自动驾驶汽车的发展史

anyRTC开发者

人工智能 自动驾驶 AI

百度研究院的追星逐浪,中国科技的奋发自强

脑极体

微信视频号的排版,怎样才好看 | 视频号 28 天 (07)

赵新龙

28天写作

量化对冲搬砖套利交易APP开发|量化对冲搬砖套利交易系统软件开发

系统开发

英伟达A100和H100 已被禁止向中国供货_AI&大模型_赵钰莹_InfoQ精选文章