GMTC深圳站本周日开幕,14大专题全部上线,完整日程>> 了解详情
写点什么

探访华为云全球最大云数据中心,背后藏着这些“黑科技”

  • 2021 年 9 月 10 日
  • 本文字数:2320 字

    阅读完需:约 8 分钟

探访华为云全球最大云数据中心,背后藏着这些“黑科技”

新基建背景下,数据中心作为支撑新基建发展的重要 IT 基础设施,愈发受到重视。除三大运营商外,BAT 等互联网巨头近年也开始大力投入数据中心的建设和布局。近日,InfoQ 记者来到华为云贵安数据中心实地探访,进一步了解 AI 和大数据等技术在支撑超大型数据中心日常运转所发挥的作用。


坐落在贵安新区数谷大道 1 号的“童话小镇”,也是华为云全球最大云数据中心

 

2016 年,华为与贵州省政府签署战略合作协议,数据中心正式投建。目前华为云贵安数据中心一期已经投入使用,共建设有 9 栋机房,预计未来三到五年还会有更多机房建成。

 

据华为云营销部长董理斌介绍,贵安数据中心规划为华为全球最大的云数据中心,全部建成后可容纳 100 万台服务器。它也是华为云业务的重要承载节点,主要承载华为云、消费者云和华为内部流程 IT 等业务。“如果以贵州为中心,用一千公里画一个半径,贵安华为云数据中心的服务范围能够辐射到重庆、广西、广东、云南、四川等周边省份和地区。”

 

除了建设数据中心以外,华为云贵安数据中心还将承担华为全球 IT 维护工程师基地、员工培训实习基地的职能。预计将有约 600-800 位 IT 维护工程师对数据中心提供支持与服务,每年还将有大量人员到园区进行全景化实战培训、实习等。

 

当前,华为云在中国布局了五大数据中心,除了贵安和乌兰察布外,还有京津冀、长三角、粤港澳片区三大核心数据中心。在国内数据中心规划中,华为云主要基于时延来进行数据中心的冷、温、热布局,其中冷服务主要建在低成本地方,温服务贴近沿海的低成本地方,热服务则布局在贴近客户需求的地方。在海外,华为也在欧洲、中东、非洲、亚太、拉美等区域建立了本地数据中心。

 

在董理斌看来,当前数据中心及相关联产业目前仍处在飞速发展阶段。仅在贵州,华为云就已为超过 800 家贵州企业数字化转型提供服务,全省 62 家省直部门 1438 个数据资源都已上云。而据中国信息通信研究院数据,截至 2020 年底,我国在用数据中心机架总规模超过 400 万架,近 5 年年均增速超过 30%。

 

但数据中心产业快速发展的同时,也带来了能耗大幅增长的问题。据《中国数据中心能耗现状白皮书》,早在 2015 年,全国大数据中心的耗电量已达 1000 亿 kWh,相当于三峡电站全年的发电量;2018 年这个数值迅速爬升至 1609 亿 kWh,超过上海全年的社会用电量。

能耗问题如何破解?

 

今年 7 月 14 日,工业和信息化部印发《新型数据中心发展三年行动计划(2021-2023 年)》(以下简称“行动计划”)明确指出:到 2021 年底,全国数据中心平均利用率力争提升到 55%以上,总算力超过 120EFLOPS,新建大型及以上数据中心 PUE 降低到 1.35 以下;到 2023 年底,全国数据中心机架规模年均增速保持在 20%左右,平均利用率力争提升到 60%以上,新建大型及以上数据中心 PUE 降低到 1.3 以下,严寒和寒冷地区力争降低到 1.25 以下。

 

PUE,即 Power Usage Effectiveness,这是一项用于评价数据中心能源效率的指标,它的值取自数据中心消耗的所有能源(总能耗)与 IT 设备消耗的能源的比值。 其中数据中心总能耗包括 IT 设备能耗和制冷、配电等系统的能耗,因此 PUE 值通常大于 1,PUE 值越接近 1 表明非 IT 设备耗能越少,即能效水平越好。

 

华为云贵安数据中心的能效比 PUE 做到了 1.12,处于业界领先水平。董理斌在采访中向 InfoQ 表示,为了把 PUE 做到尽可能低,华为云采取了多重手段。

 

首先,数据中心选址贵安主要也是基于气候的考虑,贵安年均温度约 15℃,空气质量良好,没有化学、颗粒物污染,使采用直通风自然冷却成为可能。为了充分利用自然冷源,放置服务器的机房建筑相比其他普通建筑也做了一些特殊设计,包括更高的层高和用百叶窗替代普通窗户,而百叶窗背后其实就是一个个的机柜。冷风经大楼百叶窗送进机房,热风经热通道从楼顶排出。



 其次,数据中心设施区和办公区域采用中温冷冻水系统,散发的热量一部分通过瀑布和湖面实现自然冷却,另一个部分通过热回收技术用于游泳池和办公区冬季制热,实现余热回收,减少热损耗。此外还引入了服务器液冷技术,能够把热量直接从芯片上带走,减少制冷无关损耗,提升设备密度降低能效比。

 

AI 技术也在其中发挥了重要作用,基于 AI 技术能够实现随业务功率的变化实时调整制冷功率、削峰平谷,使各服务器负荷均衡,进一步提升资源使用效率比。同时在供电环节用功率半导体替换铜器件,结合智能算法,又能进一步降低供电损耗。

 

华为云称,在满负荷运行的情况下,预计每年可节省电力 10.1 亿度,减少碳排放 81 万吨,相当于年植树 3567 万棵。

智能运维:人均运维设备数量提升 10 倍

 

在数据中心生命周期中,数据中心运维管理是数据中心生命周期中最后一个、也是历时最长的一个阶段。如何用尽可能少的运维人员高效完成数据中心的运维工作,同样是一个非常大的挑战。

 

随着数据中心规模不断扩大,当故障发生时,想要在几十万甚至上百万台服务器中,通过人工来确定故障具体发生在哪个机房、哪个机柜、哪台机器,并找到出问题的具体原因,已经非常困难。为了解决这个问题,华为云结合智能传感和 IoT 等技术构建了数字孪生平台,可以实时显示数据中心环境和设备的状态,把供电和制冷全链路状态以及各模块每台服务器工作状态、工作温度全部可视化。


运行中的河图机器人


机房环境信息实时展示

 

结合华为河图虚拟增强现实技术,运维工程师可以非常方便地实时看到机柜温度、湿度、通风等机房环境信息,人均运维设备数量提升了 10 倍,故障定界定位时间也从 30 分钟大幅降低到 1 分钟。

 

据了解,河图是华为在 2019 年 8 月推出的底层技术平台,定位数据基础设施,其核心能力包括全场景空间计算能力、AR 步行导航、场景编辑、渲染等核心技术。

 

此外,借助大数据分析和 AI 技术,还可以提前分析可能存在的隐患,对基础设施故障进行预测并发布智能风险提醒,从而把运维工作从“被动”变为“主动”,防范于未然。

2021 年 9 月 10 日 09:062752
用户头像
蔡芳芳 InfoQ高级编辑

发布了 643 篇内容, 共 319.1 次阅读, 收获喜欢 2128 次。

关注

评论

发布
暂无评论
发现更多内容

自研规则/流程引擎-ice简介

迟到的月亮

规则引擎使用 规则引擎

机器学习(二):理解线性回归与梯度下降并做简单预测

caiyongji

机器学习

架构实战营--模块一

永佳

架构实战营

用 JavaScript 实现时间轴与动画 - 前端组件化

三钻

JavaScript 前端 动画 组件化 时间轴

Wireshark数据包分析学习笔记Day25

穿过生命散发芬芳

Wireshark 数据包分析 4月日更

高承实:绘一幅区块链社会画像

Geek_987812

区块链

脑机接口简史——假如这篇推送是你靠意念打开的

白洞计划

面试题: String "123" 转 int类型

木子的昼夜

面试题 : 一个单调递增的数组 随机拿出一个数 你怎么找到这个数

木子的昼夜

区块链的环保实验,助全球提高垃圾回收

Geek_987812

环保

为什么数据库字段要使用NOT NULL?

艾小仙

聪明人的训练(五)

Changing Lin

4月日更

怎么画出专业的架构图?

秋天

架构师 架构·

基于二叉树实现Map

Silently9527

Java 二叉树 数据结构与算法

「架构实战营」课堂作业-G20210698010384

张亮

架构实战营 - 模块 1- 作业

请弄脏我的身体

架构实战营

踩坑 MySQL 索引,看看你真的会用么?

架构精进之路

MySQL 4月日更

go每日一库 [go-rate] 速率限制器

happlyfox

学习 Go 语言 4月日更

Linux grep 命令

一个大红包

4月日更

PCB如何拼版

不脱发的程序猿

嵌入式 电路设计 硬件设计 4月日更 PCB打样

架构实战营 模块一作业

netspecial

架构实战营

C++ sort 排序及自定义排序

玄兴梦影

什么是架构?怎么来理解?

秋天

架构师 架构·

一文读懂区块链领域最新发展方向 NFT经济将成未来发展方向

Geek_987812

艺术品

极客架构module 1 作业

Geek_649372

架构实战营

作业1--微信的业务架构及学生管理系统

大可

面试题: 合并两个有序链表

木子的昼夜

重磅官宣:Nacos2.0发布,性能提升10倍

xcbeyond

Java 微服务 nacos 4月日更

如何做Nginx安全日志分析可视化

运维研习社

nginx 4月日更 waf

架构实战营——作业一:微信架构及学生管理架构

开拓纪

架构实战营 作业一

机器学习和大数据的区别和联系

大数据技术指南

机器学习 大数据 4月日更

2021星空论坛:破局创新,论道数字化转型

2021星空论坛:破局创新,论道数字化转型

探访华为云全球最大云数据中心,背后藏着这些“黑科技”-InfoQ