写点什么

疏通数据链条上的每个“堵点”,企业该如何利用端到端解决方案释放数据价值?

  • 2023-01-18
    北京
  • 本文字数:1714 字

    阅读完需:约 6 分钟

疏通数据链条上的每个“堵点”,企业该如何利用端到端解决方案释放数据价值?

2020 年 4 月,国家发展改革委、中央网信办联合印发《关于推进“上云用数赋智”行动培育新经济发展实施方案》,鼓励在具备条件的行业领域和企业范围内,探索大数据、人工智能、云计算、数字孪生、5G、物联网和区块链等新一代数字技术应用和集成创新,为企业数字化转型提供技术支撑。

 

上云、用数、赋智,精炼地描述了企业上云的三个阶段,三重境界。上云可以相对容易,“用数”学问则比较大,“赋智”是更高的境界。在“用数”方面,数据中台的概念曾经在国内大行其道,很快又跌落神坛。很大一部分原因就在于业界没有完全准备好能让数据中台落地的技术。

 

事实上,让数据更好地在企业内部流通,可以有多种解决方案。

 

亚马逊云科技 CEO Adam Selipsky 曾在 2022 re:Invent全球大会的主题演讲中提到,“企业需要不断从数据获得洞察,指导业务决策。”

 

Adam 指出,就像我们不断寻找新的方法来理解宇宙空间的浩瀚和复杂,比如在不同的光谱中观察同一个星云,数据的庞大和复杂也需要新的工具,将不断扩展的信息世界转化为洞察。这些工具需要有最好的性价比,需要最多的功能以支持所有用例,需要可扩展的工具以便处理如此庞大且不断增长的数据量,需要所有这些工具与零 ETL 一起工作,并且有强大的治理以便在访问和控制之间取得平衡。当企业拥有所有这些工具时,就可以构建一个完整的端到端数据策略,涵盖所有数据类型、用户需求和工作负载。亚马逊云科技是执行此操作的最佳场所,正在投资整个数据之旅,从数据的摄取、存储、查询,到分析、可视化和运行机器学习,以及端到端治理,使客户更容易释放数据的价值。”

 

当前,企业收集的数据达到 PB 甚至 EB 级别,这些数据来自多个部门、多项云服务、众多本地数据库以及第三方数据源(如来自合作伙伴解决方案和公共数据集)。在企业可以释放数据的全部价值之前,管理员和数据管理者作为数据生产者与管理者,需要在保障数据的管控和治理的前提下允许数据访问,确保数据只能由正确的人在正确的情境下访问。

 

另一方面,整个公司的员工(作为数据消费者)都希望发现和分析来自数据生产者的信息,以推动决策制定。数据需要被管控以保证安全,产生新的洞察需要允许数据访问,企业必须在二者之间寻求平衡。然而企业内数据多样,部门林立,用例不同,这些都对治理策略的落实提出挑战。

 

一些企业通过建立目录来管理信息,但这些目录系统维护起来相当耗时,需要数据生产者手动标记每个数据集,额外添加来源或描述等情境信息来保证数据可以被检索和发现,同时缺乏内嵌的访问控制来简化数据治理。企业很难保持数据分级分类的一致性,以及各个数据生产者必须保持自己的信息实时更新,这使得在整个企业中搜索数据变得非常困难,并可能导致数据过时。在这种情况下,数据消费者即使找到了所需信息,也无法快速通过目录直接向数据所有者请求访问权限,也就无法加载数据分析服务以及与他人协作。最终,决策者无法及时获得所需信息,或者可能根据不完整或过时的数据做出欠佳的决策。

 

针对上述挑战,亚马逊云科技发布了全新数据管理服务 Amazon DataZone,帮助客户在整个企业内对数据进行编目、发现、共享和治理。

 

Amazon DataZone 的作用是打通、盘活企业内的数据。首先,让管理员可以使用精细的控制工具,管理数据访问权限,确保数据不被滥用、不被非正常使用。这样,整个企业的工程师、数据科学家、产品经理、分析师和业务用户就都可以轻松访问整个企业的数据,挖掘数据价值。

 

数据生产者可以通过 Amazon DataZone 定义数据分级分类,配置治理策略,连接一系列亚马逊云科技服务(如 Amazon S3 和 Amazon Redshift)、合作伙伴解决方案(如 Salesforce 和 ServiceNow)和本地系统,从而创建自己的业务数据目录。Amazon DataZone 使用机器学习为每个数据集收集和建议元数据信息(如数据来源和数据类型),并根据客户的分级分类和偏好进行模型训练,不断优化,从而消除数据目录维护的繁重工作。设置目录后,数据消费者可以使用 Amazon DataZone 搜索和发现数据资产,检查元数据使用情境,请求数据集访问权限。当数据消费者开始分析数据,他们会创建一个 Amazon DataZone 数据项目,即门户系统中的一个共享空间,用户可以在其中提取不同的数据集、与同事共享访问权限、进行分析协作。


2023-01-18 17:189076
用户头像
李冬梅 加V:busulishang4668

发布了 1188 篇内容, 共 811.9 次阅读, 收获喜欢 1303 次。

关注

评论

发布
暂无评论
发现更多内容

IPO,联结一切的桥梁

鼎道智联

Java 对象如何安全的 toString

HoneyMoose

构建基于React18的电子表格程序

葡萄城技术团队

React 表格 纯前端表格技术

各厂商的数据湖解决方案

五分钟学大数据

数据湖 6月月更

大数据培训Flink高频面试题

@零度

flink 大数据开发

工资管理系统该如何使用?

低代码小观

企业管理 工资 管理系统

盘点现有开源软件许可合规工具

开源社

元宇宙产业投资全景图,快人一步走进元宇宙新时代!

博文视点Broadview

GameFi新的启程,AQUANEE将于6.9日登陆Gate以及BitMart

西柚子

保姆级教程:如何成为Apache Linkis文档贡献者

康月牙

Apache GitHub 教程 文档 Linkis

web前端培训React如何原生实现防抖

@零度

前端开发 React

知名网络安全硬件平台厂商铵泰克加入龙蜥社区

OpenAnolis小助手

开源 网络安全 龙蜥社区 CLA 铵泰克

Springcloud Oauth2 HA篇

Damon

微服务架构 安全架构 6月月更

Android 产生ANR后的Trace文件的解析

北洋

android 6月月更

精益产品开发体系最佳实践及原则

阿里云云效

云计算 阿里云 精益开发 产品开发 开发

喜报 | 旺链科技签约汨罗市文旅体产业项目,打造“链”上数字乡村

旺链科技

区块链 产业区块链 乡村振兴 汨罗市

细说腾讯如何做到直播延时降低90%以上方案

C++后台开发

WebRTC CDN 音视频开发 视频直播 直播低延迟

ARM64 上的性能怪兽:API 网关 Apache APISIX 在 AWS Graviton3 上的安装和性能测试

API7.ai 技术团队

AWS 网关 arm APISIX

最佳实践 | 用腾讯云AI语音识别零基础实现小程序语音输入法

牵着蜗牛去散步

最佳实践 语音识别 小程序开发 腾讯云AI 语音输入法

《数字经济全景白皮书》银行财富管理篇 重磅发布

易观分析

理财 银行理财

技术干货 | Linkis实践:新引擎实现流程解析

康月牙

Apache 开源社区 WeDataSphere Linkis 使用实践

为什么 SQL 语句使用了索引,但却还是慢查询?

okokabcd

MySQL

Ubuntu20.04设置静态IP

echeverra

Linux 静态IP

柴云鹏:创新能力的培养至关重要|OceanBase 数据库大赛访谈

OceanBase 数据库

oceanbase 数据库大赛

评“开发人员不喜欢低代码和无代码的8个理由”

代码制造者

程序员 编程语言 开发 iVX 低代码开发

kube-apiserver调度器核心实现

申屠鹏会

k8s

网络安全等级测评和商用密码应用安全性评估是一回事吗?

行云管家

网络安全 等级保护 商用密码

基于模板配置的数据可视化平台

百度Geek说

LP流动性挖矿系统开发生态系统详解

开发微hkkf5566

陕西西安等保测评单位有哪些?在哪里可以查到?

行云管家

西安 等保测评 等保测评机构

分布式数据对象:超级终端的"全局变量"

OpenHarmony开发者

OpenHarmony

疏通数据链条上的每个“堵点”,企业该如何利用端到端解决方案释放数据价值?_文化 & 方法_李冬梅_InfoQ精选文章