写点什么

数据中台初探与应用实践

  • 2020-05-18
  • 本文字数:1518 字

    阅读完需:约 5 分钟

数据中台初探与应用实践

本文是【技术琐话公益直播】4 月 28 日晚分享嘉宾徐桢虎在线直播中主题《数据中台初探与应用实践》内容整理,内容有删减调整,直播回放见之前的分享。


1 为什么需要数据中台


当企业发展到一定规模时,数据是否能够创造价值显得尤为重要。如果没有从业务的角度对数据进行规划,再多的数据也没有用。一个企业业务与数据双中台的战略地位是相辅相成的,需要打造数据与业务的闭环。


  • 数据增值 :对数据做统一规划、管理、深度挖掘,实现数据到资产的增值;

  • 数据流通 :高价值数据资源的整合、积累、流通,提升数据处理能力;

  • 业务创新 :打破技术隔阂,构建智能化技术引擎,提高业务效率和创新能力。


数据中台的核心价值为优化现有业务和实现新业务的转型,打造数据驱动的智能化企业。


业务价值


  • 以客户为中心进行精细化运营

  • 以数据为基础支撑商业模式创新

  • 打造持续增值的数据资产


技术价值


  • 应对不同数据处理的需求

  • 对数据资产进行标签化应用

  • 快速复用数据服务

  • 快速定位数据血缘链路

2 什么是数据中台


传统数据仓库,第一次明确了数据分析的应用场景应该用单独的解决方案去实现,不再依赖于业务的数据库。这个阶段主要是 IBM、oracle 的产品的黄金年代。但是进入互联网时代后业务发展太快,数据量剧增,传统数据仓库逐渐没落。为什么传统数据仓库效率这么低?自顶向下建模。


数据湖(Data Lake)是一个以原始格式存储数据的存储库或系统。以 google 发布的三篇论文为基础实现的 hadoop 开源项目的出现大数据平台是面向数据研发场景的,覆盖数据研发的完整链路的数据工作台。


大数据平台像一条设备流水线,经过大数据平台的加工,原始数据变成了指标,出现在各个报表或者数据产品中。


数据中台的核心,是在企业数字化战略的基础上,利用一套技术标准构建的共享、安全、标准、统一的数据服务。


恩门建模(自顶向下)因为是从数据源和主题域开始构建,构建成本比较高,适用于应用场景比较固定的业务,比如金融领域,冗余数据少是它的优势。金博尔建模(自底向上)由于是从分析场景出发,适用于变化速度比较快的业务,比如互联网业务。



嘉宾观点:数据中台是各个企业独有的一种战略选择和组织形式,不存在数据中台这样的一个能对外直接售卖的产品。


3 哪些企业需要数据中台


嘉宾认为:


企业有一定的信息化基础,但存在较多的业务数据的孤岛,需要数据整合分析


企业有数字化转型需求,需要通过精细化运营提升效率


企业是跨多个领域业务线的集团架构,有丰富的标签维度和大量的数据应用场景


四、什么时候要建数据中台

4 什么时候要建数据中台


5 建数据中台的成本

五、建设数据中台的成本


6 如何建数据中台

六、如何建数据中台



嘉宾观点:可见是数据资产化,可用是数据产品化和服务化,可运营是要打造数据价值转换的闭环


建议原则:


尽量兼容原各业务线系统,避免推倒重来(开源兼容)


先拿新的业务线作为试点,再大面积推广(快速试错)


先使用的业务线,提供更高的容错度和激励(鼓励创新)



7 建数据中台职责由那个团队承担?

8 封面传媒数据中台应用实践













嘉宾核心观点



人的因素往往最难推动,因为涉及到很多团队的利益,还涉及到能不能找到一些有经验的人来做这个事情。


嘉宾介绍


徐桢虎,西南交通大学计算机硕士,专业方向是数据仓库与数据挖掘


封面传媒 总经理助理兼数据研究部总监


技术委员会召集人、人工智能研究所执行所长


专注领域:数据中台建设、媒体 AI 应用落地


TGO 鲲鹏会 成都分会成员


2050 大会讲师


四川省青联委员


本文转载自公众号技术琐话(ID:TheoryPractice)。


原文链接


https://mp.weixin.qq.com/s?__biz=MzIxMzEzMjM5NQ==&mid=2651036706&idx=1&sn=467ce35475c82de0c88ba932455b541c&chksm=8c4c4926bb3bc030dafc939cc1701e4ef8e770c043da3dfd96831c6f85a78a2bb06e194d01fe&scene=27#wechat_redirect


2020-05-18 10:062604

评论 3 条评论

发布
用户头像
个人认为,中台在大多数公司性价比不高。失败的概率也非常大。
1、投入真的很大。如果小投入,几乎不要试。
2、高层会在中台建设一半,然后发现效果一般时,会马上提出质疑。压迫式KPI就会到来。
3、中台很容易是大数据团队自己幻想的。是否跟业务运营,数据分师接得上气,还未知。
2020-05-19 14:46
回复
用户头像
受益匪浅。在比较高的层次讲解了数据中台的意义,也给了数据中台建设的一般范式。看文章内容应该是截取了ppt,是否可以分享ppt
2020-05-18 15:52
回复
用户头像
中台适用场景小
2020-05-18 11:06
回复
没有更多了
发现更多内容

清爽快速全面的网址导航(cooltools.top)

Yongqiang

人工智能 AI AIGC ChatGPT

为世界第一大癌症高效研发首创新药,AI大模型助力药物研发叩开未来之门

飞桨PaddlePaddle

人工智能 paddle 飞桨

Bettertouchtool for Mac:触控板增强工具

背包客

macos Mac 软件 BetterTouchTool教程 Mac触控板增强 Bettertouchtool

瓴羊Quick BI:商业智能工具的新标杆

巷子

深入学习 Linux 操作系统的存储 IO 堆栈

KaiwuDB

KaiwuDB Linux存储 IO堆栈

重磅再推 | 基于OpenSearch向量检索版+大模型,搭建对话式搜索

阿里云大数据AI技术

人工智能 搜索引擎 企业号 6 月 PK 榜

软件测试/测试开发丨Pytest测试框架学习笔记

测试人

程序员 软件测试 pytest

啥?PCB拼版对SMT组装有影响!

华秋PCB

PCB SMT PCB设计 PCB拼版 贴片

TiDB x Catalyst丨秒级洞悉数据价值,TiDB 帮助“客户成功 SaaS 厂商”提升用户体验

PingCAP

数据库 分布式 TiDB

字节算法中了80%!靠着这份GitHub上的算法小抄,成功斩获Offer

互联网架构师小马

Java 数据结构 算法 LeetCode

软件测试 | Dalvik虚拟机是如何执行程序的

测吧(北京)科技有限公司

测试

Pycharm配置远程调试

Geek_7ubdnf

MySQL读取的记录和我想象的不一致

华为云开发者联盟

数据库 后端 华为云 华为云开发者联盟 企业号 6 月 PK 榜

我的多巴胺回来了!双手奉上在rumble上下载视频的最佳秘诀!

frank

华为云企业快成长安全技术创新论坛广州站举办在即 都有哪些亮点干货?

说山水

Wallys DR9074 4x4 Wlan module work on X86 device/DR9074 应用在X86。

Cindy-wallys

QCN9074 QCN9024

百度沈抖:大模型 产业智能化时代的新引擎

飞桨PaddlePaddle

百度 算法

数据库的 Schema 变更实现

KaiwuDB

KaiwuDB Schema 锁表

Python的离线安装

Geek_7ubdnf

连续两年!PingCAP 入选 Gartner 云数据库“客户之声”,获评“卓越表现者”最高分

PingCAP

2023 可信数据库发展大会:近百位行业大咖将出席演讲

KaiwuDB

KaiwuDB TDBC 2023可信数据库发展大会

软件测试 | Selenium-Grid架构

测吧(北京)科技有限公司

测试

KaiwuDB 数据库高可用方案及落地实现

KaiwuDB

KaiwuDB 数据库高可用

逐鹿AI+、论道沪上,华为云企业快成长AI+大数据技术创新论坛在上海举行

说山水

GitHub热榜,亿级流量并发手册彻底揭开阿里高流量的秘密

互联网架构师小马

麒麟操作系统是什么?和linux的区别是什么?

行云管家

信创 麒麟操作系统

GitHub标星159K的Java学习手册,太香了!

互联网架构师小马

Java

NFTScan 与 SPACE ID 达成合作伙伴,支持 .bnb / .arb 域名搜索!

NFT Research

域名 NFT\

数据中台初探与应用实践_开源_徐桢虎_InfoQ精选文章