10 月 23 - 25 日,QCon 上海站即将召开,现在大会已开始正式报名,可以享受 8 折优惠 了解详情
写点什么

O ' reilly 阶层会议暨 Hadoop 世界 2012:Azure HDInsight,Cloudera Impala,MapR M7

  • 2012-11-30
  • 本文字数:1518 字

    阅读完需:约 5 分钟

在今年的 O ' reilly 阶层会议暨 Hadoop 世界期间,除了一系列非常有趣的报告之外,还有几个关于微软 Azure HDInsight、Cloudera Impala 和 MapR M7 等重要供应商的产品发布。

微软 Hortonworks 推出它们基于云的 Hadoop Azure 服务,现在称为 Windows Azure HDInsight 服务。微软技术研究员大卫•坎贝尔说:

“大数据应该提供商业解决方案,而不是带来 IT 复杂性。Windows 服务器和 Azure 提供的 Hadoop 兼容能力显著降低了安装和部署的门槛,使客户能够从任何数据、任何规模、本地或云上获得商业洞察力。”

HDInsight 服务器设计在 Windows Server 和 Microsoft SQL Server 上工作。在 Windows 下,HDInsight 集成了用于管理控制的 Microsoft System Center 和用于访问控制与安全的 Active Directory。HDInsight(本地和云) 支持连接到微软 SQL Server 以实现商业智能

“……从面向用户的工具和组件(包括 Microsoft Excel、PowerPivot Excel 和 Power View)开始。几乎没有人不使用 Excel,它可处理从任何 Hadoop 环境的提取的数据。”

HDInsight 可以使用户在几分钟内旋转和部署 Hadoop 集群。此服务将与现有的 MapReduce 服务展开竞争(包括亚马逊 Web 服务的 Elastic Map Reduce )。此外,Azure 将运营数据交易市场,使用户能够互相买卖数据。

Cloudera 发布了实时查询项目 Impala ,它服务于几秒钟内完成的实时 SQL 查询,支持与领先 BI 工具的集成。Impala 提供本地分布式查询引擎和一个低延迟调度器,可以在 HDFS 和 HBase 上操作数据存储。它利用了 Apache Hive 元仓库,兼容 Hive SQL 语法、ODBC 驱动程序和 Beeswax GUI(在 Hue 中)。

Cloudera 声称新平台已进入公测,可以以比 Hive/MapReduce 快 10 到 30 倍的效率处理查询。虽然 Cloudera 的营销材料宣称处理速度为“实时”和“思维速度”,该公司的首席架构师却认为,在数据分析中,“实时”更好的说法是“较少的等待”。

首批 Impala 的 beta 测试者之一 Expedia 说:

“现在,我们能够在一个统一的大数据平台上归档、ETL 和分析,而不需要许多不同的系统。……Hadoop 的这个演变使我们减少了 50% 的延迟,并产生了新的真正的商业洞察力服务,而以前是不可行的。”

如果你仔细分析为何公司可处理比以前更多的内部数据时,给你印象最深的就是增加的速度。但这些庞大的数据集还创造很大的后台问题,特别是延迟。

最后, MapR Technologies 介绍了他们的新版本——M7,它简化了 HBase 管理,并使它自己成为企业级数据库平台。

对于 M7

“……该公司与 HBase 已经共同努力解决了大量的可靠性和管理问题。该公司的目标是简化底层架构,如何让不同的产品在一起工作,并使其尽可能的简单。Norris 说,管理平台已更加易用,并且它也为客户提供了统一管理、统一数据保护、一致访问,比之前的平台有更高的灵活性和性能。”

M7 白皮书上说:

“M7 有一个特制的架构,专门设计用来优化存储,并能在统一平台中处理表和文件。这种统一性应用了 MapR 已有的管理能力、访问和保护表数据的能力。M7 消除了 HBase 的分层架构,于是 HBase 应用程序仅通过一个网络中继就可以直接访问数据,无需任何额外的通信层延误。M7 架构将文件和表集成到单个数据存储,给 HBase 应用带来更加简化的管理和开发、极佳的可靠性、空前的性能和可扩展性”

大会的演讲稿主题演讲和访谈可以从其网站下载。

查看英文原文 News from O’Reilly Strata Conference + Hadoop World 2012: Azure HDInsight, Cloudera Impala, MapR M7


感谢马国耀对本文的审校。

给 InfoQ 中文站投稿或者参与内容翻译工作,请邮件至 editors@cn.infoq.com 。也欢迎大家通过新浪微博( @InfoQ )或者腾讯微博( @InfoQ )关注我们,并与我们的编辑和其他读者朋友交流。

2012-11-30 09:341397

评论

发布
暂无评论
发现更多内容

程序员快乐器之JAVA代码生成工具

Philips

敏捷开发 程序设计 软件架构 开发工具

LeetCode题解:1. 两数之和,Map+队列+双指针,JavaScript,详细注释

Lee Chen

大前端 LeetCode

同城双活与异地多活架构分析

vivo互联网技术

架构 高可用 架构设计 高可用系统的架构

基于electron桌面级脚手架的设计

久违

设计 大前端 全栈

区块链永续合约交易所搭建,永续合约系统开发

java中实现List集合中对象元素按其属性的中文拼音排序

云辰

中途转行学Java,如何赛过科班生?你只需要做到这几点

小Q

Java 程序员 架构 技术 基础

大项目写代码写到晕头转向?敏捷多项目框架解君愁

Learun

敏捷开发 软件开发

碰撞率下降75%!Mobileye与所托瑞安宣布双方合作重大进展

最新动态

案例解析丨Spark Hive自定义函数应用

华为云开发者联盟

spark UDF

想学习数据结构和算法,推荐给你 10 本优质书单

沉默王二

数据结构 算法 书单推荐

将DevOps视为哲学——实施DevOps的绝佳方式

禅道项目管理

DevOps 测试 开发 持续交付

从linux源码看epoll

无毁的湖光

Linux TCP Linux Kenel

创建spring boot starter

曾彪彪

Java spring Boot Starter

5分钟带你掌握Makefile分析

华为云开发者联盟

makefile 脚本

【写作群星榜】9.1~9.13写作平台优秀作者 & 文章排名

InfoQ写作社区官方

写作平台 排行榜 文章

不想码代码,你还能做什么?(一)

研发管理Jojo

项目管理 技术管理 PMO

一定要写点什么?!

什么是云服务器,ECS它能干什么?

德胜网络-阳

docker 安装consul

云辰

记一次node项目重构改进

华为云开发者联盟

Java 项目 方案

东方证券企业架构之技术架构转型实践

BoCloud博云

云计算 容器 微服务 PaaS 博云

使用Valgrind调试Linux C++程序

Simon

c++ gdb Valgrind memcheck 内存泄漏

实践案例丨基于Raft协议的分布式数据库系统应用

华为云开发者联盟

raft 华为云

Python中的with是测试常用到的资源打开利器

陈磊@Criss

看动画学算法之:排序-快速排序

程序那些事

排序 快速排序 数据结构和算法 看动画学算法

Docker映射详解,没问题了!

程序员的时光

Docker

TNFE-Weekly[第七十二周已更新]

莹姐🙈

小程序 大前端 周刊

中国云计算的云栖“坐标”

脑极体

图计算黑科技:打开中文词嵌入训练实践新模式

腾讯云大数据

大数据

USDT承兑商支付系统搭建,区块链支付平台开发

O ' reilly阶层会议暨Hadoop世界2012:Azure HDInsight,Cloudera Impala,MapR M7_大数据_Boris Lublinsky_InfoQ精选文章