写点什么

O ' reilly 阶层会议暨 Hadoop 世界 2012:Azure HDInsight,Cloudera Impala,MapR M7

  • 2012-11-30
  • 本文字数:1518 字

    阅读完需:约 5 分钟

在今年的 O ' reilly 阶层会议暨 Hadoop 世界期间,除了一系列非常有趣的报告之外,还有几个关于微软 Azure HDInsight、Cloudera Impala 和 MapR M7 等重要供应商的产品发布。

微软 Hortonworks 推出它们基于云的 Hadoop Azure 服务,现在称为 Windows Azure HDInsight 服务。微软技术研究员大卫•坎贝尔说:

“大数据应该提供商业解决方案,而不是带来 IT 复杂性。Windows 服务器和 Azure 提供的 Hadoop 兼容能力显著降低了安装和部署的门槛,使客户能够从任何数据、任何规模、本地或云上获得商业洞察力。”

HDInsight 服务器设计在 Windows Server 和 Microsoft SQL Server 上工作。在 Windows 下,HDInsight 集成了用于管理控制的 Microsoft System Center 和用于访问控制与安全的 Active Directory。HDInsight(本地和云) 支持连接到微软 SQL Server 以实现商业智能

“……从面向用户的工具和组件(包括 Microsoft Excel、PowerPivot Excel 和 Power View)开始。几乎没有人不使用 Excel,它可处理从任何 Hadoop 环境的提取的数据。”

HDInsight 可以使用户在几分钟内旋转和部署 Hadoop 集群。此服务将与现有的 MapReduce 服务展开竞争(包括亚马逊 Web 服务的 Elastic Map Reduce )。此外,Azure 将运营数据交易市场,使用户能够互相买卖数据。

Cloudera 发布了实时查询项目 Impala ,它服务于几秒钟内完成的实时 SQL 查询,支持与领先 BI 工具的集成。Impala 提供本地分布式查询引擎和一个低延迟调度器,可以在 HDFS 和 HBase 上操作数据存储。它利用了 Apache Hive 元仓库,兼容 Hive SQL 语法、ODBC 驱动程序和 Beeswax GUI(在 Hue 中)。

Cloudera 声称新平台已进入公测,可以以比 Hive/MapReduce 快 10 到 30 倍的效率处理查询。虽然 Cloudera 的营销材料宣称处理速度为“实时”和“思维速度”,该公司的首席架构师却认为,在数据分析中,“实时”更好的说法是“较少的等待”。

首批 Impala 的 beta 测试者之一 Expedia 说:

“现在,我们能够在一个统一的大数据平台上归档、ETL 和分析,而不需要许多不同的系统。……Hadoop 的这个演变使我们减少了 50% 的延迟,并产生了新的真正的商业洞察力服务,而以前是不可行的。”

如果你仔细分析为何公司可处理比以前更多的内部数据时,给你印象最深的就是增加的速度。但这些庞大的数据集还创造很大的后台问题,特别是延迟。

最后, MapR Technologies 介绍了他们的新版本——M7,它简化了 HBase 管理,并使它自己成为企业级数据库平台。

对于 M7

“……该公司与 HBase 已经共同努力解决了大量的可靠性和管理问题。该公司的目标是简化底层架构,如何让不同的产品在一起工作,并使其尽可能的简单。Norris 说,管理平台已更加易用,并且它也为客户提供了统一管理、统一数据保护、一致访问,比之前的平台有更高的灵活性和性能。”

M7 白皮书上说:

“M7 有一个特制的架构,专门设计用来优化存储,并能在统一平台中处理表和文件。这种统一性应用了 MapR 已有的管理能力、访问和保护表数据的能力。M7 消除了 HBase 的分层架构,于是 HBase 应用程序仅通过一个网络中继就可以直接访问数据,无需任何额外的通信层延误。M7 架构将文件和表集成到单个数据存储,给 HBase 应用带来更加简化的管理和开发、极佳的可靠性、空前的性能和可扩展性”

大会的演讲稿主题演讲和访谈可以从其网站下载。

查看英文原文 News from O’Reilly Strata Conference + Hadoop World 2012: Azure HDInsight, Cloudera Impala, MapR M7


感谢马国耀对本文的审校。

给 InfoQ 中文站投稿或者参与内容翻译工作,请邮件至 editors@cn.infoq.com 。也欢迎大家通过新浪微博( @InfoQ )或者腾讯微博( @InfoQ )关注我们,并与我们的编辑和其他读者朋友交流。

2012-11-30 09:341210

评论

发布
暂无评论
发现更多内容

开发者独立搭建一个跨模态搜索应用有多难?

Jina AI

深度学习 云原生 神经搜索 跨模态应用 多模态数据

HTTP和HTTPS的区别

开发微hkkf5566

《2022 年上半年全球独角兽企业发展研究报告》发布——DEMO WORLD世界创新峰会圆满落幕

创业邦

基于 Next.js实现在线Excel

葡萄城技术团队

前端 在线excel nextjs 表格 控件

Mybatis中#{}和${}的区别

开发微hkkf5566

2022年7月国产数据库大事记-墨天轮

墨天轮

数据库 腾讯云 GaussDB 国产数据库 KingBase

Spring之JDK动态代理与CGLIB动态代理

echoes

Typora收费?搭建VS Code MarkDown写作环境

三分恶

工具 markdown 8月月更

使用python获取浏览器收藏夹和历史浏览记录,然后可以...

技能实验室

签约计划第三季

《分布式云最佳实践》分论坛,8月11日深圳见

阿里云弹性计算

分布式云 飞天 数字化升级 一云多形态

重构指标之如何监控代码圈复杂度

京东科技开发者

测试 重构 软件重构 分布式应用软件

攻防视角下,初创企业安全实战经验分享

声网

网络安全

5种kafka消费端性能优化方法

华为云开发者联盟

大数据 kafka 后端 MRS

面了三十个人,说说真实感受

三分恶

面试 面试官 8月月更

直播系统开发——直播间架构的设计及难点分析

开源直播系统源码

软件开发 语聊房 语音聊天源码 直播系统开发

IDC:阿里云稳居中国大数据平台公有云市场第一位

阿里云大数据AI技术

阿里云

百度APP Android包体积优化实践(三)资源优化

百度Geek说

Andriod

《中国综合算力指数》《中国算力白皮书》《中国存力白皮书》《中国运力白皮书》在首届算力大会上重磅发出

GPU算力

兆骑科创创新创业大赛活动举办,线上直播路演,投融资对接

兆骑科创凤阁

大数据开发,Hadoop Spark太重?你试试esProc SPL

华为云开发者联盟

大数据 开源 后端

化繁为简,聊一聊复制状态机系统架构抽象

阿里技术

数据库 架构

快速打造安全的车联网平台

Geek_99967b

小程序

Vue3 初探

怀府风

Pisanix v0.2.0 发布|新增动态读写分离支持

SphereEx

数据库 开源 ShardingSphere SphereEx

SAP ABAP SteamPunk 蒸汽朋克的最新进展 - 嵌入式蒸汽朋克

汪子熙

云原生 Cloud 云平台 SAP 8月月更

深入聊聊Linux五种IO模型

C++后台开发

epoll 网络模型 I/O模型 C/C++后台开发 C/C++开发

面渣逆袭:MySQL六十六问,两万字+五十图详解

三分恶

MySQL 8月月更

现代 ABAP 编程语言中的正则表达式

汪子熙

正则表达式 编程语言 SAP abap 8月月更

从-99打造Sentinel高可用集群限流中间件

艾小仙

Java 高可用 sentinel 集群限流

如何防止重复下单?

三分恶

8月月更

O ' reilly阶层会议暨Hadoop世界2012:Azure HDInsight,Cloudera Impala,MapR M7_大数据_Boris Lublinsky_InfoQ精选文章