Kudu:构建高性能实时数据分析存储系统

【美】吉恩-马克·斯帕加里(Jean-Marc Spaggiari) 等

出版时间

2019-02-28

ISBN

9787121295416

评分

★★★★★
书籍介绍

要在Hadoop生态系统中实现数据的快速输入和快速分析,一直以来只有少数可用但是不够完美的解决方案。它们要么以缓慢的数据输入为代价实现快速分析,要么以缓慢的分析为代价实现快速的数据输入。这个问题现在有了解决办法,使用Apache Kudu基于列的数据存储,可以很容易地对快速输入的数据进行快速的分析。这就是本书的内容。

在《Kudu:构建高性能实时数据分析存储系统》中,你将学习Kudu设计中的关键概念,以及如何用它构建快速、可扩展和可靠的应用程序。通过实际的示例,你将了解Kudu是如何与其他Hadoop生态系统组件(如Apache Spark、Spark SQL和Impala)集成的。

《Kudu:构建高性能实时数据分析存储系统》适合大数据系统的架构师、开发者和咨询师阅读。

目录
前言 ............................................................................... XIII
第1 章 为什么会有Kudu ..................................................1
Kudu 为什么重要 .................................................................................... 1
易用性驱动接纳度 .................................................................................. 2
新的应用场景 ......................................................................................... 5

显示全部
用户评论
前两章可以简单看一下,虽然已经是 2022 年烂俗的车轱辘话(OLTP OLAP Streaming Hadoop 生态 HTAP),不过还是有一些 cloudera 的实践的。部署的时候 SSD / HDD 选择的部分可以看看。其他都没啥意思,没有任何细节部分,不如看官方文档
基础架构和使用运维方面的
下载
收藏