大数据系统构建

[美] 南森·马茨, [美] 詹姆斯·沃伦

出版时间

2016-12-01

ISBN

9787111552949

评分

★★★★★
书籍介绍
本书将教你充分利用集群硬件优势的Lambda架构,以及专门用来捕获和分析网络规模数据的新工具,来创建这些系统。它将描述一个可扩展的、易于理解大数据系统的方法——可以由小团队构建并运行。本书共18章,除了介绍基本概念,其他章节采用“理论+示例”的方式来阐释相关概念,并使用现实世界中的工具加以论证。其中,第1章介绍了数据系统的原理,给出了Lambda架构的概述,并概述了构建任何数据系统的广义方法。第2~9章集中阐述Lambda架构的批处理层。第10章和第11章集中阐述服务层,让读者了解只批量写入的特定数据库——这些数据库比传统数据库更简单,它们具有出色的性能,并具备可操作性、稳健性等特点。第12~17章集中阐述速度层,让读者更明确地了解NoSQL数据库、流处理和管理增量计算的复杂性。 第18章通过综合回顾Lambda架构的相关知识,帮助读者了解增量批处理、基本Lambda架构的变种,以及如何充分利用资源。 马延辉,资深Hadoop技术专家,对Hadoop生态系统相关技术有着深刻的理解,在Hadoop开发和运维方面积累了丰富的经验。曾就职于阿里、Answers.com、暴风等互联网公司,从事Hadoop相关的研发和运维工作,对大数据技术的企业级落地、研发、运维和管理有着深刻的理解和丰富的实战经验。开源HBase监控工具Ella作者。现在致力于大数据技术在传统行业的落地和大数据技术的普及和推广。 向磊,前暴风影音数据平台架构师,目前在某垂直电商平台担任技术总监,惠普中国Hadoop相关课程讲师。开源项目EasyHadoop、phpHiveAdmin作者,对Hadoop及其周边生态系统的底层运维及开发、集群自动化运维、网络架构设计、集群安全、性能优化、嵌入式编程方面有较深入了解。 魏东琦,博士,长期从事软件研发工作,现就职于中国地质调查局西安地质调查中心,参加、承担过多项科研项目。现致力于地质行业与大数据技术融合的相关研究工作。
目录
译者序
前言
关于本书
致谢
第1章 大数据的新范式

显示全部
用户评论
理论部分很有指导性,实践部分意义不大。另外翻译的质量一般。
系统设计应该考虑到人会犯错,得在人犯错的时候,有个弥补至少兜底的措施。
是本非常好的书呀。不过总觉得还是应该读英文版……否则跟大数据工程师说话时,彼此理解还是有偏差
大数据技术集大成者
三个具体例子处理的思想很实用, 实践中.
架构果然日新月异 迭代飞速 现在Lambda architecture已经被很多公司抛弃了 databricks delta lake才是未来~
阅读了第一章关于lambda架构的描述,以及第十二章实时视图,有帮助。
这本书还是很不错滴 感觉不能算是科普书 更像是专业书。没有什么废话并且配有详细的例子和代码 以便进一步了解。 这书介绍了一些lambda架构的属性 还有结构,为我这种新手 绘制了一个大致框架。包括一些未来可发展技术的趋势也有提到,干货满满。但是后半部分牵扯到具体算法的代码时就有些 云里雾里了。自认为非专业人士不用把每个代码都看懂 毕竟要用到的时候再查就行。
翻译的太烂了,大量读不通顺的直译和错别字,建议大家都不要去读翻译的书,从大学教材到技术书籍,误国误民。
大数据Lambda架构科普。随机写是复杂性之源。
下载
收藏