基于Apache Flink的流处理

[美] 比安‧霍斯克

出版时间

2019-12-31

ISBN

9787519840112

评分

★★★★★

标签

编程

书籍介绍
这本书最突出的价值,在于它把流处理从「批处理的延伸」这一常见误解中剥离出来,系统讲清了时间语义、水位线与状态一致性这些真正决定流计算正确性的核心概念。读者普遍反馈,书中对「满足结合律、交换律的流式算子」以及窗口机制的讲解尤为到位,这是理解Flink设计哲学的关键,也是很多同类资料一笔带过的地方。它不追求源码剖析,也不堆砌API手册,而是以概念建模为主,帮助读者建立对并行流处理的整体认知。因此它特别适合刚接触Flink、想先建立原理框架而非急于写代码的开发者;若你期待一本手把手的实战编码指南,可能会觉得偏浅,仍需结合真实项目补齐。
作者简介
Fabian Hueske是Apache Flink项目的PMC成员,他从Flink项目创始之初就开始参与贡献。Fabian是data Artisans(现在的Ververica)公司的创始人之一,拥有柏林工业大学的计算机科学博士学位。 Vasiliki Kalavri是苏黎世联邦理工学院系统组的博士后研究员。她同样也是Apache Flink项目的PMC成员。作为Flink早期贡献者,Vasiliki参与了图计算库Gelly以及初期版本的Table API和流式SQL的建设工作。 译者介绍 崔星灿,加拿大约克大学博士后,分布式流处理技术和开源爱好者,Apache Flink Committer。
目录
前言 .1
第1 章 状态化流处理概述 .7
传统数据处理架构 .8
事务型处理 8
分析型处理.9

显示全部
用户评论
对于flink入门感觉非常友好
就是好!
作为Flink入门而已非常不错的一本书,翻译也还可以
不错的Flink入门书籍,特别是对于流式算子(满足结合律、交换律的要求的重要性)的特性的说明,以及对窗口的介绍,挺有价值的
认真看了前面5章,快速浏览了后面的内容,跑了几个demo,对flink有了初步的认识,不过总体讲得还是比较浅的,讲api也占了很大部分内容,差了点意思,还是得结合实战项目再来查阅
这书写的算是很好的,有些杠精走开,你行你上,又要入门好,又要源码分析的。主要看的英文版,中文的被老婆霸占了,翻了翻,翻译的还行。
能预见到自己未来一段时间都要当java的概念的搬运工了
下载
收藏