全面、深入地总结资深工程师多年大数据项目实战经验
理论结合实践,由浅入深地展现Spark性能优化的核心技术
实用性强:不但介绍理论知识,而且结合350多个示例和多个实战案例解析Spark性能优化的核心技术与应用,帮助读者更好地实施优化策略。
适用面广:无论是Spark性能优化初学者,还是开发人员、数据工程师和数据科学家等从业人员,都可以从本书中获得需要的知识和技能。
前瞻性强:基于Spark的新版本写作,不但介绍其新特性,而且介绍其集成Hadoop、Kafka和Elasticsearch使用时的性能优化方法。
讲解深入:对Spark性能优化的核心技术与工作原理进行深入讲解,以便让读者能够理解Spark的内部结构和运行机制,从而更有效地对其性能进行优化。
本书赞誉
曾有幸与作者共同参与过大数据领域相关工程的实施,作者对技术的研究与探索给我留下了深刻的印象。如今他将多年的经验进行总结与分享,相信能够给大数据领域的各位同仁带来帮助。本书结合常见的应用场景,系统地梳理了Spark性能优化所需要的核心技术,给出了清晰的解决思路,并在讲解的过程中辅以实践案例,从而帮助读者更好地理解。本书内容丰富,结构清晰,分析透彻,可帮助读者系统地学习Spark性能优化技术,也可作为技术手册供读者随时查阅和参考,相信广大读者一定能够从中受益。
——中国农业银行研发中心资深设计师 庞浩然
我曾有幸与本书作者并肩工作,他对技术的执着追求和不懈创新精神深深地影响了周围的同事。在如今这个数据为王的时代,Apache Spark在大数据领域的地位无可撼动,特别是面对大规模数据处理时的性能优化问题,它更是具有很大的优势。本书以通俗易懂的语言深入剖析Spark的底层逻辑,详细解读数据架构,并结合精心挑选的代码示例和实际应用案例,从Spark的底层架构和业务应用层面,为读者展示如何全方位地进行性能优化。无论你是大数据处理领域的学术研究人员,还是一线从业人员,本书都能对你学习和研究Spark性能优化提供很大的价值。
——京东集团资深算法技术专家 李虎
本书作者深耕大数据行业多年,造诣颇深。拜读他写的这本书,令人耳目一新。作者对Spark的各种优化技术和策略进行了详细讲解,引导读者从多方面理解Spark性能优化,帮助他们提升不同应用场景的Spark运行效率,从而突破工作中遇到的性能瓶颈,获得良好的性能表现。同时,作者总结了自己多年从事大数据工作积累的丰富的实战经验,并通过精选案例带领读者动手实践,从而加深读者的理解,提高他们的实战水平。可以说,本书既是一部学习Spark性能优化的佳作,也是一部不可多得的实用工具书,推荐给大数据技术爱好者阅读,相信会获益颇丰。
——庸沐康美科技CEO/博士 杨汉军
