内容简介 本书内容分为两大部分。第一部分(第1章到第5章)从非常高的层次介绍分布式计算,讨论如何在集群上运行计算。第二部分(第6章到第10章)更加具体地关注数据科学家应该了解的工具和技术,意在为各种分析和大规模数据管理提供动力。