Big Data, MapReduce, Hadoop, and Spark with Python

此书不错,很短,且想打通PYTHON和大数据架构的关系。 先看一次,计划把这个文档作个翻译。 先来一个模拟MAPREDUCE的东东。。。 mapper.py class Mapper: def map(self, data): returnval = [] counts = {} for line in data: w
相关文章
相关标签/搜索