hadoop之 mapreduce example（2）

时间 2019-11-11

标签 hadoop mapreduce example 栏目 Hadoop 繁體版

原文原文链接

解释下第一篇程序的意思java

Job ’s setJarByClass() 便于hadoop查找并加载相关的jar包文件apache

FileInputFormat.addInputPath() 设置输入路径，能够是一个文件，也能够是一个文件夹，并且能够被调用屡次，用以加载不一样的输入路径。app

FileOutputFormat.setOutputPath() 设置输出路径，reduce函数会讲文件写入该路径。在job执行前，该文件夹不能存在，不然hadoop会抛出异常.函数

org.apache.hadoop.mapred.FileAlreadyExistsException: Output directory hdfs://hadoop:9000/hadoop/out already exists
    at org.apache.hadoop.mapreduce.lib.output.FileOutputFormat.checkOutputSpecs(FileOutputFormat.java:146)
    at org.apache.hadoop.mapreduce.JobSubmitter.checkSpecs(JobSubmitter.java:266)
    at org.apache.hadoop.mapreduce.JobSubmitter.submitJobInternal(JobSubmitter.java:139)
    at org.apache.hadoop.mapreduce.Job$10.run(Job.java:1290)
    at org.apache.hadoop.mapreduce.Job$10.run(Job.java:1287)
    at java.security.AccessController.doPrivileged(Native Method)
    at javax.security.auth.Subject.doAs(Subject.java:422)
    at org.apache.hadoop.security.UserGroupInformation.doAs(UserGroupInformation.java:1657)
    at org.apache.hadoop.mapreduce.Job.submit(Job.java:1287)
    at org.apache.hadoop.mapreduce.Job.waitForCompletion(Job.java:1308)
    at com.hadoop2.serialize.job.MaxTemperatureJob.main(MaxTemperatureJob.java:46)
    at sun.reflect.NativeMethodAccessorImpl.invoke0(Native Method)
    at sun.reflect.NativeMethodAccessorImpl.invoke(NativeMethodAccessorImpl.java:62)
    at sun.reflect.DelegatingMethodAccessorImpl.invoke(DelegatingMethodAccessorImpl.java:43)
    at java.lang.reflect.Method.invoke(Method.java:497)
    at com.intellij.rt.execution.application.AppMain.main(AppMain.java:144)

经过setMapperClass()和setReducerClass()方法设置map和reduce类型oop

setOutputKeyClass()和setOutputValueClass() 方法用以控制reduce函数输出类型，而且必须匹配reduce函数的输出类型，好比程序中输出key是Text，value 是IntWritable。code

若是map和reduce的输出类型是一致的，就不须要设置map函数的输出类型，默认是一致的。可是若是不同，须要设置map函数的输出类型。orm

job.setInputFormatClass() 能够设置输入类型，默认使用TextInputFormat，因此若是使用文本不须要设置。hadoop

waitForCompletion() 从命名上就能够看出是提交job并等待完成。it

上面的程序是远程执行的，不须要打jar包，我认为这样更加方便。io

1. 2-Hadoop学习之旅-MapReduce
2. hadoop 2 MapReduce框架
3. WordCount MapReduce example
4. Hadoop之mapreduce
5. hadoop之MapReduce
6. Hadoop之MapReduce
7. hadoop之mapreduce
8. Hadoop MapReduce 之wordcount
9. Hadoop 之 MapReduce
10. hadoop之 mapreduce Combiner
更多相关文章...
• Thymeleaf扩展2(Say Hello) - Thymeleaf 教程
• QBC的2种检索方式 - Hibernate教程
• 互联网组织的未来：剖析GitHub员工的任性之源
• TiDB 在摩拜单车在线数据业务的应用和实践