解释下 第一篇 程序的意思java
Job ’s setJarByClass() 便于hadoop查找并加载相关的jar包文件apache
FileInputFormat.addInputPath() 设置输入路径,能够是一个文件,也能够是一个文件夹,并且能够被调用屡次,用以加载不一样的输入路径。app
FileOutputFormat.setOutputPath() 设置输出路径,reduce函数会讲 文件写入该路径。在job执行前,该文件夹不能存在,不然hadoop会抛出异常.函数
org.apache.hadoop.mapred.FileAlreadyExistsException: Output directory hdfs://hadoop:9000/hadoop/out already exists at org.apache.hadoop.mapreduce.lib.output.FileOutputFormat.checkOutputSpecs(FileOutputFormat.java:146) at org.apache.hadoop.mapreduce.JobSubmitter.checkSpecs(JobSubmitter.java:266) at org.apache.hadoop.mapreduce.JobSubmitter.submitJobInternal(JobSubmitter.java:139) at org.apache.hadoop.mapreduce.Job$10.run(Job.java:1290) at org.apache.hadoop.mapreduce.Job$10.run(Job.java:1287) at java.security.AccessController.doPrivileged(Native Method) at javax.security.auth.Subject.doAs(Subject.java:422) at org.apache.hadoop.security.UserGroupInformation.doAs(UserGroupInformation.java:1657) at org.apache.hadoop.mapreduce.Job.submit(Job.java:1287) at org.apache.hadoop.mapreduce.Job.waitForCompletion(Job.java:1308) at com.hadoop2.serialize.job.MaxTemperatureJob.main(MaxTemperatureJob.java:46) at sun.reflect.NativeMethodAccessorImpl.invoke0(Native Method) at sun.reflect.NativeMethodAccessorImpl.invoke(NativeMethodAccessorImpl.java:62) at sun.reflect.DelegatingMethodAccessorImpl.invoke(DelegatingMethodAccessorImpl.java:43) at java.lang.reflect.Method.invoke(Method.java:497) at com.intellij.rt.execution.application.AppMain.main(AppMain.java:144)
经过setMapperClass()和setReducerClass()方法 设置map和reduce类型oop
setOutputKeyClass()和setOutputValueClass() 方法用以控制reduce函数输出类型,而且必须匹配reduce函数的输出类型,好比程序中输出key是Text,value 是IntWritable。code
若是map和reduce的输出类型是一致的,就不须要设置map函数的输出类型,默认是一致的。可是若是不同,须要设置map函数的输出类型。orm
job.setInputFormatClass() 能够设置输入类型,默认使用TextInputFormat,因此 若是使用文本不须要设置。hadoop
waitForCompletion() 从命名上就能够看出是 提交job并等待完成。it
上面的程序是远程执行的,不须要打jar包,我认为这样更加方便。io