这篇文章给大家分享的是有关hadoop如何实现统计输入行数的MAP的内容。小编觉得挺实用的,因此分享给大家做个参考,一起跟随小编过来看看吧。
import java.io.IOException;
import java.util.regex.Matcher;
import java.util.regex.Pattern;
import org.apache.hadoop.io.LongWritable;
import org.apache.hadoop.io.Text;
import org.apache.hadoop.mapreduce.Mapper;
public class FilterCidMap2 extends Mapper<LongWritable, Text, Text, LongWritable> {
private long count=0;
@Override
protected void map(LongWritable key, Text value, Mapper<LongWritable, Text, Text, LongWritable>.Context context)
throws IOException, InterruptedException {
try {
//取得读取的行数
count=key.get();
//正常逻辑
context.write(new Text(), new LongWritable(1));
} catch (Exception e) {
e.printStackTrace();
}
}
//map 方法调用完后才调用的
@Override
protected void cleanup(Mapper<LongWritable, Text, Text, LongWritable>.Context context)
throws IOException, InterruptedException {
//map清理资源的操作
//在reduce中把linescount取出来就行了
context.write(new Text("linesCount"), new LongWritable(count));
}
}
感谢各位的阅读!关于“hadoop如何实现统计输入行数的MAP”这篇文章就分享到这里了,希望以上内容可以对大家有一定的帮助,让大家可以学到更多知识,如果觉得文章不错,可以把它分享出去让更多的人看到吧!
亿速云「云服务器」,即开即用、新一代英特尔至强铂金CPU、三副本存储NVMe SSD云盘,价格低至29元/月。点击查看>>
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。
原文链接:https://my.oschina.net/chiyong/blog/494120