这篇文章主要讲解了“Flink Fold怎么使用”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“Flink Fold怎么使用”吧!
Fold算子:将数据流的每一次输出进行滚动叠加,合并输出结果
示例环境
java.version: 1.8.x
flink.version: 1.11.1
示例数据源
Flink 系例 之 搭建开发环境与数据
Fold.java
import com.flink.examples.DataSource;
import org.apache.flink.api.common.functions.FoldFunction;
import org.apache.flink.api.java.functions.KeySelector;
import org.apache.flink.api.java.tuple.Tuple3;
import org.apache.flink.streaming.api.datastream.KeyedStream;
import org.apache.flink.streaming.api.datastream.SingleOutputStreamOperator;
import org.apache.flink.streaming.api.environment.StreamExecutionEnvironment;
import java.util.List;
/**
* @Description Fold算子:将数据流的每一次输出进行滚动叠加,合并输出结果
* (与Reduce的区别是,Reduce是拿前一次聚合结果累加后一次的并输出数据流;Fold是直接将当前数据对象追加到前一次叠加结果上并输出数据流)
*/
public class Fold {
/**
* 遍历集合,分区打印每一次滚动叠加的结果(示例:按性别分区,按排序,未位追加输出)
* @param args
* @throws Exception
*/
public static void main(String[] args) throws Exception {
final StreamExecutionEnvironment env = StreamExecutionEnvironment.getExecutionEnvironment();
env.setParallelism(4);
List<Tuple3<String,String,Integer>> tuple3List = DataSource.getTuple3ToList();
//注意:使用Integer进行分区时,会导致分区结果不对,转换成String类型输出key即可正确输出
KeyedStream<Tuple3<String,String,Integer>, String> keyedStream = env.fromCollection(tuple3List).keyBy(new KeySelector<Tuple3<String,String,Integer>, String>() {
@Override
public String getKey(Tuple3<String, String, Integer> tuple3) throws Exception {
//f1为性别字段,以相同f1值(性别)进行分区
return String.valueOf(tuple3.f1);
}
});
SingleOutputStreamOperator<String> result = keyedStream.fold("同学:", new FoldFunction<Tuple3<String, String, Integer>, String>() {
@Override
public String fold(String s, Tuple3<String, String, Integer> tuple3) throws Exception {
if (s.startsWith("男") || s.startsWith("女")){
return s + tuple3.f0 + "、";
} else {
return (tuple3.f1.equals("man") ? "男" : "女") + s + tuple3.f0 + "、";
}
}
});
result.print();
env.execute("flink Fold job");
}
}
打印结果
2> 男同学:张三、
2> 男同学:张三、王五、
2> 男同学:张三、王五、吴八、
1> 女同学:李四、
1> 女同学:李四、刘六、
1> 女同学:李四、刘六、伍七、
感谢各位的阅读,以上就是“Flink Fold怎么使用”的内容了,经过本文的学习后,相信大家对Flink Fold怎么使用这一问题有了更深刻的体会,具体使用情况还需要大家实践验证。这里是亿速云,小编将为大家推送更多相关知识点的文章,欢迎关注!
亿速云「云服务器」,即开即用、新一代英特尔至强铂金CPU、三副本存储NVMe SSD云盘,价格低至29元/月。点击查看>>
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。
原文链接:https://my.oschina.net/u/437309/blog/4616881