本篇内容介绍了“Flink的MaxBy怎么用”的有关知识,在实际案例的操作过程中,不少人都会遇到这样的困境,接下来就让小编带领大家学习一下如何处理这些情况吧!希望大家仔细阅读,能够学有所成!
maxBy聚合:获取一组数据流算子中最大的记录行(和max的区别,max是返回计算字段的最大值)
示例环境
java.version: 1.8.x
flink.version: 1.11.1
示例数据源 (项目码云下载)
Flink 系例 之 搭建开发环境与数据
MaxBy.java
import com.flink.examples.DataSource;
import org.apache.flink.api.common.typeinfo.Types;
import org.apache.flink.api.java.functions.KeySelector;
import org.apache.flink.api.java.tuple.Tuple3;
import org.apache.flink.streaming.api.datastream.DataStream;
import org.apache.flink.streaming.api.environment.StreamExecutionEnvironment;
import java.util.List;
/**
* @Description maxBy聚合:获取一组数据流算子中最大的记录行(和max的区别,max是返回计算字段的最大值)
*/
public class MaxBy {
/**
* 遍历集合,返回每个性别分区下最大年龄数据记录
* @param args
* @throws Exception
*/
public static void main(String[] args) throws Exception {
final StreamExecutionEnvironment env = StreamExecutionEnvironment.getExecutionEnvironment();
List<Tuple3<String, String, Integer>> tuple3List = DataSource.getTuple3ToList();
DataStream<Tuple3<String, String, Integer>> dataStream = env.fromCollection(tuple3List)
.returns(Types.TUPLE(Types.STRING, Types.STRING,Types.INT))
.keyBy((KeySelector<Tuple3<String, String, Integer>, String>) k ->k.f1)
//按数量窗口滚动,每3个输入数据流,计算一次
.countWindow(3)
//注意:计算变量为f2
.maxBy(2);
dataStream.print();
env.execute("flink MaxBy job");
}
}
打印结果
4> (刘六,girl,32)
2> (吴八,man,30)
“Flink的MaxBy怎么用”的内容就介绍到这里了,感谢大家的阅读。如果想了解更多行业相关的知识可以关注亿速云网站,小编将为大家输出更多高质量的实用文章!
亿速云「云服务器」,即开即用、新一代英特尔至强铂金CPU、三副本存储NVMe SSD云盘,价格低至29元/月。点击查看>>
免责声明:本站发布的内容(图片、视频和文字)以原创、转载和分享为主,文章观点不代表本网站立场,如果涉及侵权请联系站长邮箱:is@yisu.com进行举报,并提供相关证据,一经查实,将立刻删除涉嫌侵权内容。
原文链接:https://my.oschina.net/u/437309/blog/4733889