Flink入门使用

启动本地运行

首先找一台安装了hadoop的linux。

将安装包解压，到bin目录启动local模式的脚本。

tar -zxvf flink-1.3.1-bin-hadoop26-scala_2.11.tgz

./start-local.sh

运行wordCount例子

这个例子从sokect端口中每隔5秒读取其中的输入并进行记数。

//执行完nc输入单词，程序会开始记数。

nc -l 9001

//开另一个xshell，执行运行程序的命令

./bin/flink run examples/streaming/SocketWindowWordCount.jar --port 9001

//到log目录下可以看到输出了记数的文件

运行的jar中的源码如下：

package org.apache.flink.streaming.examples.socket;

import org.apache.flink.api.common.functions.FlatMapFunction;

import org.apache.flink.api.common.functions.ReduceFunction;

import org.apache.flink.api.java.utils.ParameterTool;

import org.apache.flink.streaming.api.datastream.DataStream;

import org.apache.flink.streaming.api.environment.StreamExecutionEnvironment;

import org.apache.flink.streaming.api.windowing.time.Time;

import org.apache.flink.util.Collector;

@SuppressWarnings("serial")

public class SocketWindowWordCount {

	public static void main(String[] args) throws Exception {

		// the host and the port to connect to

		final String hostname;

		final int port;

		try {

			final ParameterTool params = ParameterTool.fromArgs(args);

			hostname = params.has("hostname") ? params.get("hostname") : "localhost";

			port = params.getInt("port");

		} catch (Exception e) {

			System.err.println("No port specified. Please run 'SocketWindowWordCount " +

				"--hostname <hostname> --port <port>', where hostname (localhost by default) " +

				"and port is the address of the text server");

			System.err.println("To start a simple text server, run 'netcat -l <port>' and " +

				"type the input text into the command line");

			return;

		}

		// get the execution environment

		final StreamExecutionEnvironment env = StreamExecutionEnvironment.getExecutionEnvironment();

		// get input data by connecting to the socket

		DataStream<String> text = env.socketTextStream(hostname, port, "\n");

		// parse the data, group it, window it, and aggregate the counts

		DataStream<WordWithCount> windowCounts = text

				.flatMap(new FlatMapFunction<String, WordWithCount>() {

					@Override

					public void flatMap(String value, Collector<WordWithCount> out) {

						for (String word : value.split("\\s")) {

							out.collect(new WordWithCount(word, 1L));

						}

					}

				})

				.keyBy("word")

				.timeWindow(Time.seconds(5))

				.reduce(new ReduceFunction<WordWithCount>() {

					@Override

					public WordWithCount reduce(WordWithCount a, WordWithCount b) {

						return new WordWithCount(a.word, a.count + b.count);

					}

				});

		// print the results with a single thread, rather than in parallel

		windowCounts.print().setParallelism(1);

		env.execute("Socket Window WordCount");

	}

	/**

	 * Data type for words with count.

	 */

	public static class WordWithCount {

		public String word;

		public long count;

		public WordWithCount() {}

		public WordWithCount(String word, long count) {

			this.word = word;

			this.count = count;

		}

		@Override

		public String toString() {

			return word + " : " + count;

		}

	}

}

创建flink项目

window的命令行执行以下命令即可下载一个模板项目，导入IDE中就可以愉快地撸了。

mvn archetype:generate -DarchetypeGroupId=org.apache.flink -DarchetypeArtifactId=flink-quickstart-java -DarchetypeVersion=1.3.0

Flink入门使用的更多相关文章

Flink入门（二）——Flink架构介绍
1.基本组件栈了解Spark的朋友会发现Flink的架构和Spark是非常类似的,在整个软件架构体系中,同样遵循着分层的架构设计理念,在降低系统耦合度的同时,也为上层用户构建Flink应用提供了丰富 ...
Flink入门（三）——环境与部署
flink是一款开源的大数据流式处理框架,他可以同时批处理和流处理,具有容错性.高吞吐.低延迟等优势,本文简述flink在windows和linux中安装步骤,和示例程序的运行,包括本地调试环境,集群 ...
Flink入门（四）——编程模型
flink是一款开源的大数据流式处理框架,他可以同时批处理和流处理,具有容错性.高吞吐.低延迟等优势,本文简述flink的编程模型. 数据集类型: 无穷数据集:无穷的持续集成的数据集合有界数据集:有 ...
Flink入门（五）——DataSet Api编程指南
Apache Flink Apache Flink 是一个兼顾高吞吐.低延迟.高性能的分布式处理框架.在实时计算崛起的今天,Flink正在飞速发展.由于性能的优势和兼顾批处理,流处理的特性,Flink ...
不一样的Flink入门教程
前言微信搜[Java3y]关注这个朴实无华的男人,点赞关注是对我最大的支持! 文本已收录至我的GitHub:https://github.com/ZhongFuCheng3y/3y,有300多篇原创 ...
Flink入门-第一篇：Flink基础概念以及竞品对比
Flink入门-第一篇:Flink基础概念以及竞品对比 Flink介绍截止2021年10月Flink最新的稳定版本已经发展到1.14.0 Flink起源于一个名为Stratosphere的研究项目主 ...
flink 入门
http://ifeve.com/flink-quick-start/ http://vinoyang.com/2016/05/02/flink-concepts/ http://wuchong.me ...
Flink入门宝典（详细截图版）
本文基于java构建Flink1.9版本入门程序,需要Maven 3.0.4 和 Java 8 以上版本.需要安装Netcat进行简单调试. 这里简述安装过程,并使用IDEA进行开发一个简单流处理程序 ...
记一次flink入门学习笔记
团队有几个系统数据量偏大,且每天以几万条的数量累增.有一个系统每天需要定时读取数据库,并进行相关的业务逻辑计算,从而获取最新的用户信息,定时任务的整个耗时需要4小时左右.由于定时任务是夜晚执行,目前看 ...
第02讲：Flink 入门程序 WordCount 和 SQL 实现
我们右键运行时相当于在本地启动了一个单机版本.生产中都是集群环境,并且是高可用的,生产上提交任务需要用到flink run 命令,指定必要的参数. 本课时我们主要介绍 Flink 的入门程序以及 SQ ...

随机推荐

[国嵌攻略][174][CGI快速入门-网页控制LED]
CGI程序(Common Gate Way Interface) 在服务器外部供服务器调用的程序,CGI程序与服务器配合后能让服务器完成更强大的功能. 1.浏览器通过HTML表单或超链接请求指向一个C ...
IntelliJ IDEA 2017.3下载与安装
大约在2017年暑假的时候知道了IntelliJ IDEA,但是那个时候一心认为有Eclipse就足够用了,然而今天在网上冲浪的时候发现,IntelliJ IDEA是java语言开发的集成环境,这款开 ...
Spark算子--distinct
distinct--Transformation类算子代码示例
HtmlHelper总结
HTML helper是在视图页面上操作HTML元素时可以调用的方法,还包括URL helper和AJAX helper.这些帮助方法都为了使得操作HTML更加容易.分为两类:a.编辑和输入帮助类b. ...
Django将request对象传入模板配置
对于很多时候,需要从模板中获取很请求中很多内容,比如当前请求的url,当前的session变量中的某个值,这时候我们可以通过配置可将request对象传递进模板. django1.10版本: sett ...
ASP.NET Core Razor页面禁用防伪令牌验证
在这篇短文中,我将向您介绍如何ASP.NET Core Razor页面中禁用防伪令牌验证. Razor页面是ASP.NET Core 2.0中增加的一个页面控制器框架,用于构建动态的.数据驱动的网站: ...
使用vue 遇到的问题————— 解决手机实时显示项目
Vue项目文件组织架构: src文件夹存放源代码. Static文件夹存放第三方静态资源. git将项目上传github http://blog.csdn.net/laozitianxia/ ...
Linux安装mysql 在/etc下没有my.cnf 解决办法
进入 /usr/share/mysql 将my-medium.cnf 移动到etc 并且改名为my.cnf
linux如何自动获取ip地址
第一步:激活网卡系统装好后默认的网卡是eth0,用下面的命令将这块网卡激活. # ifconfig eth0 up 第二步:设置网卡进入系统时启动想要每次开机就可以自动获取IP地址上网,就要设置网 ...
CColor类封装
CColor类封装 Color.h #pragma once #include <sstream> #include <string> using namespace std; ...

Flink入门使用

启动本地运行

运行wordCount例子

创建flink项目

Flink入门使用的更多相关文章

随机推荐

热门专题