2023年2月16日
Flink 集群部署
大数据 · Flink · 流处理
在三台服务器上部署 Flink 集群,用于分布式计算。
期间准备好 Jdk、hadoop 并启动hadoop
解压和设置flink环境变量
修改配置文件
启动 $FLINK_HOME/bin/start-cluster.sh
在哪个机器上运行这条命令 就会在那台机器上开放web端口
提交任务
正在运行的作业查看 flink list| flink list -a
关闭运行的作业 flink cancel <JOB_ID>
Flink的运行模式
独立模式 (Standalone)
独立模式包含以下部署方式:
单作业模式(借助其他管理平台如yarn、k8s)
会话模式
应用模式
YARN模式
将Flink应用提交给 Yarn的 ResourceManager
1、启动hadoop集群
2、检查环境变量是否有
3、重启hadoop yarn
4、启动flink on yarn yarn-session.sh -nm test -d
参数:
-nm <NAME>
-d 分离模式
-jm JobManager 所需内存 单位MB
-qu 指定yarn队列名
-tm 每个TaskManager 所所用内存
5、提交作业 flink run
其他:
Flink 运行报错
解决办法 修改log4j配置文件
新建log4j.properties文件

将其中的内容修改为以下内容:
然后重启flink,重新提交作业,应该就可以解决问题了。