Flink安装部署

Flinkflink安装部署(1) Flink集群的搭建,local,standalone,flink on yarn。 阅读详情

一、Standalone集群模式安装部署

conda deactivate 退出 base环境

Flink支持多种安装模式。

local(本地)——本地模式

standalone——独立模式,Flink自带集群,开发测试环境使用

standaloneHA—独立集群高可用模式,Flink自带集群,开发测试环境使用

yarn——计算资源统一由Hadoop YARN管理,生产环境测试

下载链接:https://archive.apache.org/dist/flink/flink-1.13.1/flink-1.13.1-bin-scala_2.11.tgz

二、上传Flink安装包,解压,配置环境变量

解压:tar -zxf flink-1.13.6-bin-scala_2.11.tgz -C /opt/installs/

修改名称:mv flink-1.13.6/ flink

添加环境变量:vim /etc/profile

export FLINK_HOME=/opt/installs/flink
export PATH=$PATH:$FLINK_HOME/bin
export HADOOP_CONF_DIR=/opt/installs/hadoop/etc/hadoop

刷新:source /etc/profile

三、修改flink的配置文件

1.vi /opt/installs/flink/conf/flink-conf.yaml

jobmanager.rpc.address: bigdata01
taskmanager.numberOfTaskSlots: 2
web.submit.enable: true

#历史服务器  如果HDFS是高可用,则复制core-site.xml、hdfs-site.xml到flink的conf目录下   hadoop11:8020 -> hdfs-cluster
jobmanager.archive.fs.dir: hdfs://bigdata01:9820/flink/completed-jobs/
historyserver.web.address: bigdata01
historyserver.web.port: 8082
historyserver.archive.fs.dir: hdfs://bigdata01:9820/flink/completed-jobs/

2.vi /opt/installs/flink/conf/masters

bigdata01:8081

3.vi /opt/installs/flink/conf/workers

bigdata01
bigdata02
bigdata03

四、上传jar包

将flink-shaded-hadoop-2-uber-2.7.5-10.0.jar放到flink的lib目录下(没有的可以私下联系我)

五、将flink的配置以及环境变量分发到其他两台虚拟机上(自己一个个配置也可以,内容不变)

六、启动

#启动HDFS  
start-dfs.sh
#启动集群
start-cluster.sh
#启动历史服务器
historyserver.sh start

假如 historyserver 无法启动,也就没有办法访问 8082 服务,原因大概是你没有上传 关于 hadoop 的 jar 包到 lib 下:

观察webUI

http://bigdata01:8081   -- Flink集群管理界面    当前有效,重启后里面跑的内容就消失了
能够访问8081是因为你的集群启动着呢
http://bigdata01:8082   -- Flink历史服务器管理界面,及时服务重启,运行过的服务都还在
能够访问8082是因为你的历史服务启动着

两者的区别:首先可以先把服务都停止

然后再重启,发现8081上已经完成的任务中是空的,而8082上的历史任务都还在,原因是8082读取了hdfs上的一些数据,而8081没有。

但是从web提供的功能来看,8081提供的功能还是比8082要丰富的多。

七、提交官方示例

flink run  /opt/installs/flink/examples/batch/WordCount.jar
或者
flink run  /opt/installs/flink/examples/batch/WordCount.jar --input 输入数据路径 --output 输出数据路径

flink run  /opt/installs/flink/examples/batch/WordCount.jar --input /home/wc.txt --output /home/result

运行以上案例时,会出现有时候运行成功,有时候运行失败的问题:

Caused by: java.io.FileNotFoundException: /home/wc.txt (没有那个文件或目录)
        at java.io.FileInputStream.open0(Native Method)
        at java.io.FileInputStream.open(FileInputStream.java:195)
        at java.io.FileInputStream.<init>(FileInputStream.java:138)
        at org.apache.flink.core.fs.local.LocalDataInputStream.<init>(LocalDataInputStream.java:50)
        at org.apache.flink.core.fs.local.LocalFileSystem.open(LocalFileSystem.java:134)
        at org.apache.flink.api.common.io.FileInputFormat$InputSplitOpenThread.run(FileInputFormat.java:1053)
原因是:你的 taskManager 有三台,你的数据只在本地存放一份,所以需要将数据分发给 bigdata02 和 bigdata03

xsync.sh /home/wc.txt(三台都必须有这个txt文件才可以)

Flink安装部署 (1) 下载flinkflink-1.13.1-bin-scala_2.11.tgzhttps://flink.apache.org/downloads.html(2)上传flink到linux本地模式安装 | Apache Flinkconf/master conf/workers flink-conf.yaml Stream测试案例: Batch测试案例: 2. Flink 架构 https://ci.apache.org/projects/flink/flink-docs-release-1.13/ 阅读详情

相关推荐

Flink 安装部署与快速入门

(一)、Flink 安装部署与快速入门(xxbj) 一、flink概述 1、为什么选用flink? 不仅仅是一个高吞吐、低延迟的计算引擎,同时还提供很多高级的功能。:有状态的计算、支持强一致性语义以及至此基于Event Time的WaterMark对延迟或者乱序的数据进行处理 2、flink组件 物理部署层 本地、独立集群、yarn管理集群上、云上 runtime核心层 该层为上层不同接口提供基础服务;也是flink分布式计算框架的核心实现层支持分布式stream作业的执行、jobgraph到ex

qq_43528451的博客 3421

Flink教程(1)-集群安装部署

Flink教程。Flink集群安装部署Flink 是一个同时具备流数据处理和批数据处理的分布式计算框架。Flink代码主要是由 Java 实现,部分代码由 Scala实现。Flink既可以处理有界的批量数据集、也可以处理无界的实时数据集。就业界的使用情况而言,Flink处理的主要场景是流式数据。Flink不同于Spark、Hadoop, Flink称得上是一款真正的流、批统一的大数据计算框架。

鸟哥哥的专栏 2万+

Flink安装部署的几种模式详解

Flink安装部署:Local本地模式|Standalone独立集群模式|Standalone-HA高可用集群模式|Flink On Yarn模式 我这里电脑上有三台安装好的虚拟机分别是node1、node2、node3 Local本地模式: 原理:主节点JobManager(Master)和从节点TaskManager(Slave)在一台机器上模拟 1、Flink程序由JobClient进行提交 2、JobClient将任务提交给JobManager 3、JobManager只负责协调...

ing 8179

Flink学习连载文档第一篇--Flink集群的安装

Flink支持多种安装模式。local(本地)——本地模式standalone——独立模式,Flink自带集群,开发测试环境使用standaloneHA—独立集群高可用模式,Flink自带集群,开发测试环境使用yarn——计算资源统一由Hadoop YARN管理,生产环境测试。

二进制专栏 1082

Flink学习之旅:(一)Flink部署安装

进入Flink官网,点击Downloads往下滑动就可以看到 Flink 的所有版本了,看自己需要什么版本点击下载即可。

小健的博客 5130

flink和pyflink安装部署

Flink和Pyflink在linux的安装部署Python版本Python版本功能快捷键合理的创建标题,有助于目录的生成如何改变文本的样式插入链接与图片如何插入一段漂亮的代码片生成一个适合你的列表创建一个表格设定内容居中、居左、居右SmartyPants创建一个自定义列表如何创建一个注脚注释也是必不可少的KaTeX数学公式新的甘特图功能,丰富你的文章UML 图表FLowchart流程图导出与导入导出导入 Python版本 在安装之前需要查询Python版本,打开终端查询Python版本。 python

qq_44953566的博客 3391

【hadoop】Flink安装部署

Apache Flink 是一个框架和分布式处理引擎,用于无界和有界数据流进行有状态的计算。Flink能在所以常见集群环境中运行,并以内存速度和任意规模进行计算。

2401_83769134的博客 1011

Flink1.13.2三种方式安装部署

有位Flink初学者问我有没有Flink安装教程,看到这后,土哥二话不说直接安排上。 以下教程全部使用 Flink1.13.2版本,在普通用户下面部署: 1、Standalone部署 版本要求: 版本 节点 部署方式 flink-1.13.2-bin-scala_2.11.tgz 192.168.244.129 standalone 1.1 将软件安装包放入集群中 1.2、软件包解压 tar -zxvf flink-1.13.2-bin-scala_2.11

逆流而上Mr李 1万+

Flink安装部署

Flink安装部署 首先打开终端 ,在/home/xxx/ 下执行命令获取安装包: wget https://labfile.oss.aliyuncs.com/courses/3423/flink-1.10.0-bin-scala_2.11.tar tar -xvf flink-1.10.0-bin-scala_2.11.tar 将其解压到该目录下。 如果你学习过 Spark 的话,那么你应该会觉得接下来的内容似曾相识。在 Flink 中有三种部署模式,分别是 Standalone、Yarn 模式和 K

Colin_lqk的博客 610

flink+clinkhouse安装部署

如果服务器上已有其他服务占用 9000 端口,那么将 ClickHouse 的端口改为 9001 是很有必要的。TaskManager 是 Flink 的 “工作节点”,负责执行具体的计算任务(如算子、函数),是实际处理数据的组件。添加后,重启集群时,Flink 进程会自动加载 Hadoop 相关的类,解决与 HDFS/YARN 集成时的类缺失问题。这行配置的作用是让 Flink 进程加载 Hadoop 的类路径,确保能正常调用 Hadoop 相关 API。在编辑器中,esc进入命令模式,输入。

更深兼春远的博客 1241

Flink 怎么部署安装

前言 本文隶属于专栏《1000个问题搞定大数据技术体系》,该专栏为笔者原创,引用请注明来源,不足和错误之处请在评论区帮忙指出,谢谢! 本专栏目录结构和参考文献请见1000个问题搞定大数据技术体系 正文 部署安装准备工作: 关闭防火墙,关闭selinux,安装jdk,更改主机名,更改主机名与IP地址的映射关系,ssh免密码登录等 1、Flink的local模式部署安装 在local模式下,不需要启动任何的进程,仅仅是使用本地线程来模拟flink的进程,适用于测试开发调试等,这种模式下,不用更改任何配置,只

Shockang的博客 1万+

Flink1.16集群安装部署

Flink1.16集群安装部署

weixin_42263032的博客 5685

Flink——角色及安装部署

一、Flink 中的角色 Flink 也遵循主从原则,主节点为JobManager,从节点为TaskManager 1.1. Client 将任务提交到JobManager,并和JobManager进行任务交互获取任务执行状态。 1.2. JobManager 负责任务的调度和资源的管理。负责Checkpoint的协调过程。 获取到客户端的任务后,会根据集群中 TaskManager 上 TaskSlot 的使用情况, 为提交的任务分配相应的 TaskSlots 资源,并命令 TaskManager 启动

h1231233211的博客 749

flink部署操作-flink standalone集群安装部署

flink集群安装部署 standalone集群模式 必须依赖 必须的软件 JAVA_HOME配置 flink安装 配置flink 启动flink 添加Jobmanager/taskmanager 实例到集群 个人真实环境实践安装步骤 必须依赖 必须的软件 flink运行在所有类unix环境中,例如:linux、mac、或者cygwin,并且集群由一个master节...

大数据技术博客 1万+

Flink 安装部署

本文介绍了Apache Flink安装部署指南,包括单机、分布式集群和YARN/Docker部署方式。主要内容涵盖:环境准备(JDK、Hadoop)、下载安装包、配置环境变量、Flink集群配置、启动与停止方法、任务提交等基础操作;详细说明了分布式集群部署步骤、高可用模式配置(基于ZooKeeper)以及YARN集群部署方案;还提供了Docker快速部署方式和常用运维管理命令,并列出了端口冲突、内存不足等常见问题的解决方案。

onlymscn的博客 1344

Flink安装部署

Flink安装部署 [本地模式​] 一、下载 wget https://mirrors.bfsu.edu.cn/apache/flink/flink-1.12.1/flink-1.12.1-bin-scala_2.11.tgz 二、解压 tar -zxvf flink-1.12.1-bin-scala_2.11.tgz -C ../software/ 三、配置bash脚本 1.vim ~/.bash_profile export FLINK_HOME=/usr/local/fli.

窦永厚 215

Flink安装部署详细指南

负责协调分布式任务的执行,如调度任务、协调检查点(Checkpoint)、故障恢复等。它是集群的“大脑”。负责执行数据流中的具体任务(Tasks),并提供内存来存储缓存数据。每个 Worker 都是一个 JVM 进程。先启动一个长期运行的集群(包含 JobManager 和 TaskManagers),然后向这个集群提交多个作业。所有作业共享集群资源。适合执行时间短、交互式的查询作业。为每个提交的作业启动一个独立的集群。作业完成后,集群资源释放。作业之间资源隔离性好,适合长期运行的大型作业。

ITHomeZSL的博客 1208
上一篇: JAVA多线程的四种创建方式
下一篇: Mysql如何批量删除海量数据
lkd1218
博客等级 码龄4年 159粉丝 17原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值