Kafka分布式集群部署

本文介绍了Kafka作为实时高效流处理系统的特点,强调其分布式集群和副本机制,依赖Zookeeper进行分布式协调。详细步骤包括下载0.8.2.1稳定版Kafka,配置server.properties和producer.properties,分发并修改各服务器配置,以及启动服务和测试数据传输的完整流程。

1:概念和特点

>>是一个消息队列,符合先进先出的原则,它是一个处理流数据的消息系统

>>实时高效的流处理,也就要求支持高吞吐量,需要支持多并发的消费者消费

>>分布式集群,存储在kafka上的数据,和HDFS一样,有副本机制。

>>依赖分布式协调服务zookeeper,包括hadoop生态圈中的HDFS,yarn,Hbase都要依赖zookeeper比如Hbase中master的选举,就是依赖于zookeeper的。Kafka也是通过zookeeper服务实现分布式协调当生产者和kafka集成的过程中,需要先把一些内容(topic的相关信息)写入到zookeeper中,消费者向Kafka消费一个内容也需要先向zookeeper读取内容。

如下图所示

 

对于kafka和zookeeper,类似于HDFS中,datanode对于namenode,kafka的topic一些信息会存放到zookeeper上,用来索引topic对于toipic的内容,可以放到不同的partition上,并且存储在partition上的数据是有副本备份的。发送的消息,是基于内存,内存满了再放到本节点的磁盘上。

2:下载kafkahttp://

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值