博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
Kafka安装及部署
阅读量:5160 次
发布时间:2019-06-13

本文共 6850 字,大约阅读时间需要 22 分钟。

 安装及部署

一、环境配置

  • 操作系统:Cent OS 7

  • Kafka版本:0.9.0.0

  • Kafka官网下载:

  • JDK版本:1.7.0_51

  • SSH Secure Shell版本:XShell 5

二、操作过程

1、下载Kafka并解压

  • 下载:

curl -L -O http://mirrors.cnnic.cn/apache/kafka/0.9.0.0/kafka_2.10-0.9.0.0.tgz
  • 解压:

tar zxvf kafka_2.10-0.9.0.0.tgz

2、Kafka目录介绍

  • /bin 操作kafka的可执行脚本,还包含windows下脚本

  • /config 配置文件所在目录

  • /libs 依赖库目录

  • /logs 日志数据目录,目录kafka把server端日志分为5种类型,分为:server,request,state,log-cleaner,controller

3、配置

  • 配置zookeeper

请参考

  • 进入kafka安装工程根目录编辑config/server.properties

kafka最为重要三个配置依次为:broker.id、log.dir、zookeeper.connect,kafka server端config/server.properties参数说明和解释如下:

4、启动Kafka

  • 启动

进入kafka目录,敲入命令 bin/kafka-server-start.sh config/server.properties &
  • 检测2181与9092端口

netstat -tunlp|egrep "(2181|9092)"tcp        0      0 :::2181                     :::*                        LISTEN      19787/java          tcp        0      0 :::9092                     :::*                        LISTEN      28094/java

说明:

Kafka的进程ID为28094,占用端口为9092

QuorumPeerMain为对应的zookeeper实例,进程ID为19787,在2181端口监听

5、单机连通性测试

启动2个XSHELL客户端,一个用于生产者发送消息,一个用于消费者接受消息。

  • 运行producer,随机敲入几个字符,相当于把这个敲入的字符消息发送给队列。

bin/kafka-console-producer.sh --broker-list 192.168.153.118:9092 --topic test

说明:早版本的Kafka,–broker-list 192.168.1.181:9092需改为–zookeeper 192.168.1.181:2181

  • 运行consumer,可以看到刚才发送的消息列表。

bin/kafka-console-consumer.sh --zookeeper 192.168.153.118:2181 --topic test --from-beginning
  • 注意:

producer,指定的Socket(192.168.1.181+9092),说明生产者的消息要发往kafka,也即是broker

consumer, 指定的Socket(192.168.1.181+2181),说明消费者的消息来自zookeeper(协调转发)

上面的只是一个单个的broker,下面我们来实验一个多broker的集群。

6、搭建一个多个broker的伪集群

刚才只是启动了单个broker,现在启动有3个broker组成的集群,这些broker节点也都是在本机上。

(1)为每一个broker提供配置文件

我们先看看config/server0.properties配置信息:

broker.id=0listeners=PLAINTEXT://:9092port=9092host.name=192.168.1.181num.network.threads=4num.io.threads=8socket.send.buffer.bytes=102400socket.receive.buffer.bytes=102400socket.request.max.bytes=104857600log.dirs=/tmp/kafka-logsnum.partitions=5num.recovery.threads.per.data.dir=1log.retention.hours=168log.segment.bytes=1073741824log.retention.check.interval.ms=300000log.cleaner.enable=falsezookeeper.connect=192.168.1.181:2181zookeeper.connection.timeout.ms=6000queued.max.requests =500log.cleanup.policy = delete
  • 说明:

broker.id为集群中唯一的标注一个节点,因为在同一个机器上,所以必须指定不同的端口和日志文件,避免数据被覆盖。

在上面单个broker的实验中,为什么kafka的端口为9092,这里可以看得很清楚。

kafka cluster怎么同zookeeper交互的,配置信息中也有体现。

那么下面,我们仿照上面的配置文件,提供2个broker的配置文件:

  • server1.properties:

按 Ctrl+C 复制代码
按 Ctrl+C 复制代码
  • server2.properties:

broker.id=2listeners=PLAINTEXT://:9094port=9094host.name=192.168.1.181num.network.threads=4num.io.threads=8socket.send.buffer.bytes=102400socket.receive.buffer.bytes=102400socket.request.max.bytes=104857600log.dirs=/tmp/kafka-logs2num.partitions=5num.recovery.threads.per.data.dir=1log.retention.hours=168log.segment.bytes=1073741824log.retention.check.interval.ms=300000log.cleaner.enable=falsezookeeper.connect=192.168.1.181:2181zookeeper.connection.timeout.ms=6000queued.max.requests =500log.cleanup.policy = delete
(2)启动所有的broker

命令如下:

bin/kafka-server-start.sh config/server0.properties &   #启动broker0bin/kafka-server-start.sh config/server1.properties & #启动broker1bin/kafka-server-start.sh config/server2.properties & #启动broker2

查看2181、9092、9093、9094端口

netstat -tunlp|egrep "(2181|9092|9093|9094)"tcp        0      0 :::9093                     :::*                        LISTEN      29725/java          tcp        0      0 :::2181                     :::*                        LISTEN      19787/java          tcp        0      0 :::9094                     :::*                        LISTEN      29800/java          tcp        0      0 :::9092                     :::*                        LISTEN      29572/java

一个zookeeper在2181端口上监听,3个kafka cluster(broker)分别在端口9092,9093,9094监听。

(3)创建topic
bin/kafka-topics.sh --create --topic topic_1 --partitions 1 --replication-factor 3  \--zookeeper localhost:2181bin/kafka-topics.sh --create --topic topic_2 --partitions 1 --replication-factor 3  \--zookeeper localhost:2181bin/kafka-topics.sh --create --topic topic_3 --partitions 1 --replication-factor 3  \--zookeeper localhost:2181

查看topic创建情况:

bin/kafka-topics.sh --list --zookeeper localhost:2181testtopic_1topic_2topic_3[root@atman081 kafka_2.10-0.9.0.0]# bin/kafka-topics.sh --describe --zookeeper localhost:2181Topic:test	PartitionCount:1	ReplicationFactor:1	Configs:	Topic: test	Partition: 0	Leader: 0	Replicas: 0	Isr: 0Topic:topic_1	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_1	Partition: 0	Leader: 2	Replicas: 2,1,0	Isr: 2,1,0Topic:topic_2	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_2	Partition: 0	Leader: 1	Replicas: 1,2,0	Isr: 1,2,0Topic:topic_3	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_3	Partition: 0	Leader: 0	Replicas: 0,2,1	Isr: 0,2,1

上面的有些东西,也许还不太清楚,暂放,继续试验。需要注意的是topic_1的Leader=2

(4)模拟客户端发送,接受消息
  • 发送消息

bin/kafka-console-producer.sh --topic topic_1 --broker-list 192.168.1.181:9092,192.168.1.181:9093,192.168.1.181:9094
  • 接收消息

bin/kafka-console-consumer.sh --topic topic_1 --zookeeper 192.168.1.181:2181 --from-beginning

需要注意,此时producer将topic发布到了3个broker中,现在就有点分布式的概念了。

(5) kill some broker

kill broker(id=0)

首先,我们根据前面的配置,得到broker(id=0)应该在9092监听,这样就能确定它的PID了。

broker0没kill之前topic在kafka cluster中的情况

bin/kafka-topics.sh --describe --zookeeper localhost:2181Topic:test	PartitionCount:1	ReplicationFactor:1	Configs:	Topic: test	Partition: 0	Leader: 0	Replicas: 0	Isr: 0Topic:topic_1	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_1	Partition: 0	Leader: 2	Replicas: 2,1,0	Isr: 2,1,0Topic:topic_2	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_2	Partition: 0	Leader: 1	Replicas: 1,2,0	Isr: 1,2,0Topic:topic_3	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_3	Partition: 0	Leader: 2	Replicas: 0,2,1	Isr: 2,1,0

kill之后,再观察,做下对比。很明显,主要变化在于Isr,以后再分析

bin/kafka-topics.sh --describe --zookeeper localhost:2181Topic:test	PartitionCount:1	ReplicationFactor:1	Configs:	Topic: test	Partition: 0	Leader: -1	Replicas: 0	Isr: Topic:topic_1	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_1	Partition: 0	Leader: 2	Replicas: 2,1,0	Isr: 2,1Topic:topic_2	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_2	Partition: 0	Leader: 1	Replicas: 1,2,0	Isr: 1,2Topic:topic_3	PartitionCount:1	ReplicationFactor:3	Configs:	Topic: topic_3	Partition: 0	Leader: 2	Replicas: 0,2,1	Isr: 2,1

测试下,发送消息,接受消息,是否收到影响。

  • 发送消息

bin/kafka-console-producer.sh --topic topic_1 --broker-list 192.168.1.181:9092,192.168.1.181:9093,192.168.1.181:9094
  • 接收消息

bin/kafka-console-consumer.sh --topic topic_1 --zookeeper 192.168.1.181:2181 --from-beginning

可见,kafka的分布式机制,容错能力还是挺好的~

Kafka介绍

1、kafka有什么?

  • producer 消息的生成者,即发布消息

  • consumer 消息的消费者,即订阅消息

  • broker Kafka以集群的方式运行,可以由一个或多个服务组成,服务即broker

  • zookeeper 协调转发

2、kafka的工作图

producers通过网络将消息发送到Kafka集群,集群向消费者提供消息

kafka对消息进行归纳,即topic,也就是说producer发布topic,consumer订阅topic

参考资料

转载于:https://www.cnblogs.com/zhengchunyuan/p/9882090.html

你可能感兴趣的文章
(转)Mysql常用命令行
查看>>
HDU 3697 Selecting courses(贪心+暴力)(2010 Asia Fuzhou Regional Contest)
查看>>
SPFA求最短路
查看>>
Redis注册成服务
查看>>
matlab 非平稳变化时域分析
查看>>
二分边界
查看>>
UVa 10878 - Decode the tape
查看>>
R语言之Apriori算法应用
查看>>
Java虚拟机是如何加载Java类的?
查看>>
ZooKeeper学习第三期---Zookeeper命令操作(转)
查看>>
HBase性能优化方法总结(四):数据计算
查看>>
洛谷 P1002 过河卒
查看>>
The JavaScript this Keyword
查看>>
var $this = $(this)
查看>>
添加了click事件不响应
查看>>
Excel导出失败的提示
查看>>
汇编指令
查看>>
Mysql数据库中InnoDB和MyISAM的差别
查看>>
Java并发编程:深入剖析ThreadLocal
查看>>
IPC进程通信机制
查看>>