行僧

参与开源,努力提升。 我的GitHub地址:https://github.com/playingjoker

Kafka入门教程 有更新!

一、基本概念

介绍

Kafka 是一个分布式的、可分区的、可复制的消息系统。它提供了普通消息系统的功能,但具有自己独特的设计。

这个独特的设计是什么样的呢?

首先让我们看几个基本的消息系统术语:

Kafka 将消息以 topic 为单位进行归纳。

将向 Kafka topic 发布消息的程序成为 producers.

将预订 topics 并消费消息的程序成为 consumer.

Kafka 以集群的方式运行,可以由一个或多个服务组成,每个服务叫做一个 broker.

producers 通过网络将消息发送到 Kafka 集群,集群向消费者提供消息,
客户端和服务端通过 TCP 协议通信。Kafka 提供了 Java 客户端,并且对多种语言都提供了支持。

Topics 和 Logs

先来看一下 Kafka 提供的一个抽象概念:topic.

一个 topic 是对一组消息的归纳。对每个 topic,Kafka 对它的日志进行了分区
每个分区都由一系列有序的、不可变的消息组成,这些消息被连续的追加到分区中。分区中的每个消息都有一个连续的序列号叫做 offset, 用来在分区中唯一的标识这个消息。

在一个可配置的时间段内,Kafka 集群保留所有发布的消息,不管这些消息有没有被消费。比如,如果消息的保存策略被设置为 2 天,那么在一个消息被发布的两天时间内,它都是可以被消费的。之后它将被丢弃以释放空间。Kafka 的性能是和数据量无关的常量级的,所以保留太多的数据并不是问题。

实际上每个 consumer 唯一需要维护的数据是消息在日志中的位置,也就是 offset. 这个 offset 有 consumer 来维护:一般情况下随着 consumer 不断的读取消息,这 offset 的值不断增加,但其实 consumer 可以以任意的顺序读取消息,比如它可以将 offset 设置成为一个旧的值来重读之前的消息。

以上特点的结合,使 Kafka consumers 非常的轻量级:它们可以在不对集群和其他 consumer 造成影响的情况下读取消息。你可以使用命令行来 “tail” 消息而不会对其他正在消费消息的 consumer 造成影响。

将日志分区可以达到以下目的:首先这使得每个日志的数量不会太大,可以在单个服务上保存。另外每个分区可以单独发布和消费,为并发操作 topic 提供了一种可能。

分布式

每个分区在 Kafka 集群的若干服务中都有副本,这样这些持有副本的服务可以共同处理数据和请求,副本数量是可以配置的。副本使 Kafka 具备了容错能力。

每个分区都由一个服务器作为“leader”,零或若干服务器作为“followers”,leader 负责处理消息的读和写,followers 则去复制 leader. 如果 leader down 了,followers 中的一台则会自动成为 leader。集群中的每个服务都会同时扮演两个角色:作为它所持有的一部分分区的 leader,同时作为其他分区的 followers,这样集群就会据有较好的负载均衡。

Producers

Producer 将消息发布到它指定的 topic 中, 并负责决定发布到哪个分区。通常简单的由负载均衡机制随机选择分区,但也可以通过特定的分区函数选择分区。使用的更多的是第二种。

Consumers

发布消息通常有两种模式:队列模式(queuing)和发布 - 订阅模式 (publish-subscribe)。队列模式中,consumers 可以同时从服务端读取消息,每个消息只被其中一个 consumer 读到;发布 - 订阅模式中消息被广播到所有的 consumer 中。Consumers 可以加入一个 consumer 组,共同竞争一个 topic,topic 中的消息将被分发到组中的一个成员中。同一组中的 consumer 可以在不同的程序中,也可以在不同的机器上。如果所有的 consumer 都在一个组中,这就成为了传统的队列模式,在各 consumer 中实现负载均衡。如果所有的 consumer 都不在不同的组中,这就成为了发布 - 订阅模式,所有的消息都被分发到所有的 consumer 中。更常见的是,每个 topic 都有若干数量的 consumer 组,每个组都是一个逻辑上的“订阅者”,为了容错和更好的稳定性,每个组由若干 consumer 组成。这其实就是一个发布 - 订阅模式,只不过订阅者是个组而不是单个 consumer。
二、环境搭建

Step 1: 下载 Kafka

点击下载最新的版本并解压.

tar -xzf kafka_2.9.2-0.8.1.1.tgz

cd kafka_2.9.2-0.8.1.1

复制代码

Step 2: 启动服务

Kafka 用到了 Zookeeper,所有首先启动 Zookper,下面简单的启用一个单实例的 Zookkeeper 服务。可以在命令的结尾加个 & 符号,这样就可以启动后离开控制台。

bin/zookeeper-server-start.sh config/zookeeper.properties &

[2013-04-22 15:01:37,495] INFO Reading configuration from: config/zookeeper.properties (org.apache.zookeeper.server.quorum.QuorumPeerConfig)

复制代码

现在启动 Kafka:

bin/kafka-server-start.sh config/server.properties

[2013-04-22 15:01:47,028] INFO Verifying properties (kafka.utils.VerifiableProperties)

[2013-04-22 15:01:47,051] INFO Property socket.send.buffer.bytes is overridden to 1048576 (kafka.utils.VerifiableProperties)

复制代码

Step 3: 创建 topic

创建一个叫做“test”的 topic,它只有一个分区,一个副本。

bin/kafka-topics.sh –create –zookeeper localhost:2181 –replication-factor 1 –partitions 1 –topic test

复制代码

可以通过 list 命令查看创建的 topic:

bin/kafka-topics.sh –list –zookeeper localhost:2181

test

复制代码

除了手动创建 topic,还可以配置 broker 让它自动创建 topic.

Step 4: 发送消息.

Kafka 使用一个简单的命令行 producer,从文件中或者从标准输入中读取消息并发送到服务端。默认的每条命令将发送一条消息。

运行 producer 并在控制台中输一些消息,这些消息将被发送到服务端:

bin/kafka-console-producer.sh –broker-list localhost:9092 –topic test

This is a messageThis is another message

复制代码

ctrl+c 可以退出发送。

Step 5: 启动 consumer

Kafka also has a command line consumer that will dump out messages to standard output.

Kafka 也有一个命令行 consumer 可以读取消息并输出到标准输出:

bin/kafka-console-consumer.sh –zookeeper localhost:2181 –topic test –from-beginning

This is a message

This is another message

复制代码

你在一个终端中运行 consumer 命令行,另一个终端中运行 producer 命令行,就可以在一个终端输入消息,另一个终端读取消息。

这两个命令都有自己的可选参数,可以在运行的时候不加任何参数可以看到帮助信息。

Step 6: 搭建一个多个 broker 的集群

刚才只是启动了单个 broker,现在启动有 3 个 broker 组成的集群,这些 broker 节点也都是在本机上的:

首先为每个节点编写配置文件:

cp config/server.properties config/server-1.properties

cp config/server.properties config/server-2.properties

复制代码

在拷贝出的新文件中添加以下参数:

config/server-1.properties:

broker.id=1

port=9093

log.dir=/tmp/kafka-logs-1

复制代码

config/server-2.properties:

broker.id=2

port=9094

log.dir=/tmp/kafka-logs-2

复制代码

broker.id 在集群中唯一的标注一个节点,因为在同一个机器上,所以必须制定不同的端口和日志文件,避免数据被覆盖。

We already have Zookeeper and our single node started, so we just need to start the two new nodes:

刚才已经启动可 Zookeeper 和一个节点,现在启动另外两个节点:

bin/kafka-server-start.sh config/server-1.properties &

bin/kafka-server-start.sh config/server-2.properties &

复制代码

创建一个拥有 3 个副本的 topic:

bin/kafka-topics.sh –create –zookeeper localhost:2181 –replication-factor 3 –partitions 1 –topic my-replicated-topic

复制代码

现在我们搭建了一个集群,怎么知道每个节点的信息呢?运行“"describe topics”命令就可以了:

bin/kafka-topics.sh –describe –zookeeper localhost:2181 –topic my-replicated-topic

复制代码

Topic:my-replicated-topic PartitionCount:1 ReplicationFactor:3 Configs:

Topic: my-replicated-topic Partition: 0 Leader: 1 Replicas: 1,2,0 Isr: 1,2,0

复制代码

下面解释一下这些输出。第一行是对所有分区的一个描述,然后每个分区都会对应一行,因为我们只有一个分区所以下面就只加了一行。

leader:负责处理消息的读和写,leader 是从所有节点中随机选择的.

replicas:列出了所有的副本节点,不管节点是否在服务中.

isr:是正在服务中的节点.

在我们的例子中,节点 1 是作为 leader 运行。

向 topic 发送消息:

bin/kafka-console-producer.sh –broker-list localhost:9092 –topic my-replicated-topic

复制代码

my test message 1my test message 2^C

复制代码
三、搭建 Kafka 开发环境

我们搭建了 kafka 的服务器,并可以使用 Kafka 的命令行工具创建 topic,发送和接收消息。下面我们来搭建 kafka 的开发环境。

添加依赖

搭建开发环境需要引入 kafka 的 jar 包,一种方式是将 Kafka 安装包中 lib 下的 jar 包加入到项目的 classpath 中,这种比较简单了。不过我们使用另一种更加流行的方式:使用 maven 管理 jar 包依赖。

创建好 maven 项目后,在 pom.xml 中添加以下依赖:

org.apache.kafka

kafka_2.10

0.8.0

复制代码

添加依赖后你会发现有两个 jar 包的依赖找不到。没关系我都帮你想好了,点击这里下载这两个 jar 包,解压后你有两种选择,第一种是使用 mvn 的 install 命令将 jar 包安装到本地仓库,另一种是直接将解压后的文件夹拷贝到 mvn 本地仓库的 com 文件夹下,比如我的本地仓库是 d:\mvn, 完成后我的目录结构是这样的:
四、数据持久化

不要畏惧文件系统!

Kafka 大量依赖文件系统去存储和缓存消息。对于硬盘有个传统的观念是硬盘总是很慢,这使很多人怀疑基于文件系统的架构能否提供优异的性能。实际上硬盘的快慢完全取决于使用它的方式。设计良好的硬盘架构可以和内存一样快。

在 6 块 7200 转的 SATA RAID-5 磁盘阵列的线性写速度差不多是 600MB/s,但是随即写的速度却是 100k/s,差了差不多 6000 倍。现代的操作系统都对次做了大量的优化,使用了 read-ahead 和 write-behind 的技巧,读取的时候成块的预读取数据,写的时候将各种微小琐碎的逻辑写入组织合并成一次较大的物理写入。对此的深入讨论可以查看这里,它们发现线性的访问磁盘,很多时候比随机的内存访问快得多。

为了提高性能,现代操作系统往往使用内存作为磁盘的缓存,现代操作系统乐于把所有空闲内存用作磁盘缓存,虽然这可能在缓存回收和重新分配时牺牲一些性能。所有的磁盘读写操作都会经过这个缓存,这不太可能被绕开除非直接使用 I/O。所以虽然每个程序都在自己的线程里只缓存了一份数据,但在操作系统的缓存里还有一份,这等于存了两份数据。

另外再来讨论一下 JVM, 以下两个事实是众所周知的:

•Java 对象占用空间是非常大的,差不多是要存储的数据的两倍甚至更高。

•随着堆中数据量的增加,垃圾回收回变的越来越困难。

基于以上分析,如果把数据缓存在内存里,因为需要存储两份,不得不使用两倍的内存空间,Kafka 基于 JVM,又不得不将空间再次加倍, 再加上要避免 GC 带来的性能影响,在一个 32G 内存的机器上,不得不使用到 28-30G 的内存空间。并且当系统重启的时候,又必须要将数据刷到内存中( 10GB 内存差不多要用 10 分钟),就算使用冷刷新(不是一次性刷进内存,而是在使用数据的时候没有就刷到内存)也会导致最初的时候新能非常慢。但是使用文件系统,即使系统重启了,也不需要刷新数据。使用文件系统也简化了维护数据一致性的逻辑。

所以与传统的将数据缓存在内存中然后刷到硬盘的设计不同,Kafka 直接将数据写到了文件系统的日志中。

常量时间的操作效率

在大多数的消息系统中,数据持久化的机制往往是为每个 cosumer 提供一个 B 树或者其他的随机读写的数据结构。B 树当然是很棒的,但是也带了一些代价:比如 B 树的复杂度是 O(log N),O(log N) 通常被认为就是常量复杂度了,但对于硬盘操作来说并非如此。磁盘进行一次搜索需要 10ms,每个硬盘在同一时间只能进行一次搜索,这样并发处理就成了问题。虽然存储系统使用缓存进行了大量优化,但是对于树结构的性能的观察结果却表明,它的性能往往随着数据的增长而线性下降,数据增长一倍,速度就会降低一倍。

直观的讲,对于主要用于日志处理的消息系统,数据的持久化可以简单的通过将数据追加到文件中实现,读的时候从文件中读就好了。这样做的好处是读和写都是 O(1) 的,并且读操作不会阻塞写操作和其他操作。这样带来的性能优势是很明显的,因为性能和数据的大小没有关系了。

既然可以使用几乎没有容量限制(相对于内存来说)的硬盘空间建立消息系统,就可以在没有性能损失的情况下提供一些一般消息系统不具备的特性。比如,一般的消息系统都是在消息被消费后立即删除,Kafka 却可以将消息保存一段时间(比如一星期),这给 consumer 提供了很好的机动性和灵活性,这点在今后的文章中会有详述。

五、消息传输的事务定义

之前讨论了 consumer 和 producer 是怎么工作的,现在来讨论一下数据传输方面。数据传输的事务定义通常有以下三种级别:

最多一次: 消息不会被重复发送,最多被传输一次,但也有可能一次不传输。

最少一次: 消息不会被漏发送,最少被传输一次,但也有可能被重复传输.

精确的一次(Exactly once): 不会漏传输也不会重复传输, 每个消息都传输被一次而且仅仅被传输一次,这是大家所期望的。

大多数消息系统声称可以做到“精确的一次”,但是仔细阅读它们的的文档可以看到里面存在误导,比如没有说明当 consumer 或 producer 失败时怎么样,或者当有多个 consumer 并行时怎么样,或写入硬盘的数据丢失时又会怎么样。kafka 的做法要更先进一些。当发布消息时,Kafka 有一个“committed”的概念,一旦消息被提交了,只要消息被写入的分区的所在的副本 broker 是活动的,数据就不会丢失。关于副本的活动的概念,下节文档会讨论。现在假设 broker 是不会 down 的。

如果 producer 发布消息时发生了网络错误,但又不确定实在提交之前发生的还是提交之后发生的,这种情况虽然不常见,但是必须考虑进去,现在 Kafka 版本还没有解决这个问题,将来的版本正在努力尝试解决。

并不是所有的情况都需要“精确的一次”这样高的级别,Kafka 允许 producer 灵活的指定级别。比如 producer 可以指定必须等待消息被提交的通知,或者完全的异步发送消息而不等待任何通知,或者仅仅等待 leader 声明它拿到了消息(followers 没有必要)。

现在从 consumer 的方面考虑这个问题,所有的副本都有相同的日志文件和相同的 offset,consumer 维护自己消费的消息的 offset,如果 consumer 不会崩溃当然可以在内存中保存这个值,当然谁也不能保证这点。如果 consumer 崩溃了,会有另外一个 consumer 接着消费消息,它需要从一个合适的 offset 继续处理。这种情况下可以有以下选择:

consumer 可以先读取消息,然后将 offset 写入日志文件中,然后再处理消息。这存在一种可能就是在存储 offset 后还没处理消息就 crash 了,新的 consumer 继续从这个 offset 处理,那么就会有些消息永远不会被处理,这就是上面说的“最多一次”。

consumer 可以先读取消息,处理消息,最后记录 offset,当然如果在记录 offset 之前就 crash 了,新的 consumer 会重复的消费一些消息,这就是上面说的“最少一次”。

“精确一次”可以通过将提交分为两个阶段来解决:保存了 offset 后提交一次,消息处理成功之后再提交一次。但是还有个更简单的做法:将消息的 offset 和消息被处理后的结果保存在一起。比如用 Hadoop ETL 处理消息时,将处理后的结果和 offset 同时保存在 HDFS 中,这样就能保证消息和 offser 同时被处理了。

作者:huadeyu
链接:https://hacpai.com/article/1530496683773
来源:黑客派
著作权归作者所有。商业转载请联系作者获得授权,非商业转载请注明出处。

评论
validate