Kafka 基础概念

2020年4月19日 | 作者 Siran | 1200字 | 阅读大约需要3分钟
归档于 消息队列 | 标签 #kafka
  • Producer:生产者,也就是发送消息的一方。生产者负责创建消息,然后将其投递到Kafka中。

  • Consumer:消费者,也就是接收消息的一方。消费者连接到Kafka上并接收消息,进而进行相应的业务逻辑处理。

  • Broker:服务代理节点。对于Kafka而言,Broker可以简单地看作一个独立的Kafka服务节点或Kafka服务实例。大多数情况下也可以将Broker看作一台Kafka服务器,前提是这台服务器上只部署了一个Kafka实例。一个或多个Broker组成了一个Kafka集群。

  • Topic:Kafka中的消息以主题为单位进行归类,生产者负责将消息发送到特定的主题(发送到Kafka集群中的每一条消息都要指定一个主题),而消费者负责订阅主题并进行消费。

  • Partition:主题是一个逻辑上的概念,它还可以细分为多个分区,一个分区只属于单个主题,很多时候也会把分区称为主题分区(Topic-Partition)。同一主题下的不同分区包含的消息是不同的,分区在存储层面可以看作一个可追加的日志(Log)文件,消息在被追加到分区日志文件的时候都会分配一个特定的偏移量(offset)。

  • Offset:offset是消息在分区中的唯一标识,Kafka通过它来保证消息在分区内的顺序性,不过offset并不跨越分区,也就是说,Kafka保证的是分区有序而不是主题有序。

  • Replica:Kafka 为分区引入了多副本(Replica)机制,通过增加副本数量可以提升容灾能力。同一分区的不同副本中保存的是相同的消息(在同一时刻,副本之间并非完全一样),副本之间是“一主多从”的关系,其中leader副本负责处理读写请求,follower副本只负责与leader副本的消息同步。副本处于不同的broker中,当leader副本出现故障时,从follower副本中重新选举新的leader副本对外提供服务。Kafka通过多副本机制实现了故障的自动转移,当Kafka集群中某个broker失效时仍然能保证服务可用。

  • AR(Assigned Replicas):分区中的所有副本统称为AR(Assigned Replicas)

  • ISR(In-Sync Replicas):所有与leader副本保持一定程度同步的副本(包括leader副本在内)

  • OSR(Out-of-Sync Replicas):与leader副本同步滞后过多的副本(不包括leader副本)

  • HW:高水位,它标识了一个特定的消息偏移量(offset),消费者只能拉取到这个offset之前的消息。

  • LEO:是Log End Offset的缩写,它标识当前日志文件中下一条待写入消息的offset