kafka partition

男娘i 2022-03-16 16:48 343阅读 0赞

这里写自定义目录标题

  • kafka partition

kafka partition

  1. 一个topic 可以配置几个partitionproduce发送的消息分发到不同的partition
  2. consumer接受数据的时候是按照group来接受,kafka确保每个partition只能同一个group中的同一个consumer消费,如果想要重复消费,那么需要其他的组来消费。
  3. Zookeerper中保存这每个topic下的每个partition在每个group中消费的offset
  4. 新版kafka把这个offsert保存到了一个__consumer_offserttopic下,这个__consumer_offsert 50个分区,通过将groupid哈希值%50的值来确定要保存到那一个分区. 这样也是为了考虑到zookeeper不擅长大量读写的原因。
  5. 所以,如果要一个group用几个consumer来同时读取的话,需要多线程来读取,一个线程相当于一个consumer实例。当consumer的数量大于分区的数量的时候,有的consumer线程会读取不到数据。
  6. 假设一个topic test groupA消费了,现在启动另外一个新的groupB来消费test,默认test-groupBoffset不是0,而是没有新建立,除非当test有数据的时候,groupB会收到该数据,该条数据也是第一条数据,groupBoffset也是刚初始化的ofsert, 除非用显式的用–from-beginnging 来获取从0开始数据

引用:https://www.cnblogs.com/liuwei6/p/6900686.html

发表评论

表情:
评论列表 (有 0 条评论,343人围观)

还没有评论,来说两句吧...

相关阅读