zoukankan      html  css  js  c++  java
  • kafka学习

    kafka名词解释和工作方式:

    • Producer :消息生产者,就是向kafka broker发消息的客户端。
    • Consumer :消息消费者,向kafka broker取消息的客户端
    • Topic :咋们可以理解为一个队列。
    • Consumer Group (CG):这是kafka用来实现一个topic消息的广播(发给所有的consumer)和单播(发给任意一个consumer)的手段。一个topic可以有多个CG。topic的消息会复制(不是真的复制,是概念上的)到所有的CG,但每个CG只会把消息发给该CG中的一个consumer。如果需要实现广播,只要每个consumer有一个独立的CG就可以了。要实现单播只要所有的consumer在同一个CG。用CG还可以将consumer进行自由的分组而不需要多次发送消息到不同的topic。
    • Broker :一台kafka服务器就是一个broker。一个集群由多个broker组成。一个broker可以容纳多个topic。
    • Partition:为了实现扩展性,一个非常大的topic可以分布到多个broker(即服务器)上,一个topic可以分为多个partition,每个partition是一个有序的队列。partition中的每条消息都会被分配一个有序的id(offset)。kafka只保证按一个partition中的顺序将消息发给consumer,不保证一个topic的整体(多个partition间)的顺序。
    •  Offset:kafka的存储文件都是按照offset.kafka来命名,用offset做名字的好处是方便查找。例如你想找位于2049的位置,只要找到2048.kafka的文件即可。当然the first offset就是00000000000.kafka

    kafka设计目标

    高吞吐量是其核心设计之一。

    • 数据磁盘持久化:消息不在内存中cache,直接写入到磁盘,充分利用磁盘的顺序读写性能。
    • zero-copy:减少IO操作步骤。
    • 支持数据批量发送和拉取。
    • 支持数据压缩。
    • Topic划分为多个partition,提高并行处理能力。

    Producer负载均衡和HA机制

    • producer根据用户指定的算法,将消息发送到指定的partition。
    • 存在多个partiiton,每个partition有自己的replica,每个replica分布在不同的Broker节点上。
    • 多个partition需要选取出lead partition,lead partition负责读写,并由zookeeper负责fail over。
    • 通过zookeeper管理broker与consumer的动态加入与离开。
  • 相关阅读:
    atitit.为什么技术的选择方法java超过.net有前途
    HDU 4022 Bombing STL 模拟题
    定制XP引导屏幕背景图像和替换windows这句话
    《STL源代码分析》---stl_heap.h读书笔记
    2015在大型多人在线游戏市场报告
    于Unity3D调用安卓AlertDialog
    jQuery整理笔记5----jQuery大事
    推断字符串数组里面是空的
    软测试-数据结构
    2014第18周三
  • 原文地址:https://www.cnblogs.com/douyamv/p/6780057.html
Copyright © 2011-2022 走看看