kafka节点数规划

南墨2年前 (2023-10-07)技术文章1059

按磁盘容量规划节点数

Kafka的数据存放在本地磁盘，建议使用SAS盘，提供较高磁盘IO，以提高Kafka吞吐量。在本规划基于的硬件规格下，单节点平均吞吐量参考值为读300MB/s，写150MB/s。

由于磁盘存在1M = 1024 KB or 1M = 1000KB的算法不同，一般来说，

磁盘实际可用容量 = 磁盘标注容量 * 0.9

举例说明，磁盘标注容量为600G，实际容量=600 * 0.9 = 540G。

副本数直接决定了消息的膨胀率，如：一条写入到topic1中的消息大小是1M，topic1的副本数是3，那么最终存入broker的消息大小就是3M。

在Kafka集群中，分区越多吞吐量越高，但是分区过多也存在潜在影响，例如文件句柄增加、不可用性增加

（如：某个节点故障后，部分Partition重选Leader后时间窗口会比较大）及端到端时延增加等。

单个Partition的磁盘占用最大不超过100GB；单节点上Partition数目不超过3000；整个集群的分区总数不超过10000。

返回列表

1. INSERT INTO"insert into"是向Iceberg表中插入数据，有两种语法形式："INSERT INTO tbl VALUES (1,"z...

1、停止正在运行的服务a、控制台停止集群服务b、控制台停止Cloudera Management Servicec、命令行停止cm服务systemctl stop cloudera-scm-agent...

需求：将ACK版本从1.14.8升级至1.16.9升级前注意事项：集群升级需要机器可以公网访问，以便下载升级所需的软件包。集群升级Kubernetes过程中，可能会有升级失败的情况，为了您的数据安全，...

无论Windows还是Linux操作系统，启动之前都会对硬件进行检测，之后硬盘引导启动操作系统，下面是与启动系统相关的几个概念。BIOS基本输入输出系统是一组固化到计算机主板上的只读内存镜...

一、简述sysstat 包含了常用的 Linux 性能工具，用来监控和分析系统的性能。本次内容会用到这个包的两个命令 mpstat 和iostat。mpstat 是一个常用的多核 CPU 性能分析工具...

确认监控方式开始监控之前首先思考确认好要监控的方式。提出疑问：zabbix 监控华为存储设备推荐使用snmptrap还是snmptt呢？回答：在 Zabbix 监控华为存储设备时，您可以选择使用 SN...