互联网/IT行业面试题 · Apache Kafka
互联网/IT行业相关面试题,按题目行业基础数据聚合。
共 47588 道真题 · 当前筛选命中 374 道 · 更新 2026-08-05
筛选题目已选:Apache Kafka
考察点
技术栈
第 121 题请说明 Kafka 中可能出现的数据丢失和重复消费问题,以及各自的应对方案。 考察对 Kafka 消息可靠性与消费语义的理解及实践能力第 122 题请分享一次你使用 Kafka 时遇到并解决的问题。 考察对 Kafka 架构、常见故障及排查能力的理解第 123 题Kafka的消息传递机制是怎样的? 考察对Kafka消息传递模型、分区与消费语义的理解第 124 题Kafka 和 RocketMQ 在消息队列设计上有哪些主要区别? 考察对主流消息队列核心设计理念和适用场景的对比理解第 125 题流处理中如何保证数据一致性,以及如何保证数据不丢失? 考察流处理系统的容错机制与端到端一致性理解第 126 题实现几乎100%最终一致性的具体方案有哪些?请结合MQ、Binlog对账、定时任务等展开说明。 考察分布式系统最终一致性方案的设计与权衡第 127 题为什么用Kafka不用RabbitMQ? 考察消息中间件选型与业务场景匹配能力第 128 题Kafka如何保证消息不丢失? 考察Kafka端到端的可靠性保证与消息投递语义第 129 题你了解哪些消息队列中间件?它们各自有什么优势? 考察对主流消息队列的选型认知和工程理解第 130 题Kafka中的Broker是什么? 考察对Broker角色的准确理解第 131 题Kafka如何保证消息不会丢失? 考察对Kafka消息可靠性机制的整体理解与端到端保障能力第 132 题你一般使用哪个消息中间件?选择它时主要考虑了哪些因素? 考察消息中间件的选型思路和实际使用经验第 133 题即使Kafka生产者配置了ACK=all并设置了重试,消息仍可能丢失吗?请分析可能的原因。 考察对Kafka消息传递可靠性的完整理解及边界场景识别第 134 题Kafka的topic分区数是越多越好吗?为什么不能建1万个分区? 考察对Kafka分区数量权衡和资源开销的理解第 135 题Kafka支持多分区,它是保证所有分区都写成功后返回,还是写入其中一个分区成功后就返回视为成功? 考察对Kafka生产端ack机制和分区写入语义的理解第 136 题为什么消费者实例的个数不能大于分区数? 考察 Kafka 消费者组与分区的分配机制及并发模型第 137 题最新版本的 Kafka 还需要依赖 ZooKeeper 吗?原因是什么? 考察对 Kafka 去 ZooKeeper 化演进及原因的理解第 138 题FEED流中的关注推送功能是如何实现的?如果采用推模式,请说明具体机制。 考察内容分发与推送模式的设计理解第 139 题如果公司已经具备本地化部署和接入模型底层能力的条件,你会如何实现让模型进行持续的数据处理?请展开场景追问。 考察候选人将大模型应用于实际数据处理场景的系统设计与落地能力第 140 题请谈谈你对常用大数据组件的了解,并说明它们各自适用的场景。 考察对大数据生态的认知广度与场景匹配能力