互联网/IT行业面试题 · 方案权衡 · tech:apache-spark

互联网/IT行业相关面试题,按题目行业基础数据聚合。

47588 道真题 · 当前筛选命中 29 · 更新 2026-08-05

筛选题目已选:方案权衡 · tech:apache-spark
第 21 题Spark 提交任务时,Client 模式和集群模式有什么区别?例如 Driver 运行位置、日志查看方式和适用场景。 考察对 Spark 部署模式的理解及实际运维能力技术原理方案权衡Apache Spark第 22 题Spark和Flink有什么区别? 考察对两种主流大数据计算引擎的理解与选型判断技术原理方案权衡Apache FlinkApache Spark第 23 题请说明在进行实时计算框架技术选型时,你会考虑哪些关键因素,并给出你的选择逻辑。 考察对实时计算技术栈的理解及技术选型的系统思维业务理解技术选型方案权衡Apache FlinkApache KafkaApache Spark第 24 题MapReduce与Spark的区别是什么? 考察候选人是否理解两种大数据计算框架的架构差异、适用场景与性能特点技术原理方案权衡Apache SparkMapReduce第 25 题请谈谈你对大数据生态中Spark和Hadoop的了解,以及它们各自的作用和关系。 考察大数据基础认知、技术选型与生态理解技术原理方案权衡Apache HadoopApache Spark第 26 题Spark Executor 的内存分为哪几部分?请说明堆内与堆外内存的区别及应用场景。 考察对 Spark 内存模型的理解及对堆内外内存设计的掌握技术原理方案权衡Apache Spark第 27 题请比较 Flink 和 Spark 在处理实时流数据方面的核心区别。 考察对 Flink 与 Spark 流处理架构和语义差异的理解技术原理技术选型方案权衡Apache FlinkApache Spark第 28 题面对一万亿条用户购买记录,每行包含用户ID和购买数量,如何找出购买数量最多的三位用户?请给出你的设计思路和可能的实现方案。 考察海量数据处理中的排序与内存优化能力,以及取舍意识问题拆解技术选型方案权衡Apache HadoopApache Spark第 29 题Hive Shuffle和Spark Shuffle的区别有哪些? 考察对两类大数据引擎Shuffle机制及性能差异的理解性能优化技术原理方案权衡Apache HiveApache Spark