后端岗位面试题 · 方案权衡 · tech:apache-spark

题库中标记为“后端”的结构化面试题。

89928 道真题 · 当前筛选命中 72 · 更新 2026-08-05

筛选题目已选:方案权衡 · tech:apache-spark
第 21 题请简要介绍 Spark 中的 coalesce 算子及其作用场景。 考察对 Spark 分区调整算子的理解与实际应用技术原理方案权衡Apache Spark第 22 题Spark Executor 的内存分为哪几部分?请说明堆内与堆外内存的区别及应用场景。 考察对 Spark 内存模型的理解及对堆内外内存设计的掌握技术原理方案权衡Apache Spark第 23 题请设计一个方案,将海量数据接入业务后台,并进行处理和存储。你会如何设计实现? 考察对海量数据接入、处理和存储的整体架构设计与关键技术选型系统设计技术选型方案权衡Apache FlinkApache KafkaApache Spark第 24 题请说明 Spark 能处理的数据量级范围,以及影响其处理能力的关键因素。 考察对 Spark 架构扩展性和资源模型的理解性能优化技术原理方案权衡Apache Spark第 25 题Spark RDD和MapReduce的区别? 考察对Spark RDD与MapReduce核心机制差异的理解技术原理方案权衡Apache SparkMapReduce第 26 题请解释 Spark 中宽依赖与窄依赖的区别,并说明其对作业划分和优化策略的影响。 考察对 Spark 依赖类型及其在任务调度和性能优化中作用的理解技术原理方案权衡Apache Spark第 27 题spark.sql.shuffle.partitions调节的经验,调多大合适,是否有公式 考察对Spark shuffle分区设置原理、经验值与调优方法的理解性能优化技术原理方案权衡Apache Spark第 28 题请介绍你对 Hive on Spark 的了解,包括它的基本原理和适用场景。 考察对 Hive on Spark 技术原理和适用场景的理解技术原理技术选型方案权衡Apache HiveApache Spark第 29 题请对比 MapReduce 和 Spark 在计算模型、性能与适用场景上的主要差异。 考察对经典大数据计算框架原理与选型的理解技术原理技术选型方案权衡Apache SparkMapReduce第 30 题MR和Spark的区别是什么? 考察对MapReduce与Spark核心架构、计算模型及适用场景差异的理解技术原理技术选型方案权衡Apache SparkMapReduce第 31 题Flink 与 Spark 的容错机制和故障恢复机制有哪些异同? 考察对两种主流流批计算引擎容错设计的理解与对比技术原理方案权衡问题排查Apache FlinkApache Spark第 32 题请介绍Spark的三种join优化,以及针对数据倾斜的处理方法。 考察SparkSQL执行计划理解、join策略选择与数据倾斜调优能力性能优化技术原理方案权衡Apache Spark第 33 题Spark为什么比MR快? 考察对Spark和MapReduce执行引擎差异的理解及性能优化原理技术原理方案权衡Apache SparkMapReduce第 34 题Spark是完全基于内存吗? 考察对Spark内存计算模型和存储层原理的理解性能优化技术原理方案权衡Apache Spark第 35 题Spark合并小文件怎么做的,落HDFS之前合并还是之后合并? 考察Spark写HDFS时小文件问题的处理策略与时机选择性能优化技术原理方案权衡Apache SparkHDFS第 36 题请比较 RDD 与 MapReduce 的优缺点。 考察对 RDD 与 MapReduce 在计算模型、性能与容错方面的理解技术原理方案权衡Apache SparkMapReduce第 37 题Spark常见的Shuffle策略有哪些?这些不同的策略分别在哪些项目中用到? 考察对Spark Shuffle机制的理解及其在不同业务场景下的应用业务理解技术原理方案权衡Apache Spark第 38 题reduceByKey() 和 groupByKey() 的区别是什么? 考察对 Spark 算子执行语义和数据混洗性能的理解技术原理方案权衡Apache Spark第 39 题Spark的弹性你怎么理解的? 考察对Spark弹性设计理念及核心机制的理解技术原理方案权衡Apache Spark第 40 题Flink和Spark流式处理的区别 考察流式计算引擎的架构差异与实时性理解技术原理技术选型方案权衡Apache FlinkApache Spark