后端岗位面试题 · tech:apache-spark

题库中标记为“后端”的结构化面试题。

89928 道真题 · 当前筛选命中 233 · 更新 2026-08-05

筛选题目已选:tech:apache-spark
第 81 题Spark和MapReduce的区别是什么? 考察对Spark与MapReduce核心特性的理解与对比技术原理技术选型Apache SparkMapReduce第 82 题Spark的宽窄依赖有了解吗?Shuffle有了解吗,哪些算子会触发Shuffle? 考察Spark依赖类型与Shuffle触发机制的理解问题拆解技术原理Apache Spark第 83 题大数据开发是以Java为主吗? 考察对大数据开发技术栈的理解及语言生态认知技术原理技术选型Apache SparkJavaPython第 84 题Hive和Spark分别是什么?它们的主要用途和区别是什么? 考察对Hive和Spark基本概念、应用场景及差异的理解技术原理技术选型Apache HiveApache Spark第 85 题请设计一个方案,将海量数据接入业务后台,并进行处理和存储。你会如何设计实现? 考察对海量数据接入、处理和存储的整体架构设计与关键技术选型系统设计技术选型方案权衡Apache FlinkApache KafkaApache Spark第 86 题请说明 Spark 能处理的数据量级范围,以及影响其处理能力的关键因素。 考察对 Spark 架构扩展性和资源模型的理解性能优化技术原理方案权衡Apache Spark第 87 题数据倾斜怎么排查,如何解决? 考察对分布式计算中数据倾斜问题的识别、定位与处理能力风险判断技术原理问题排查Apache HiveApache Spark第 88 题Spark RDD和MapReduce的区别? 考察对Spark RDD与MapReduce核心机制差异的理解技术原理方案权衡Apache SparkMapReduce第 89 题Spark中job、stage和task分别是什么含义,它们之间有什么关系? 考察对Spark作业执行模型和任务划分机制的理解问题拆解技术原理Apache Spark第 90 题使用Spark引擎做wordcount,基本的流程是什么? 考察Spark编程模型与基本计算流程编码实现技术原理Apache Spark第 91 题请介绍 Spark 的基本运行原理,包括任务提交到执行的整体流程。 考察对 Spark 分布式计算模型和调度执行流程的理解问题拆解技术原理Apache Spark第 92 题请解释 Spark 中宽依赖与窄依赖的区别,并说明其对作业划分和优化策略的影响。 考察对 Spark 依赖类型及其在任务调度和性能优化中作用的理解技术原理方案权衡Apache Spark第 93 题spark.sql.shuffle.partitions调节的经验,调多大合适,是否有公式 考察对Spark shuffle分区设置原理、经验值与调优方法的理解性能优化技术原理方案权衡Apache Spark第 94 题Spark UI 怎么看,关注哪些点去判断数据倾斜? 考察对 Spark UI 的理解、数据倾斜的症状识别与排查路径数据驱动技术原理问题排查Apache Spark第 95 题请介绍你对 Hive on Spark 的了解,包括它的基本原理和适用场景。 考察对 Hive on Spark 技术原理和适用场景的理解技术原理技术选型方案权衡Apache HiveApache Spark第 96 题Spark和Hive的区别是什么? 考察对Spark与Hive在架构、计算模型和适用场景上的理解技术原理Apache HiveApache Spark第 97 题Spark 的体系结构中包含哪些核心组件? 考察对 Spark 核心组件及其职责的理解技术原理Apache Spark第 98 题请详细说明Spark中一个算子从提交到分布式执行的完整过程,包括DAG构建、任务调度和执行阶段。 考察对Spark执行引擎核心流程的理解,包括调度、执行和容错机制问题拆解技术原理Apache Spark第 99 题请介绍你阅读 Spark 源码的经历,包括重点关注的模块和思考。 考察候选人对 Spark 源码的深入理解与抽象总结能力持续改进项目复盘技术原理Apache Spark第 100 题请对比 MapReduce 和 Spark 在计算模型、性能与适用场景上的主要差异。 考察对经典大数据计算框架原理与选型的理解技术原理技术选型方案权衡Apache SparkMapReduce