后端岗位面试题 · 问题拆解 · tech:apache-spark
题库中标记为“后端”的结构化面试题。
共 89928 道真题 · 当前筛选命中 48 道 · 更新 2026-08-05
筛选题目已选:问题拆解 · tech:apache-spark
考察点
技术栈
第 41 题请介绍你在大数据项目中使用过的 Hadoop、Hive 和 Spark 等组件,及各自的应用场景。 考察大数据组件实际应用能力与场景适配理解第 42 题请介绍Spark的计算核心特性,比如它的计算模型和执行机制。 考察对Spark内存计算、RDD、DAG及执行流程的理解第 43 题数据倾斜遇到过吗?怎么处理?产生原因? 考察对数据倾斜现象的理解、排查思路和应对方案第 44 题MapReduce和Spark 到底差在哪儿?适用场景这些都得对比着说 考察对分布式计算框架的核心差异、适用场景及技术选型的理解第 45 题面对一张千亿条数据的大表,请在不依赖直接SQL聚合的前提下,设计一个将全表聚合结果导出到Excel的整体方案,并说明关键技术点。 考察海量数据离线处理的架构设计能力、分布式计算与导出细节第 46 题请说明Spark是如何处理小文件问题的? 考察对Spark小文件问题的成因、影响及常见处理策略的理解第 47 题请介绍 Spark 的运行机制,包括作业提交、任务调度和执行的完整流程。 考察对 Spark 分布式计算框架核心运行机制的理解第 48 题Spark了解吗?从代码到输出结果,Spark引擎做了什么? 考察Spark执行流程与核心机制理解