专业服务行业面试题 · tech:apache-spark
专业服务行业相关面试题,按题目行业基础数据聚合。
共 27579 道真题 · 当前筛选命中 50 道 · 更新 2026-08-05
筛选题目已选:tech:apache-spark
考察点
技术栈
第 41 题YARN在Hadoop生态中主要解决什么问题?什么是计算资源? 考察YARN资源调度的基本原理及对计算资源的理解第 42 题Spark RDD和DataFrame的区别 考察对Spark核心数据抽象的理解及使用场景判断第 43 题请谈谈你对大数据技术的了解。 考察大数据基础知识的广度与理解深度第 44 题请谈谈你对常用大数据框架和大数据技术的了解,并说明它们各自适用的场景。 考察对大数据技术栈的广度了解及应用场景的判断能力第 45 题Spark是完全基于内存吗? 考察对Spark内存计算模型和存储层原理的理解第 46 题Flink 和 Spark 在实时处理方面哪个更好? 考察对两类流式计算引擎原理差异的理解及选型依据第 47 题Map Join 中如果小表太大导致内存占用过高甚至内存溢出,你会怎么处理? 考察对 Map Join 原理、内存模型及优化策略的理解第 48 题Spark中算子内的变量共享是如何实现的? 考察对Spark广播变量和累加器机制的理解第 49 题Spark RDD和MapReduce的区别? 考察对Spark RDD与MapReduce核心机制差异的理解第 50 题Spark的宽窄依赖有了解吗?Shuffle有了解吗,哪些算子会触发Shuffle? 考察Spark依赖类型与Shuffle触发机制的理解