美团面试题 · tech:apache-spark
美团相关面试题,按最终去重题目聚合。
共 3614 道真题 · 当前筛选命中 6 道 · 更新 2026-08-05
筛选题目已选:tech:apache-spark
考察点
技术栈
第 1 题面对一万亿条用户购买记录,每行包含用户ID和购买数量,如何找出购买数量最多的三位用户?请给出你的设计思路和可能的实现方案。 考察海量数据处理中的排序与内存优化能力,以及取舍意识第 2 题在配置大数据计算引擎(如 Spark 或 Flink)的内存管理时,是否应将最大堆与最小堆参数设置为相同值?请说明原因。 考察对 JVM 堆内存动态调整机制及其在分布式计算环境中影响的理解第 3 题请介绍 Spark 中的 Shuffle 机制及其工作原理。 考察对 Spark Shuffle 原理、过程和相关配置的理解第 4 题大数据开发是以Java为主吗? 考察对大数据开发技术栈的理解及语言生态认知第 5 题你了解Spark的宽窄依赖吗? 考察Spark任务划分与依赖关系的基本原理第 6 题请解释 Spark 中宽依赖和窄依赖的区别。 考察对 Spark 任务调度与数据分区理解