后端岗位面试题 · 技术原理 · tech:apache-hive
题库中标记为“后端”的结构化面试题。
共 89928 道真题 · 当前筛选命中 138 道 · 更新 2026-08-05
筛选题目已选:技术原理 · tech:apache-hive
考察点
技术栈
第 81 题在Hive中指定Spark作为计算引擎时,任务调度是如何进行的?请描述从提交Hive查询到Spark任务执行的完整调度链路。 考察对Hive on Spark架构及Spark任务调度机制的理解第 82 题大数据生态中除了 Flink 之外,还有哪些常用的组件,它们分别承担什么角色? 考察对大数据生态体系的整体了解与组件职责划分第 83 题有没有通过Java编写过UDF函数,UDF函数需要实现哪些方法? 考察对Hive或Flink等计算引擎UDF编程模型的掌握程度第 84 题请说明Hive中增强查询性能的索引机制有哪些? 考察对Hive索引类型及其适用场景的理解第 85 题Hive查询过程怎么优化? 考察对Hive查询执行流程的理解及系统性优化方法第 86 题MapJoin适用于什么场景?具体如何使用? 考察对MapJoin适用场景、原理及使用方法的理解第 87 题请说明Hive内部表和外部表的区别,以及在什么场景下你会选择使用哪一类表? 考察Hive表类型的核心区别及实际应用场景的选择能力第 88 题讲下HIVE的内部表和外部表有什么不同 考察Hive内部表与外部表的核心区别及适用场景第 89 题Hive底层使用的是什么技术或框架? 考察对Hive底层实现原理的了解第 90 题请解释Hive中的开窗函数(窗口函数)是什么,并举例说明其常见用法与适用场景。 考察对Hive窗口函数概念、语法及典型应用场景的理解第 91 题请解释Hive数据倾斜的常见原因及相应的调优策略。 考察对Hive数据倾斜的理解及实际调优能力第 92 题Hive表常用的存储格式有哪些?各自有何特点? 考察对Hive存储格式的熟悉程度和选型能力第 93 题你觉得Hive SQL和MySQL有什么区别? 考察对SQL方言差异、底层存储与执行引擎的理解第 94 题Hive数据倾斜有哪些解决办法? 考察对Hive数据倾斜成因和常见优化手段的理解第 95 题Hive 是数据库吗?请说明它的本质与适用场景。 考察对 Hive 本质、底层架构及与传统数据库区别的理解第 96 题Spark和Hive对数据倾斜的处理有哪些异同? 考察对大数据引擎数据倾斜问题的理解与方案对比第 97 题请解释一下 Map Join 的工作原理及其适用场景。 考察对分布式计算中优化手段的理解,特别是 Map Join 的执行机制与适用条件第 98 题请说明一条SQL查询在Hive中被执行时的主要顺序。 考察对Hive查询执行流程与SQL语义顺序的理解第 99 题Hive 支持哪些存储格式? 考察对 Hive 常见存储格式的认知与适用场景理解第 100 题大数据生态圈都了解哪些? 考察大数据技术栈的广度和系统性理解