后端岗位面试题 · tech:apache-hive
题库中标记为“后端”的结构化面试题。
共 89928 道真题 · 当前筛选命中 149 道 · 更新 2026-08-05
筛选题目已选:tech:apache-hive
考察点
技术栈
第 81 题请列举并说明你实际使用过的 Hive 函数,并简要讲解其应用场景。 考察 Hive 函数掌握广度、理解深度与实际应用能力第 82 题Hive 中 hive.optimize.skewjoin(skewindata)的原理是什么? 考察对 Hive 数据倾斜优化机制的深入理解第 83 题Hive数据倾斜是什么?请介绍其原因和解决方案。 考察对Hive数据倾斜的成因识别与治理能力第 84 题如何查看 Hive 表的存储路径? 考察对 Hive 表存储结构及常用命令的掌握第 85 题那你说说内部表和外部表的区别吧。 考察对数据仓库表管理方式、数据生命周期及删除行为差异的理解第 86 题请说明一条 HiveSQL 语句在提交后执行的底层处理流程。 考察对 Hive 查询编译、优化与执行引擎调度的完整理解第 87 题请介绍 Hive 的分区表和分桶表的区别,以及各自适用的场景。 考察对 Hive 数据组织方式的理解及实际应用场景判断第 88 题在Hive中指定Spark作为计算引擎时,任务调度是如何进行的?请描述从提交Hive查询到Spark任务执行的完整调度链路。 考察对Hive on Spark架构及Spark任务调度机制的理解第 89 题大数据生态中除了 Flink 之外,还有哪些常用的组件,它们分别承担什么角色? 考察对大数据生态体系的整体了解与组件职责划分第 90 题有没有通过Java编写过UDF函数,UDF函数需要实现哪些方法? 考察对Hive或Flink等计算引擎UDF编程模型的掌握程度第 91 题请说明Hive中增强查询性能的索引机制有哪些? 考察对Hive索引类型及其适用场景的理解第 92 题Hive查询过程怎么优化? 考察对Hive查询执行流程的理解及系统性优化方法第 93 题MapJoin适用于什么场景?具体如何使用? 考察对MapJoin适用场景、原理及使用方法的理解第 94 题请说明Hive内部表和外部表的区别,以及在什么场景下你会选择使用哪一类表? 考察Hive表类型的核心区别及实际应用场景的选择能力第 95 题讲下HIVE的内部表和外部表有什么不同 考察Hive内部表与外部表的核心区别及适用场景第 96 题Hive底层使用的是什么技术或框架? 考察对Hive底层实现原理的了解第 97 题请解释Hive中的开窗函数(窗口函数)是什么,并举例说明其常见用法与适用场景。 考察对Hive窗口函数概念、语法及典型应用场景的理解第 98 题请解释Hive数据倾斜的常见原因及相应的调优策略。 考察对Hive数据倾斜的理解及实际调优能力第 99 题Hive表常用的存储格式有哪些?各自有何特点? 考察对Hive存储格式的熟悉程度和选型能力第 100 题你觉得Hive SQL和MySQL有什么区别? 考察对SQL方言差异、底层存储与执行引擎的理解