后端岗位面试题 · 编码实现 · tech:apache-hive
题库中标记为“后端”的结构化面试题。
共 89928 道真题 · 当前筛选命中 6 道 · 更新 2026-08-05
筛选题目已选:编码实现 · tech:apache-hive
考察点
技术栈
第 1 题自定义 UDF 怎么实现?比如在 Hive 或Spark 里,具体步骤是啥,有没有踩过坑 考察对 Hive/Spark 自定义 UDF 开发流程、生命周期和踩坑点的理解第 2 题请写一个简单的 UDF 示例,并说明其作用。 考察 UDF 的编码实现能力第 3 题请设计一个Hive表结构用于存储样例日志,并写出导入与聚合计算的SQL过程。日志格式为:pin|-|requesttm|-|url|-|skuid|-|amount,分隔符为"-|",数据样例:张三-|2013-11-23 11:59:30-|www.jd.com-|100023-|110.15。假设数据文件为sample.txt,导入到Hive的test库的tsample表,然后计算每个用户(pin)的总消费金额。 考察Hive建表、数据导入和聚合查询能力第 4 题有没有通过Java编写过UDF函数,UDF函数需要实现哪些方法? 考察对Hive或Flink等计算引擎UDF编程模型的掌握程度第 5 题已知表 a 是一张内部表,如何将它转换成外部表?请写出相应的 Hive 语句。 考察 Hive 内部表与外部表的区别及表属性修改能力第 6 题Hive的UDF怎么写? 考察对Hive UDF编写流程、类型区分和部署调用的理解