数据岗位面试题更新 2026-08-05

请说明 DolphinScheduler 中 Master 和 Worker 两个核心组件各自承担的任务以及它们之间是如何协作完成工作流调度的。

数据系统设计技术原理Apache DolphinSchedulerZooKeeper

考察说明

考察对 DolphinScheduler 分布式调度架构中 Master 与 Worker 职责分工和协作机制的理解。

回答思路

  1. 【回答框架 1】Master 是调度中心,负责工作流(DAG)的解析、拆分和任务实例的创建,维护工作流与任务的状态,并将任务分发到 Worker 执行。它通过 ZooKeeper 实现集群的协调和故障转移,保证调度的高可用。
  2. 【回答框架 2】Worker 是任务执行节点,负责接收 Master 分配的任务实例,执行具体的任务逻辑,并更新任务状态。Worker 可以水平扩展,提升任务并行处理能力,同时通过 ZooKeeper 进行心跳上报和注册。
  3. 【回答框架 3】Master 与 Worker 之间的通信和协同主要通过 ZooKeeper 和数据库(如 MySQL)完成。Master 将任务写入数据库,Worker 拉取并执行;同时通过 ZooKeeper 实现分布式锁、节点协调和通知,确保任务分配和状态一致性。
  4. 【回答框架 4】协同的核心是任务流程:Master 负责调度触发和任务分发,Worker 负责执行和反馈,最终由 Master 汇总任务结果,推进整个 DAG 的执行。这种分工实现了计算与调度的解耦,提高了系统的扩展性和容错性。
  5. 【关键点 1】Master 负责调度与分发,Worker 负责执行与反馈。
  6. 【关键点 2】ZooKeeper 用于集群协调和故障转移。
  7. 【关键点 3】数据库用于持久化任务状态和实现任务分配。
  8. 【关键点 4】Worker 通过心跳上报和扩展提升并行能力。
  9. 【关键点 5】协同实现调度与执行解耦,增强可靠性和扩展性。
  10. 【易错点 1】仅说明 Master 分发任务,不强调状态协调机制,可能导致理解不完整。
  11. 【易错点 2】混淆 Master 的高可用和数据库的持久化职责,应明确区分。
  12. 【易错点 3】忽略 ZooKeeper 在分布式锁和节点协调中的作用,低估其重要性。