编程 用 Docker 跑起 DolphinScheduler 3.2.2 并创建第一个工作流

2026-09-04 22:15:21

用 Docker 跑起 DolphinScheduler 3.2.2 并创建第一个工作流

Apache DolphinScheduler 是一个面向企业级场景的分布式可视化工作流调度系统,提供任务、工作流以及全生命周期数据处理过程的可视化操作,主要解决复杂大数据任务依赖关系,以及数据研发中 ETL 依赖交错、任务健康状态无法监控的问题。它用 DAG 流式方式组装任务,支持监控执行状态、重试、从指定节点恢复失败、暂停、恢复和终止任务等操作。

功能特性

  • 简单易用:提供 DAG 监控界面,所有流程定义均可视化,通过拖拽任务完成 DAG 定制,支持 API 方式与第三方系统集成,一键部署。
  • 丰富的使用场景:支持多租户,支持暂停、恢复操作;支持 Spark、Hive、M/R、Python、Shell、SQL、子流程等近 20 种任务类型,贴近大数据生态,支持跨语言扩展。
  • 高可靠性:去中心化设计,原生支持 HA 任务队列,具备过载容错能力。
  • 高扩展性:支持多租户与在线资源管理,支持自定义任务类型;调度器采用分布式调度,调度能力随集群线性增长,可稳定运行百万量级任务。

快速体验:单机模式

使用 Docker 启动一个 standalone server 容器:

DOLPHINSCHEDULER_VERSION=3.2.2
docker run --name dolphinscheduler-standalone-server \
-p 12345:12345 -p 25333:25333 \
-d apache/dolphinscheduler-standalone-server:"${DOLPHINSCHEDULER_VERSION}"

启动后访问 Web UI:

http://localhost:12345/dolphinscheduler/ui

默认账号密码为 admin / dolphinscheduler123

创建第一个工作流

DolphinScheduler 中所有工作流都必须属于项目,先创建一个项目。在 Project 页面点击 “Create Project” 完成创建。

进入项目后,打开 “Workflow Definition” 页面,点击 “Create Workflow” 进入工作流编辑页。从画布工具栏拖出一个 Shell 任务,填写 “Node Name” 和 “Script” 脚本,点击 “Save” 保存任务。用同样方式创建第二个任务。

此时画布上有两个任务,将鼠标从上游任务拖到下游任务后松开,即可在两个任务间建立带箭头的依赖关系。点击右上角 “Save” 保存工作流。

返回工作流列表,点击 “Online” 使工作流上线,再点击 “Run” 运行。在 “Workflow Instance” 页面可以看到运行中的实例,状态为 Executing

查看任务日志时,在 “Workflow Instance” 列表点击对应实例,找到目标任务,右键选择 “View Log” 即可查看详细日志。

官方网址:

推荐文章

程序员茄子在线接单