博客
关于我
Azkaban简介
阅读量:243 次
发布时间:2019-03-01

本文共 507 字,大约阅读时间需要 1 分钟。

Azkaban简介

一、Azkaban 介绍

1.1 背景

一个完整的大数据分析系统必然由多个任务单元组成,包括数据收集、数据清洗、数据存储、数据分析等。这些任务单元及其依赖关系构成复杂的工作流。工作流管理涉及诸多问题:如何定时调度任务?如何在任务完成后自动执行下一步?任务失败时如何发出预警?这些问题的解决催生了工作流调度系统,而Azkaban正是其中之一。

1.2 功能

Azkaban由LinkedIn开发并经过多年生产环境验证,具备以下功能:

  • 兼容任何版本的Hadoop
  • 易于使用的Web UI
  • 支持通过简单的Web页面上传工作流
  • 支持按项目独立管理
  • 定时任务调度
  • 模块化设计,支持插入自定义组件
  • 身份验证与权限控制
  • 用户操作跟踪
  • 支持失败和成功的电子邮件提醒
  • SLA警报与自动查杀失败任务
  • 支持任务重试

Azkaban注重功能与易用性结合,其Web UI界面简洁直观,用户体验良好。

二、Azkaban 和 Oozie

Azkaban与Oozie作为两大知名的开源工作流系统,各有优势。两者在功能上存在差异,同时也各有独特的设计理念和使用场景。了解这些差异有助于选择最适合的工具进行数据分析和工作流管理。

转载地址:http://ikxv.baihongyu.com/

你可能感兴趣的文章
PgSQL · 特性分析 · PG主备流复制机制
查看>>
PGSQL主键序列
查看>>
PGSQL安装PostGIS扩展模块
查看>>
pg数据库中两个字段相除
查看>>
PhalApi:[1.23] 请求和响应:GET和POST两者皆可得及超越JSON格式返回
查看>>
Phalcon环境搭建与项目开发
查看>>
Phantom.js维护者退出,项目的未来成疑
查看>>
Pharmaceutical的同学们都看过来,关于补码运算的复习相关内容
查看>>
Phaser性能测试加强版
查看>>
phoenix 开发API系列(一)创建简单的http api
查看>>
Phoenix 查看表信息及修改元数据
查看>>
phoenixframework集成了所有自动化测试的思想的平台。mark一下。
查看>>
phoenix_执行sql报错_Error: ERROR 504 (42703): Undefined column. columnName=(state=4270_大数据工作笔记0181
查看>>
phoenix启动失败_The history file `/root/.sqlline/history` may be an older history---记录024_大数据工作笔记0184
查看>>
Phoenix基础命令_视图映射和表映射_数字存储问题---大数据之Hbase工作笔记0036
查看>>
phoenix无法连接hbase shell创建表失败_报错_PleaseHoldException: Master is initializing---记录020_大数据工作笔记0180
查看>>
Phoenix简介_安装部署_以及连接使用---大数据之Hbase工作笔记0035
查看>>
phoenix连接hbase报错Can not resolve hadoop120, please check your network_记录026---大数据工作笔记0187
查看>>
PhotoPrism:这款获得35.8K星的AI照片管理神器你值得拥有
查看>>
Photoshop工作笔记001---Photoshop常用快捷键总结
查看>>