前往小程序,Get更优阅读体验!
立即前往
首页
学习
活动
专区
工具
TVP
发布
社区首页 >专栏 >Azkaban-3.x 创建Flow

Azkaban-3.x 创建Flow

作者头像
CoderJed
发布2019-09-30 16:53:17
1.1K0
发布2019-09-30 16:53:17
举报
文章被收录于专栏:Jed的技术阶梯Jed的技术阶梯

1. Flow 2.0 基础

使用Azkaban Flow 2.0 来创建任务流,Flow 1.0 将被废弃

  • 创建一个名为flow20.project的文本文件,添加如下内容用以说明这是一个Azkaban Flow 2.0的项目:
代码语言:javascript
复制
azkaban-flow-version: 2.0
  • 创建一个名为basic.flow的文本文件,其中定义了一个project中所有需要运行的job,使用nametype来定义一个job,大部分job都会需要config这个配置,详细的内容在下文中说明,这里只是一个简单的示例:
代码语言:javascript
复制
nodes:
  - name: jobA
    type: command
    config:
      command: echo "This is an echoed text."
  • 选择上面创建好的两个文件,然后将其压缩为一个名为Archive.zip的zip文件,注意,是把两个文件压缩为一个文件,Linux中的操作如下:
代码语言:javascript
复制
[hadoop@beh07 tmp]$ mkdir zip-test
[hadoop@beh07 tmp]$ mv flow20.project basic.flow zip-test/
[hadoop@beh07 tmp]$ cd zip-test/
# 将目录下的所有文件打成一个zip包
[hadoop@beh07 zip-test]$ zip -r Archive.zip .

# 错误操作
# 这是把zip-test这个目录打成一个zip包
[hadoop@beh07 tmp]$ zip -r Archive.zip zip-test

2. Job Dependencies

使用dependsOn标签配置Job之间的依赖,以下示例中,在jobA和jobB成功运行之后,jobC将开始运行。

代码语言:javascript
复制
nodes:
  - name: jobC
    type: noop
    # jobC depends on jobA and jobB
    dependsOn:
      - jobA
      - jobB

  - name: jobA
    type: command
    config:
      command: echo "This is an echoed text."

  - name: jobB
    type: command
    config:
      command: pwd

3. Job Config

Azkaban支持很多类型的Job,在type标签中指定即可,在config标签下使用key: value形式可以加入更多的配置。以下配置中,设置了要执行的pig脚本的位置,这个脚本需要和flow20.project以及basic.flow这两个文件一起打成zip包并上传到Project。

代码语言:javascript
复制
nodes:
  - name: pigJob
    type: pig
    config:
      pig.script: sql/pig/script.pig

4. Flow Config

Flow级别的配置也使用config标签,但是它与node标签同级。Flow级别的配置将会作用于所有的Job。

代码语言:javascript
复制
---
config:
  user.to.proxy: foo
  failure.emails: noreply@foo.com

nodes:
  - name: jobA
    type: command
    config:
      command: echo "This is an echoed text."

5. 多级Flow

你可以在Flow中添加其他子Flow,而不仅是添加Job。

代码语言:javascript
复制
nodes:
  - name: embedded_flow
    type: flow
    config:
      prop: value
    nodes:
      - name: jobB
        type: noop
        dependsOn:
          - jobA

      - name: jobA
        type: command
        config:
          command: pwd
本文参与 腾讯云自媒体分享计划,分享自作者个人站点/博客。
原始发表:2019.09.30 ,如有侵权请联系 cloudcommunity@tencent.com 删除

本文分享自 作者个人站点/博客 前往查看

如有侵权,请联系 cloudcommunity@tencent.com 删除。

本文参与 腾讯云自媒体分享计划  ,欢迎热爱写作的你一起参与!

评论
登录后参与评论
0 条评论
热度
最新
推荐阅读
目录
  • 1. Flow 2.0 基础
  • 2. Job Dependencies
  • 3. Job Config
  • 4. Flow Config
  • 5. 多级Flow
相关产品与服务
文件存储
文件存储(Cloud File Storage,CFS)为您提供安全可靠、可扩展的共享文件存储服务。文件存储可与腾讯云服务器、容器服务、批量计算等服务搭配使用,为多个计算节点提供容量和性能可弹性扩展的高性能共享存储。腾讯云文件存储的管理界面简单、易使用,可实现对现有应用的无缝集成;按实际用量付费,为您节约成本,简化 IT 运维工作。
领券
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档