我想检查文件是否存在,在HDFS位置使用oozie批处理。如何在OOZIE的决策节点中动态获取文件名?
在我的HDFS位置,在日常的基础上,我将在每天晚上11点获得像“test_08_01_2016.csv”,“test_08_02_2016.csv”这样的文件。
所以我想检查文件是否存在是晚上11点15分,我可以检查文件存在不使用决策节点。通过使用以下工作流。
<workflow-app name="HIVECoWorkflow" xmlns="uri:oozie:workflow:0.5">
<start to="CheckFile"/>
<decision name="CheckFile">
<switch>
<case to="nextOozieTask">
${fs:exists("/user/cloudera/file/input/test_08_01_2016.csv")}
</case>
<default to="MailActionFileMissing" />
</switch>
<action name="MailActionFileMissing" cred="hive2">
<hive2 xmlns="uri:oozie:hive2-action:0.1">
<job-tracker>${jobTracker}</job-tracker>
<name-node>${nameNode}</name-node>
<jdbc-url>jdbc:hive2://quickstart.cloudera:10000/default</jdbc-url>
<script>/user/cloudera/email/select.hql</script>
<file>/user/cloudera/hive-site.xml</file>
</hive2>
<ok to="End"/>
<error to="Kill"/>
</action>
<action name="nextOozieTask" cred="hive2">
<hive2 xmlns="uri:oozie:hive2-action:0.1">
<job-tracker>${jobTracker}</job-tracker>
<name-node>${nameNode}</name-node>
<jdbc-url>jdbc:hive2://quickstart.cloudera:10000/default</jdbc-url>
<script>/user/cloudera/email/select1.hql</script>
<file>/user/cloudera/hive-site.xml</file>
</hive2>
<ok to="End"/>
<error to="Kill"/>
</action>
<kill name="Kill">
<message>Action failed, error message[${wf:errorMessage(wf:lastErrorNode())}]</message>
</kill>
<end name="End"/>
,但我想动态获取文件名,例如像 “filenamt_todaysdate i.e test_08_01_2016.csv
”。
请帮我关于这个如何获得文件名动态。
在此先感谢。
RTFM => https://oozie.apache.org/docs/4.1.0/CoordinatorFunctionalSpec.html#a6.7.3._coord:nominalTime_EL_Function –