[Linux]结合awk删除hdfs指定日期前的数据
内容导读
互联网集市收集整理的这篇技术教程文章主要介绍了[Linux]结合awk删除hdfs指定日期前的数据,小编现在分享给大家,供广大互联网技能从业者学习和参考。文章包含2007字,纯文字阅读大概需要3分钟。
内容图文
![[Linux]结合awk删除hdfs指定日期前的数据](/upload/InfoBanner/zyjiaocheng/1236/0c672883ea3e4b2f8959a872bfcb162b.jpg)
业务背景
约定五天前的HDFS数据为过期版本数据,写一个脚本自动删除过期版本数据
$ hadoop fs -ls /user/pms/workspace/ouyangyewei/data
Found 9 items
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-01
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-02
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-03
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-04
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-05
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-06
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-07
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-08
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-09
脚本实现
# ---------------------------------------------------------
#
# 删除历史版本(五天前的为过期版本数据)
#
# ---------------------------------------------------------
old_version=$(hadoop fs -ls /user/pms/workspace/ouyangyewei/data | awk ‘BEGIN{ five_days_ago=strftime("%F", systime()-5*24*3600) }{ split($8,arr,"/"); if(arr[7]<five_days_ago){printf "%s\n", $8} }‘)
arr=(${old_version// / })
for version in${arr[@]}
do
hadoop fs -rmr $version
done
执行以后
$ hadoop fs -ls /user/pms/workspace/ouyangyewei/data
Found 4 items
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-06
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-07
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-08
drwxr-xr-x- pms pms 02015-08-1117:03 /user/pms/workspace/ouyangyewei/data/2015-08-09
版权声明:本文为博主原创文章,未经博主允许不得转载。
原文:http://blog.csdn.net/yeweiouyang/article/details/47426823
内容总结
以上是互联网集市为您收集整理的[Linux]结合awk删除hdfs指定日期前的数据全部内容,希望文章能够帮你解决[Linux]结合awk删除hdfs指定日期前的数据所遇到的程序开发问题。 如果觉得互联网集市技术教程内容还不错,欢迎将互联网集市网站推荐给程序员好友。
内容备注
版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 gblab@vip.qq.com 举报,一经查实,本站将立刻删除。
内容手机端
扫描二维码推送至手机访问。