欢迎光临
大数据之使用Flume监听本地文件采集数据流到HDFS
   

大数据之使用Flume监听本地文件采集数据流到HDFS

本文介绍Flume监听本地文件采集数据流到HDFS

我还写了一篇文章是Flume监听端口采集数据流到Kafka【点击即可跳转,写的也非常详细】

大数据之使用Flume监听本地文件采集数据流到HDFS,第1张

任务一:

在Master节点使用Flume采集/data_log目录下实时日志文件中的数据(实时日志文件生成方式为在/data_log目录下执行./make_data_file_v1命令即可生成日志文件,如果没有权限,请执行授权命令chmod 777 /data_log/make_data_file_v1),将数据存入到Kafka的Topic中(Topic名称分别为ChangeRecord、ProduceRecord和EnvironmentData,分区数为4),将Flume采集ChangeRecord主题的配置截图粘贴至对应报告中;

任务二:

编写新的Flume配置文件,将数据备份到HDFS目录/user/test/flumebackup下,要求所有主题的数据使用同一个Flume配置文件完成,将Flume的配置截图粘贴至对应报告中。

①模拟数据源环境

进入/data_log路径运行脚本mak

 
 大江东去的下一句  每天十句话  牡丹十月开花吗  松树品种大全大图  槿怎么读  猕猴桃长在哪里 
打赏
版权声明:本文采用知识共享 署名4.0国际许可协议 [BY-NC-SA] 进行授权
文章名称:《大数据之使用Flume监听本地文件采集数据流到HDFS》
文章链接:https://goodmancom.com/wl/175635.html