flume taidir to kafkasink

flume的数据源采用taiDir,sink类型选择kafka类型

测试目标:flume监控某一个目录的日志文件,并将文件存储到kafka中,在kafka的消费端可以实现数据的消费

dip005、dip006、dip007安装kafka

dip005、dip006、dip007安装flume

1、kafka创建topic

./kafka-topics.sh --create --zookeeper dip005:2181,dip006:2181,dip007 --replication-factor 1 --partitions 1 --topic test

2、编写flume配置

# source的名字
agent.sources = s1
agent.channels = c1
agent.sinks = r1

# 指定source使用的channel
agent.sources.s1.channels = c1
agent.sinks.r1.channel = c1

######## source相关配置 ########
# source类型
agent.sources.s1.type = TAILDIR
agent.sources.s1.positionFile = /flume/taildir_position.json
agent.sources.s1.filegroups = f1
agent.sources.s1.filegroups.f1=/flume/data/.*log
agent.sources.s1.fileHeader = true

######## channel相关配置 ########
# channel类型
#agent.channels.c1.type = file
#agent.channels.c1.dataDirs = /Users/wangpei/tempData/flume/filechannle/dataDirs
#agent.channels.c1.checkpointDir = /Users/wangpei/tempData/flume/filechannle/checkpointDir
#agent.channels.c1.capacity = 1000
#agent.channels.c1.transactionCapacity = 100


agent.channels.c1.type = memory
agent.channels.c1.capacity = 1000
agent.channels.c1.transactionCapacity = 100


######## sink相关配置 ########
# sink类型
agent.sinks.r1.type = org.apache.flume.sink.kafka.KafkaSink
agent.sinks.r1.brokerList = dip005:9092,dip006:9092,dip007:9092
agent.sinks.r1.topic = test
clog.sinks.sink_log1.flumeBatchSize = 2000
clog.sinks.sink_log1.kafka.producer.acks = 1

3.启动flume

./bin/flume-ng agent -n agent -c conf -f conf/taildir_conf  -Dflume.root.logger=DEBUG,console

4.在监控目/flume/data 里放入*log文件,或者往*log文件里写数据

5.进入kafka的消费者看,执行消费,即可看到*log里面的数据

./kafka-console-consumer.sh --bootstrap-server dip005:9092 --from-beginning --topic test

 

转载于:https://www.cnblogs.com/students/p/10537392.html

记录一下flume中因为taildir_position.json因位置不对导致数据无法从kafka被采到hdfs上的问题 最后发现是我的taildir_position.json之前在/opt/module/flume/jobs/collectionProject路径下(4.JSONObject.class(flume/lib中也已经导入),我需要用flumekafka上的数据采集到hdfs上,发现数据怎么到不了hdfs。),导致flume读不到这个文件的位置,所以无法从kafka将数据读到hdfs。MySQL数据库的增量数据已从kafka成功同步到hdfs~2.我的flume配置文档(没问题),3.时间拦截器(没问题), 阅读详情

相关推荐

Python OpenCV基于颜色通道分离法去除图片中的红色印章

最近一段时间的工作都是研究如何去除图片中的红色印章,在网上查找了大量的大佬写过的方法,发现大多数是采取颜色通道分离法来做,并且效果还不错。站在前人的肩膀上,我又做了些许调整,谈不上是改进,但是能应对更对的情况总还是好的,特此记录。 拿发票做例子,印章相较于其它部分最大的不同就是印章是红色的,而其它部分不是(这是一句废话)。 那么第一步当然就是将红色分离出来,这一步可以采用Python第三方库OpenCV里的 cv2.split()方法,该方法是把RGB图像的三个通道拆分开来,得...

wl_Honest的博客 1万+

flume taildirsource kafka chnanel hadf sink 配置文件

3台机器,2台 flumekafka里面采集,一台从kafka里面拿 放到hafs里面 第一台机器 大概是 #taildir source #为各个组件命名 a1.sources = r1 a1.channels = c1 #声明source a1.sources.r1.type = TAILDIR a1.sources.r1.filegroups = f1 #监控的目录 a1.sources.r1.filegroups.f1 = /log/app.* #开启断点续传,不配置 默认开启 a1.sour

BuildH的博客 629

微信小程序 - 实现大文件上传分片/切片+本地选择文件上传超大文件,小程序大文件切片上传+断点续传+上传进度条+失败自动重传完整运行示例源码,支持图片、视频、文档各种文件(支持上传单个文件或批量上传)

微信小程序实现大文件上传,实现分片大文件上传,微信小程序 分片 断点续传 大文件上传,微信小程序实现大文件上传 分片上传 进度条,小程序文件分片上传,微信小程序如何上传很大的文件,在选择文件后,按指定大小将文件切割成独立的文件片,并逐片上传,uniapp 微信小程序上传大文件如何切片,微信小程序实现大文件分片上传、断点续传、秒传,解决大文件上传问题,大文件上传如何做断点续传,微信小程序wx.uploadFile,小程序上传视频,小程序上传文档,实现大文件上传(切片上传)实现大文件上传到服务器教程,支持批量多

🏆 前端领域优质创作者 1万+

Flume配置案例(三)-Kafka

flume-kafka

super_mochi1 965

flume实现上传nginx日志到kafka

flume上传nginx日志 nginx日志的切分策略实现

chanyue123的博客 1416

flume三种保存到kakfa的方式(文件,目录,端口)

flume采集文件保存到kafka 创建文件flumeexec.conf a1.sources = r1 a1.sinks = k1 a1.channels = c1 # 描述和配置source组件:r1 a1.sources.r1.type = exec a1.sources.r1.command = tail -F /home/nana/text.log # 描述和配置sink组件:k1 a1.sinks.k1.type = org.apache.flume.sink.kafka.KafkaSi

m0_55854549的博客 1180

flume实时采集全量或者增量文件或者文件夹数据到kafka

flume实时采集全量或者增量文件或者文件夹数据到kafka 这里安装的Flume单节点,Kafka单节点,目标是通过Flume去读取文件中的历史数据导入到kafka中,还有就是将实时更新的数据传输到kafka中。 一、Flume安装 Flume的安装使用可以说非常简单,直接进官网:http://flume.apache.org/ 最新是1.9.0版本,我们选择1.8.0版本下载。 配置flume的环境变量:略 二、kafka安装 kafka官网:http://kafka.apache.org/dow

qq_44962075的博客 4048

flume配置-生产环境下 Taildir Source to kafka Sink

生产环境下用flume搜集后端系统产产生的日志,并写入kafka集群,可以参照下面配置。 clog.sources = source_log clog.channels = channel_log clog.sinks = sink_log1 sink_log2 sink_log3 clog.sources.source_log.type = TAILDIR clog.sources.sou

RangeYan 5793

大数据——Flume+Kafka+Flume整合模式

创建kafka主题 #启动kafka服务 kafka-server-start.sh /opt/software/kafka280cala212/conf/kraft/server.properites #创建主题 #topic主题名test01 #partitions分区数1 #replication-factor备份数量1 kafka-topics.sh --create --topic test01 --partitions 1 --replication-factor 1 ...

Vicky_Tang 1万+

Flume_Flume常用配置6 source:taildir channel:memory sink:kafka

     最近,博主研究了一下之前一直想研究的 kafka sink。特此记录一下:   下面讲解一些注意事项:   对于 memory channel 来说 :   capacity :  默认值:100 单位: int 含义: 通道内事件的最大数量。 注意:      如果事件之间的大小差别很大,可以使用字节数来进行调整。(以下两项)   byteCapacity:...

迎难而上 667

flume1.7.0新功能taildir日志采集

第一步:解压缩 [root@service_es3 conf]# tar -zvx -f flume-ng-1.6.0-cdh5.11.0.tar.gz 第二步:修改conf的env文件 [root@service_es3 software]# cd apache-flume-1.6.0-cdh5.11.0-bin/conf/ [root@service_es3 conf]# ...

1530

flume使用(四):taildirSource多文件监控实时采集

flume使用(一):入门demo flume使用(二):采集远程日志数据到MySql数据库 ...

maoyuanming0806的博客 2万+

flumeTaildirSource介绍及升级改造

flume 1.7.0推出了taildirSource组件。tail监控目录下匹配上正则表达式的的所有文件,实现断点续传。 但是我后来发现cdh版的flume-1.6.0也已经有这个组件了,而官方的Apache版的apache-flume-1.6.0-bin却没有这个组件。并且Apache版的flume1.7.0比cdh版的flume1.6.0的org.apache.flume.source.t

小强签名设计 的博客 5153

Flume1.7.0的TaildirSource介绍

使用更改后的TaildirSource,可以递归地监听配置目录的动态变化的文件。需求描述使用了SpoolDirectorySource可以配置一个监听目录,会监听该目录下所有的文件,但是如果配置目录下面嵌套了子目录,则无法监听,通过修改源码,我们可以递归地对配置目录的所有子目录的所有文件进行监听,见上一篇文章 Flume的Spooling Directory Source支持Sub-director

在路上的学习者 1万+

Flume配置TailDirSource,FileChannel,HDFSSink和KafkaSink的单机测试

文章目录版本选择技术选型单机配置(Standalone)zookeeperkafkaflume启动程序hadoopzookeeperkafkaflume测试 版本选择 组件 版本号 Scala 2.11.x Hadoop 2.6.0-cdh5.7.0 Kafka (apache) 2.11-0.10.2.2 Flume 1.6.0-cdh5.7.0 Zookeepe...

小朋友2滴偷偷的在写博客 847

flume采集数据到hdfs、kafka配置文件

flume采集数据到hdfs、kafka配置文件 执行命令 nohup bin/flume-ng agent -n a10 -c conf/ -f ./conf/server/flume-taildir-kafka.conf -Dflume.root.logger=INFO,console >> ./logs/fflume-taildir-kafka.log 2>&1 & 采集日志文件到kafka flume-taildir-kafka.conf #agent a

weixin_42042307的博客 505

flumeTaildir Source支持变化追加文件的日志收集

flumeTaildir Source支持变化追加文件的日志收集

偏执狂才能生存!热忱比专业知识更重要......... 1万+

Flume TaildirSource 实现递归

下载源码 flume-ng-1.6.0-cdh5.7.0-src.tar.gz 修改源码 打开 org.apache.flume.source.taildir.ReliableTaildirEventReader类 找到getMatchFiles 方法 private List<File> getMatchFiles(File p...

夜的博客 1588

Flume之——Flume读取日志数据写入Kafka

转载请注明出处:http://blog.csdn.net/l1028386804/article/details/79366155一、Flume配置flume要求1.6以上版本flume-conf.properties文件配置内容,sinks的输出作为kafka的producta1.sources = r1 a1.sinks = k1 a1.channels = c1 # Describe/co...

冰河的专栏 8070

Flume Taildir Source监听实时追加内容的文件

flume中有三种可监控文件或目录的source、分别是Exec Source、Spooling Directory Source和Taildir Source。 Taildir Source是1.7版本的新特性,综合了Spooling Directory Source和Exec Source的优点。 1、flume中有三种可监控文件或目录的source、分别是Exec Source、Spooli...

感谢你的关注~~~~ღ( ´・ᴗ・` ) 857

污水处理参数的小波神经网络软测量技术.pdf

污水处理参数的小波神经网络软测量技术.pdf

上一篇: JAVA 日志级别
下一篇: 洛谷 - P2280 - 激光炸弹
weixin_30809333
博客等级 码龄11年 111粉丝 0原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值