当前位置：首页 > news >正文

flume-将日志采集到hdfs

news 2026/5/22 10:58:45

看到hdfs大家应该做什么？

是的你应该去把集群打开，

cd /export/servers/hadoop/sbin

启动集群

./start-all.sh

在虚拟机hadoop02和hadoop03上的conf目录下配置相同的日志采集方案，‘

cd /export/servers/flume/conf

切换完成之后，接下来我们输入下面的命令

vi exec-avro-new.conf

然后在文件里面输入

a1.sources = r1 r2 r3
a1.sinks = k1
a1.channels = c1
#配置第一个Source
a1.sources.r1.type = exec
a1.sources.r1.command = tail -F /export/data/access.log
a1.sources.r1.interceptors = i1
a1.sources.r1.interceptors.i1.type = static
a1.sources.r1.interceptors.i1.key = type
0a1.sources.r1.interceptors.i1.value = access
#配置第二个Source
a1.sources.r2.type = exec
a1.sources.r2.command = tail -F /export/data/nginx.log
a1.sources.r2.interceptors = i2
a1.sources.r2.interceptors.i2.type = static
a1.sources.r2.interceptors.i2.key = type
a1.sources.r2.interceptors.i2.value = nginx
#配置第三个Source
a1.sources.r3.type = exec
a1.sources.r3.command = tail -F /export/data/web.log
a1.sources.r3.interceptors = i3
a1.sources.r3.interceptors.i3.type = static
a1.sources.r3.interceptors.i3.key = type
a1.sources.r3.interceptors.i3.value = web
#配置Channel
a1.channels.c1.type = memory
a1.channels.c1.capacity = 2000000
a1.channels.c1.transactionCapacity = 100000
#配置Sink
a1.sinks.k1.type = avro
a1.sinks.k1.hostname = hadoop01
a1.sinks.k1.port = 41414
# 关联Source、Sink和Channel 
a1.sources.r1.channels = c1
a1.sources.r2.channels = c1
a1.sources.r3.channels = c1
a1.sinks.k1.channel = c1

记住hadoop02和hadoop03都需要上传哈，上传这个相同的文件就ok。

那么接下来，让我们切换到hadoop01.选择成功之后，我们再次切换到熟悉的conf目录

cd /export/servers/flume/conf

输入

vi avro-hdfs.conf

输入下面内容

a1.sources = r1
a1.sinks = k1
a1.channels = c1
# 配置Source
a1.sources.r1.type = avro
a1.sources.r1.bind = hadoop01
a1.sources.r1.port = 41414
a1.sources.r1.interceptors = i1
a1.sources.r1.interceptors.i1.type = timestamp
# 配置Channel
a1.channels.c1.type = memory
a1.channels.c1.capacity = 20000
a1.channels.c1.transactionCapacity = 10000
# 配置Sink
a1.sinks.k1.type = hdfs
a1.sinks.k1.hdfs.path = hdfs://hadoop1:9000/Flume/logs/%{type}/%Y%m%d
a1.sinks.k1.hdfs.filePrefix = events
a1.sinks.k1.hdfs.fileType = DataStream
a1.sinks.k1.hdfs.rollCount = 0
a1.sinks.k1.hdfs.rollInterval = 0
a1.sinks.k1.hdfs.rollSize = 10485760
a1.sources.r1.channels = c1
a1.sinks.k1.channel = c1

那么好，上面的弄完了，我们接下来切换到。

hadoop01的lib目录下

cd /export/servers/hadoop/share/hadoop/common/lib

切换完成之后我们复制一个jar包到flume目录下，

cp guava-27.0-jre.jar /export/servers/flume/lib

复制完成之后我们切换到flume的lib目录下，把之前的guava删除掉

cd /export/servers/flume/lib

切换完成之后，我们删除之前版本的guava

rm -rf guava-11.0.2.jar

那么这个时候！

我们就需要启动集群！

不会启动集群的给自己两巴掌，然后去博主之前的博客寻找一下如何搭建hadoop集群。

一定要启动集群啊！

再次嘱咐、

已经启动的可以略过

，没有启动的回到文章的第一行，启动集群，再回来。

首先切换到hadoop01的conf目录下

flume-ng agent --name a1 --conf conf/ --conf-file avro-hdfs.conf -Dflume.root.logger=INFO,console

展示

那么接下来，我们切换到hadoop02和hadoop03！

切换到他们的conf目录

cd /export/servers/flume/conf

输入下面的内容

flume-ng agent --name a1 --conf conf/ --conf-file exec-avro-new.conf -Dflume.root.logger=INFO,console

那么开始展示hadoop02和hadop03的

两个启动完成之后，我们返回看一下hadoop01的日志

上面的操作完成之后，我们各自克隆3个hadoop02和hadoop03窗口

那么接下来的盛况应该是

一共这么老些个

那么我们挑选一个hadoop02和hadoop03的窗口输入下面的命令查看一下日志的写入情况，

while true;do echo "access access..." >> /export/data/access.log;sleep 1;done

再挑选一组

while true;do echo "nginx nginx..." >> /export/data/nginx.log;sleep 1;done

再再挑选一组

while true;do echo "web web..." >> /export/data/web.log;sleep 1;done

那么我们回到hadoop01，查看一波日志

ok那么下一步；

打开hadoop01的9870端口的webui

点进去，再点一下

就会看到我们写入的日志内容

随便点进去一个

那么到这里为止flume，将日志采集到hdfs就完成啦

撒花~

有问题可以再评论区提出来，看到的话会给大家解答，或者私信也可以

flume-将日志采集到hdfs

看到hdfs大家应该做什么？ 是的你应该去把集群打开， cd /export/servers/hadoop/sbin 启动集群 ./start-all.sh 在虚拟机hadoop02和hadoop03上的conf目录下配置相同的日志采集方案，‘ cd /export/servers/flume/conf 切换完成之后&#…...

编程日记 2024/11/23 5:18:13

一文学习开源框架LeakCanary

LeakCanary 简介 LeakCanary 是一个由 Square 开发的开源工具，主要用于检测和诊断 Android 应用中的内存泄漏问题。它通过自动化的方式帮助开发者捕捉和分析可能导致内存泄漏的对象，简化了内存问题的排查过程。 LeakCanary 的功能自动检测内存泄漏&a…...

编程日记 2024/11/23 5:17:11

jetson orin系列开发版安装cuda的gpu版本的opencv

opencv安装包下载地址： https://github.com/opencv/opencv/扩展库下载地址： https://github.com/opencv/opencv_contrib1. 删除jetpack包中的opencv版本原先的opencv库安装在目录/usr/lib/aarch64-linux-gnu/下（一般其他的第三方库也都安…...

编程日记 2024/11/23 5:16:10

数据结构-8.Java. 七大排序算法(中篇)

本篇博客给大家带来的是排序的知识点, 由于时间有限, 分两天来写, 中篇主要实现后三种排序算法: 冒泡排序,快速排序,下一篇讲归并排序. 文章专栏: Java-数据结构若有问题评论区见欢迎大家点赞评论收藏分享如果你不知道分享给谁,那就分享给薯条. 你们的支持是我不断创作…...

编程日记 2024/11/23 5:15:09

数据结构C语言描述4(图文结合)--栈的实现,中序转后序表达式的实现

前言这个专栏将会用纯C实现常用的数据结构和简单的算法；有C基础即可跟着学习，代码均可运行；准备考研的也可跟着写，个人感觉，如果时间充裕，手写一遍比看书、刷题管用很多，这也是本人采用纯C语言…...

编程日记 2024/11/23 5:14:08

python基本数据类型 -- 元组tuple

在 Python 中，元组（Tuple）是一种轻量级的、不可变的数据结构。与列表类似，元组用于存储有序的数据集合，但它一旦创建，其内容就无法更改。这种特性让元组在某些场景下更加安全和高效。本文将从定义、操作、应…...

编程日记 2024/11/23 5:10:04

tcpdump交叉编译

TCPDUMP在Libpcap上开发。首先需要编译libcap。网上那么多教程，下载地址都只给了一个英文的官网首页， 你尽可以试试，从里面找到下载地址都要费半天时间。 \color{red}网上那么多教程，下载地址都只给了一个英文的官网首页&#…...

编程日记 2024/11/23 5:07:01

Spring IOC注入手动注入 set方法注入需要提供set方法 public class UserService {private UserDao userDao; public void setUserDao(UserDao userDao) {this.userDao userDao;} } 设置属性字段的值 <bean id"userService" class"com.shsxt.servi…...

编程日记 2024/11/23 5:00:53

uniapp微信小程序转发跳转指定页面

onShareAppMessage 是微信小程序中的一个重要函数，用于自定义转发内容。当用户点击右上角的菜单按钮，并选择“转发”时，会触发这个函数。开发者可以在这个函数中返回一个对象，用于定义分享卡片的标题、图片、路径等信息。使用场…...

编程日记 2024/11/23 4:55:47

利用uniapp开发鸿蒙：运行到鸿蒙模拟器—踩坑合集

从uniapp运行到鸿蒙模拟器上这一步，就有非常多的坑，一些常见的坑，官网都有介绍，就不再拿出来了，这里记录一下官网未记录的大坑 1.运行路径从hbuilderx启动鸿蒙模拟器解决方法： Windows系统，官…...

编程日记 2024/11/23 4:51:42

【Vue】Vue3.0（二十五）Vue3.0中的具名插槽的概念和使用场景

上篇文章【Vue】Vue3.0（二十四）Vue3.0中 r e f s 、 refs 、 refs、parent 的概念和使用场景 🏡作者主页：点击！ 🤖Vue专栏：点击！ ⏰️创作时间：2024年11月20日16点30分 …...

编程日记 2024/11/23 4:50:40

【pytorch-02】：张量的索引、形状操作和常见运算函数

文章目录 1 张量索引1.1 简单行列索引和列表索引1.2 布尔索引和多维索引 2 张量的形状操作2.1 reshape函数2.2 transpose和permute函数的使用2.3 view和contiguous函数2.4 squeeze和unsqueeze函数用法2.5 张量更改形状小结 3 常见运算函数 1 张量索引 1.1 简单行列索引和列表索…...

编程日记 2024/11/23 4:49:38

C语言-指针作为函数返回值及二级指针

1、指针作为函数返回值 c语言允许函数的返回值是一个指针（地址）我们将这样的函数称为指针函数，下面的例子定义一了一个函数strlong（），用来返回两个字符串中较长的一个： 1. #include <stdio…...

编程日记 2024/11/23 4:48:36

css 使用图片作为元素边框

先看原始图片再看效果边框的四个角灭有拉伸变形,但是图片的中部是拉伸的代码 border-style: solid;/* 设置边框图像的来源 */border-image-source: url(/static/images/mmwz/index/bk_hd3x.png);/* 设置如何切割图像 */border-image-slice: 66;/* 设置边框的宽度 */border…...

编程日记 2024/11/23 4:46:34

Linux无sudo权限将zsh作为默认shell

由于我只有用户权限，没有sudo权限，将zsh作为用户默认shell需要密码，所以没法在系统层面进行操作，下面另寻他法。安装zsh 可以根据网上教程去安装zsh，一般电脑上会带有zsh，可以使用下述命令查看是否安装z…...

编程日记 2024/11/23 4:42:29

【React 进阶】掌握 React18 全部 Hooks

一、数据更新驱动 1. useState 1. 基础介绍 useState主要用于声明和操作状态变量，可以使函数组件像类组件一样拥有state const [state, setState] useState(initialState);state：状态，作为渲染视图的数据源 setState：改变st…...

编程日记 2024/11/23 4:41:28

【卡尔曼滤波】数据预测Prediction观测器的理论推导及应用 C语言、Python实现（Kalman Filter）

【卡尔曼滤波】数据预测Prediction观测器的理论推导及应用 C语言、Python实现（Kalman Filter） 更新以gitee为准： 文章目录数据预测概念和适用方式线性系统的适用性数据预测算法和卡尔曼滤波公式推导状态空间方程和观测器先验估计后验估计…...

编程日记 2024/11/23 4:40:27

【SQL50】day 2

目录 1.每位经理的下属员工数量 2.员工的直属部门 3.判断三角形 4.上级经理已离职的公司员工 5.换座位 6.电影评分 7.修复表中的名字 8.患某种疾病的患者 9.删除重复的电子邮箱 1.每位经理的下属员工数量 # Write your MySQL query statement below #e1是经理，…...

编程日记 2024/11/23 4:36:23

【内存管理】理解 `WeakReference` 以更好地管理 Android 应用中的内存

在 Android 应用开发中，内存管理至关重要。糟糕的内存管理可能导致“内存泄漏”，即一些不再需要的对象仍然留在内存中，最终导致性能下降，甚至应用崩溃。WeakReference 就是帮助解决这个问题的一种工具。在本文中，我们将…...

编程日记 2024/11/23 4:31:18

解决IDEA中Maven管理界面不是层级结构的问题

文章目录 0. 前言1. 点击Maven管理界面右上角的三个点2. 勾选将模块分组3. 分组后的层级结构更多 IDEA 的使用技巧可查看 IDEA 专栏中的文章：IDEA 0. 前言在 IDEA 中，如果项目中有很多子模块，每个子模块中又有一个或多个子模块时&#xf…...

编程日记 2024/11/23 4:30:16

如何将GIMP秒变Photoshop？GimpPs主题插件完整配置指南

如何将GIMP秒变Photoshop？GimpPs主题插件完整配置指南【免费下载链接】GimpPs Gimp Theme to be more photoshop like 项目地址: https://gitcode.com/gh_mirrors/gi/GimpPs 如果你正在寻找一款能让GIMP拥有Photoshop般专业界面的主题插件，GimpP…...

编程新知 2026/5/22 9:43:25