LogStash实践日志分析二:收集数据、入库、数据分析和kibana展示

简介:

1、原始数据源服务器,从日志拉取数据,并转化为utf8编码,增加ip地址,保存到Redis中,上配置如下:


[plain] view plain copy 在CODE上查看代码片派生到我的代码片

  1. input {  

  2.     file {  

  3.         path => "/tmp/123server.log"  

  4.         codec => json {  

  5.             charset => "GBK"  

  6.         }  

  7.         start_position => "beginning"  

  8.         sincedb_path => "/dev/null"  

  9.         type => "activitysun"  

  10.     }  

  11. }  

  12.   

  13. filter {  

  14.     date {  

  15.         match => ["timestamp", "UNIX"]  

  16.         remove_field => ["time"]  

  17.     }  

  18.     #ruby {  

  19.     #    code => "event.timestamp.time.localtime"  

  20.     #}  

  21.     mutate {  

  22.         #some pc no host  

  23.     replace => { "host" => "192.168.10.11" }     

  24.     }  

  25. }  

  26.   

  27. output {  

  28.     #stdout {  

  29.     #    codec => plain {  

  30.     #        charset => "UTF-8"  

  31.     #    }  

  32.     #}  

  33.     file {  

  34.         path => "/tmp/logstash.log"  

  35.         codec => json {  

  36.             charset => "UTF-8"  

  37.         }  

  38.     }  

  39.     redis {  

  40.         host => ["192.168.10.18"]  

  41.         port => 16378  

  42.         data_type => "list"  

  43.         key => "123server"  

  44.         codec => json {  

  45.             charset => "UTF-8"  

  46.         }  

  47.     }  

  48. }  


采用如下命令启动


[plain] view plain copy 在CODE上查看代码片派生到我的代码片

  1. /data/logstash-2.3.4/bin/logstash -f activitylog.conf  



2、收集服务器,从redis拉取数据,放入elasticsearch,时间做一下处理,方便分析。配置如下:


[plain] view plain copy 在CODE上查看代码片派生到我的代码片

  1. input {  

  2.   redis {  

  3.     host => ["192.168.10.18"]  

  4.     port => 26378  

  5.     data_type => "list"  

  6.     key => "123server"  

  7.     codec => json {  

  8.       charset => "UTF-8"  

  9.     }  

  10.     #type => "activitysun"  

  11.   }  

  12. }  

  13.   

  14. filter {  

  15.     ruby {  

  16.         code=>"event['daytag']=event.timestamp.time.localtime.strftime('%Y.%m.%d')"  

  17.     }  

  18. }  

  19.   

  20. output {  

  21.   elasticsearch {  

  22.     hosts => ["127.0.0.1:19200"]  

  23.     index => "%{type}-%{daytag}"  

  24.     #index => "%{type}-%{+yyyy.MM.dd}"  

  25.   }  

  26. }  

3、kibana展示






filebeat.yml




filebeat.prospectors:
- input_type: log
  paths:
    - /log/123.log
    #- /home/haoren/data/filebeat-5.0.2-linux-x86_64/test.log
  encoding: gbk
  symlinks: true
  include_lines: ['\[.*?统计\]','\[.*?结算\]']
  document_type: pchannelserver
  fields_under_root: true
  fields:
    host: 192.168.10.15


processors:
- drop_fields:
    #fields: ["beat.hostname", "beat.name", "beat.version", "input_type", "beat"]
    fields: ["input_type", "beat", "offset", "source"]


output.redis:
  enabled: true
  hosts: ["192.168.10.18"]
  password: "8841c09BAD52E63067C4DA"
  port: 15377
  datatype: list
  key: "filebeat"
  db: 0


output.file:
  enabled: true
  path: "/tmp/filebeat"


output.console:
  enabled: false











本文转自 chengxuyonghu 51CTO博客,原文链接:http://blog.51cto.com/6226001001/1894117,如需转载请自行联系原作者
相关实践学习
【涂鸦即艺术】基于云应用开发平台CAP部署AI实时生图绘板
【涂鸦即艺术】基于云应用开发平台CAP部署AI实时生图绘板
目录
相关文章
|
10月前
|
SQL 人工智能 监控
SLS Copilot 实践:基于 SLS 灵活构建 LLM 应用的数据基础设施
本文将分享我们在构建 SLS SQL Copilot 过程中的工程实践,展示如何基于阿里云 SLS 打造一套完整的 LLM 应用数据基础设施。
3174 109
|
10月前
|
数据采集 运维 监控
不重启、不重写、不停机:SLS 软删除如何实现真正的“无感数据急救”?
SLS 全新推出的「软删除」功能,以接近索引查询的性能,解决了数据应急删除与脏数据治理的痛点。2 分钟掌握这一数据管理神器。
854 53
|
12月前
|
数据采集 数据可视化 数据挖掘
用 Excel+Power Query 做电商数据分析:从 “每天加班整理数据” 到 “一键生成报表” 的配置教程
在电商运营中,数据是增长的关键驱动力。然而,传统的手工数据处理方式效率低下,耗费大量时间且易出错。本文介绍如何利用 Excel 中的 Power Query 工具,自动化完成电商数据的采集、清洗与分析,大幅提升数据处理效率。通过某美妆电商的实战案例,详细拆解从多平台数据整合到可视化报表生成的全流程,帮助电商从业者摆脱繁琐操作,聚焦业务增长,实现数据驱动的高效运营。
|
11月前
|
存储 缓存 Apache
StarRocks+Paimon 落地阿里日志采集:万亿级实时数据秒级查询
A+流量分析平台是阿里集团统一的全域流量数据分析平台,致力于通过埋点、采集、计算构建流量数据闭环,助力业务提升流量转化。面对万亿级日志数据带来的写入与查询挑战,平台采用Flink+Paimon+StarRocks技术方案,实现高吞吐写入与秒级查询,优化存储成本与扩展性,提升日志分析效率。
1476 1
|
11月前
|
SQL 数据挖掘 BI
数据分析的尽头,是跳出数据看数据!
当前许多企业在数据分析上投入大量资源,却常陷入“数据越看越细,业务越看越虚”的困境。报表繁杂、指标众多,但决策难、行动少,分析流于形式。真正有价值的数据分析,不在于图表多漂亮,而在于能否带来洞察、推动决策、指导行动。本文探讨如何跳出数据、回归业务场景,实现数据驱动的有效落地。
|
11月前
|
存储 关系型数据库 数据库
【赵渝强老师】PostgreSQL数据库的WAL日志与数据写入的过程
PostgreSQL中的WAL(预写日志)是保证数据完整性的关键技术。在数据修改前,系统会先将日志写入WAL,确保宕机时可通过日志恢复数据。它减少了磁盘I/O,提升了性能,并支持手动切换日志文件。WAL文件默认存储在pg_wal目录下,采用16进制命名规则。此外,PostgreSQL提供pg_waldump工具解析日志内容。
1010 0
|
11月前
|
数据采集 运维 监控
|
机器学习/深度学习 数据采集 数据可视化
基于爬虫和机器学习的招聘数据分析与可视化系统,python django框架,前端bootstrap,机器学习有八种带有可视化大屏和后台
本文介绍了一个基于Python Django框架和Bootstrap前端技术,集成了机器学习算法和数据可视化的招聘数据分析与可视化系统,该系统通过爬虫技术获取职位信息,并使用多种机器学习模型进行薪资预测、职位匹配和趋势分析,提供了一个直观的可视化大屏和后台管理系统,以优化招聘策略并提升决策质量。
1244 4
|
数据采集 数据可视化 数据挖掘
数据分析大神养成记:Python+Pandas+Matplotlib助你飞跃!
在数字化时代,数据分析至关重要,而Python凭借其强大的数据处理能力和丰富的库支持,已成为该领域的首选工具。Python作为基石,提供简洁语法和全面功能,适用于从数据预处理到高级分析的各种任务。Pandas库则像是神兵利器,其DataFrame结构让表格型数据的处理变得简单高效,支持数据的增删改查及复杂变换。配合Matplotlib这一数据可视化的魔法棒,能以直观图表展现数据分析结果。掌握这三大神器,你也能成为数据分析领域的高手!
432 2