Skip to main content

Command Palette

Search for a command to run...

利用 Telegraf 进行简单的系统监控

Published
•1 min read•View as Markdown

InfluxData 除了广为人知的 InfluxDB 之外,还有几个其他的产品,合称 TICK:

  • Telegraf:数据采集
  • InfluxDB:数据存储
  • Chronograf:数据展现
  • Kapacitor:数据分析、告警

在翻看 InfluxDB 的时候偶然发现了这个东西,虽然 Tick 四兄弟捆起来也不够看,不过 Telegraf 足够小巧,而且自动化的可能性更大,更符合目前的做事风格,所以就学习一下。

官宣: The plugin-driven server agent for collecting & reporting metrics.

所以 Telegraf 主要是一个框架,由数据输入、处理、输出三大类插件完成各种功能。Github 的 README.md 中列出了主要插件:https://github.com/influxdata/telegraf。总的来说还是比较丰富的,下面的操作将利用简单的输入插件结合 InfluxDB 输出插件完成一个初步的指标收集过程。

安装

CentOS

生成如下的 repo 文件:

[influxdb] name = InfluxDB Repository - RHEL $releasever baseurl = https://repos.influxdata.com/rhel/$releasever/$basearch/stable enabled = 1 gpgcheck = 0

yum install -y telegraf 即可完成安装。

Docker

docker pull telegraf

配置

yum 安装后在 /etc/telegraf 下会生成一个 telegraf.conf 文件。

配置文件中可以使用 "$ENV_ITEM" 的形式使用环境变量。

global_tags

这里记录的内容将作为 Tags 保存到 InfluxDB 的每个 Item 中。

agent

这一节内容是数据搜集服务的行为定义。这里暂时无需进行改动

outputs.influxdb

这里用于定义写入的 InfluxDB。

urls = ["http://localhost:8086"]
database = "telegraf"
timeout = "5s"
username = "telegraf"
password = "abcde!@#$%"

urls 参数是一个数组,代表一个集群,如果其中包含多个服务,则每次只会选择其中一台进行写入。

而在 inputs 一节中,缺省启用了很多系统属性,例如磁盘,网络等,这里我们添加一点 http 监控内容:

[[inputs.http_response]]
address = "http://163.com"
response_timeout = "5s"
method = "GET"

[[inputs.http_response]]
address = "http://sina.com.cn"
response_timeout = "5s"
method = "GET"

小窍门:可以用 telegraf -config telegraf.conf -input-filter http_response -test 命令,来检查配置的正确性。

配置文件编写完成之后,就可以利用 systemctl start telegraf,启动 telegraf 服务了。

启动之后,Telegraf 会在一定的时间间隔里向 InfluxDB 汇报数据。我们可以在 InfluxDB UI 中利用

select * from cpu

这样的语句来查询数据,或者接入 Grafana 等进行展现。

More from this blog

AI Agent 的“莫兰迪时刻”

一个新范式真正走向大众,往往不是从所有人都正确理解它开始,而是从它开始被反复引用、简化、误读,甚至滥用开始。 今天的 AI Agent,可能正走到这样一个时刻。 这篇文章的念头,来自我最近收听《大内密谈》vol.1434《审美升级or消费主义?从莫兰迪在中国聊起》时的一些联想。节目从莫兰迪色在中国的走红,谈到作品价格、知识产权、商业流量与消费主义。[9] 我听着听着想到另一个熟悉的技术史问题:为

Oct 5, 20263 min read

FDE 是传统运维产品厂商的出路吗?

很多传统运维产品厂商,已经不缺产品了。 从 ITSM、CMDB、监控、自动化,到 IAM、数据中心管理和各类大屏,一个成熟厂商往往都能拿出一张很完整的产品地图。销售材料上看,客户运维部门的日常工作几乎都被覆盖了。 但项目一落地,味道就变了。 产品越多,集成越重;模块越全,边界越模糊;客户越大,定制越深。到了后期,项目成功本身也会变成麻烦:现场改出来的东西回不到主干,配置越来越像黑箱,谁都不敢轻易升

Jun 29, 20263 min read

绵里藏针才是 AIOps 的本质?

Agent 让运维编排变得柔性、可变、甚至自演进;但真正敢进入生产环境的 AIOps,仍然离不开坚实、受控、可审计、可回退的自动化底座。 从 Gartner 提出 AIOps 概念到现在,也大概有十年了。这么多年来,这个领域好像发生了很多变化,又好像没什么“本质”的变化。技术上,我们经历了传统机器学习、深度学习和神经网络、以及大模型和智能体这样“翻天覆地”的变化;业务上,我们面对的是更多品种、更大

May 31, 20263 min read

龙虾恐慌:AIOps 又要改名了?

ChatGPT 开始,把 AI 拉近到普罗大众的面前,让无数人感受到 AI 的亲民魅力。而龙虾,则把大模型驱动的自动化能力,突然间变得水灵灵、活泼泼地走进千家万户。它不只是“风口上的猪”,而是风口本身。热度高到让 Mac mini 一度断货,不知道这在不在库克的预料之内。 每代人都有每代人的鸡蛋,春节期间,我就领了我的鸡蛋。翻出古老的 MacBook Air M1,充值各种大模型。当然了,这个工具

Mar 9, 20261 min read
【

【伪】架构师

346 posts