详解十三款运维监控工具_听云 监控宝-程序员宅基地

技术标签: 运维  # Zabbix  # Grafana  

目录

一、开源工具介绍

1、Zabbix

2、Nagios

3、Ganglia

4、Grafana

5、Zenoss

6、Open-falcon

7、Cacti

8、天兔开源监控(只适用于mysql、redis、oracle)

二、商用运维监控系统篇

1、监控宝

2、听云

3、360网站服务监控

4、阿里云监控

5、百度云观测


纵观我们部署在基础设施当中并始终保持运作的全部测量机制,监控系统无疑是重要性最高的机制之一,但它却常常遭到我们的忽视。如果能够建立起一套坚实的监控系统来针对可能发生的灾难加以警示,我们就有机会迅速启动灾难响应方案或者着手排除复杂的性能故障,这对于任何规模的企业而言都极具巨大的实际价值。

有效的运行监测体系,最终离不开相关技术平台的支撑,而我们需要了解监测技术平台

一、开源工具介绍

1、Zabbix

官方网站:Zabbix :: The Enterprise-Class Open Source Network Monitoring Solution

推荐星级:★★★★★

Zabbix是一个基于WEB界面的提供分布式系统监控以及网络监控功能的企业级开源运维平台,也是目前国内互联网用户中使用最广的监控软件,云智慧遇到的85%以上用户在使用Zabbix做监控解决方案。

入门容易、上手简单、功能强大并且开源免费是云智慧对Zabbix的最直观评价。Zabbix易于管理和配置,能生成比较漂亮的数据图,其自动发 现功能大大减轻日常管理的工作量,丰富的数据采集方式和API接口可以让用户灵活进行数据采集,而分布式系统架构可以支持监控更多的设备。理论上,通过 Zabbix提供的插件式架构,可以满足企业的任何需求。

用户群:90%以上中小型的泛互联网企业

优点:

1. 支持多平台的企业级分布式开源监控软件

2. 安装部署简单,多种数据采集插件灵活集成

3. 功能强大,可实现复杂多条件告警,

4. 自带画图功能,得到的数据可以绘成图形

5. 提供多种API接口,支持调用脚本

6. 出现问题时可自动远程执行命令(需对agent设置执行权限)

缺点:

1. 项目批量修改不方便

2. 入门容易,能实现基础的监控,但是深层次需求需要非常熟悉Zabbix并进行大量的二次定制开发,难度较大;

3. 系统级别报警设置相对比较多,如果不筛选的话报警邮件会很多;并且自定义的项目报警需要自己设置,过程比较繁琐(但是网上的模板比较,也可以使用模板导入的方法);

4. 缺少数据汇总功能,如无法查看一组服务器平均值,需进行二次开发;

5. 数据报表需要特殊二次开发定义;

2、Nagios

官方网站:Nagios - The Industry Standard In IT Infrastructure Monitoring

推荐星级:★★★★☆

Nagios是一款开源的企业级监控系统,能够实现对系统CPU、磁盘、网络等方面参数的基本系统监控,以及 SMTP,POP3,HTTP,NNTP等各种基本的服务类型。另外通过安装插件和编写监控脚本,用户可以实现应用监控,并针对大量的监控主机和多个对象 部署层次化监控架构。

Nagios最大的特点是其强大的管理中心,尽管其功能是监控服务和主机的,但Nagios自身并不包括这部分功能代码,所有的监控、告警功能都是由相关插件完成的。

用户群:适合复杂IT环境的企业

优点:

1. 出错的服务器、应用和设备会自动重启,自动日志滚动

2. 配置灵活,可以自定义shell脚本,通过分布式监控模式

3. 支持以冗余方式进行主机监控,报警设置多样

4. 命令重新加载配置文件无需打扰Nagios的运行

缺点:

1. 事件控制台功能很弱,插件易用性差

2. 对性能、流量等指标的处理不给力

3. 看不到历史数据,只能看到报警事件,很难追查故障原因

4. 配置复杂,初学者投入的时间、精力和成本比较大

3、Ganglia

官方网站:Ganglia Monitoring System

推荐星级:★★★★☆

Ganglia是加州大学伯克利分校发起的一个开源集群监控项目,设计之初是用于监控数以千计的网络节点。Ganglia是一个跨平台可扩展的,高性能计算系统下的分布式监控系统。它已被广泛移植到各种操作系统和处理器架构上。

用户群:适用于大型服务器集群用户。

优点:

1. 适合监控系统性能,通过曲线很容易见到每个节点的工作状态

2. 可以自定义监控项,监控展示有表格和图像两种,支持手机版

3. 部署方便,通过不同的分层管理上万台机器,无需逐个添加配置

缺点:

1. 没有内置的消息通知系统

2. 没有报警机制,出现问题不能够及时报警

4、Grafana

推荐星级:★★☆☆☆

官方网站:Grafana: The open observability platform | Grafana Labs

Grafana可以用在任何需要数据可视化的地方,如果有一天老板需要你做一份漂亮的业务数据图表,你无需头疼用什么绘图库去开发,你要做的仅仅是将业务数据稍作加工存入Grafana支持的DataSource,点几下鼠标即可配制出一份完美的数据图表。

因为这款工具只可以绘图,我们可以通过influxdb监控,Prometheus采集的主机信息!

5、Zenoss

推荐星级:★★★★☆

Zenoss Core是Zenoss的开源版本,其商用版本为ZenossEnterprise。作为企业级智能监控软件,Zenoss Core允许IT管理员依靠单一的WEB控制台来监控网络架构的状态和健康度。Zenoss Core的强大能力来自于深入的列表与配置管理数据库,以发现和管理公司IT环境的各类资产。Zenoss同时提供与CMDB关联的事件和错误管理系统, 以协助提高各类事件和提醒的管理效率。

优点:

1. Zenoss比较出色的地方在于它的Dashboard,可以配置很多portlet

2. 每个用户的界面都是分开管理的,自定义dashboard不会影响其他用户

3. 强大监控功能支持服务器、路由交换、防火墙、存储、数据库、中间件监控

4. 采用基于HBASE的opentsdb存储任意时间段的数据

5. 将状态监控,性能监控,资源管理,良好的报告机制进行有机的整合

缺点:

1. 对资源要求较高,即使只管理少数几台设备,也需要消耗大量硬件及内存等附加资源。

2. 针对windows系统,开源版只提供SNMP,通过WMI检测CPU,Disk,软硬件和性能只在收费版提供。

6、Open-falcon

推荐星级:★★★☆☆

Open-falcon是小米运维团队从互联网公司的需求出发,根据多年的运维经验,结合SRE、SA、DEVS的使用经验和反馈,开发的一套面向互联网的企业级开源监控产品。

Open-falcon架构

用户群:目前有几十家企业用户不同程度使用。

优点:

1. 自动发现,支持falcon-agent、snmp、支持用户主动push、用户自定义插件支持

2. 支持每个周期上亿次的数据采集、告警判定、历史数据存储和查询

3. 高效的portal、支持策略模板、模板继承和覆盖、多种告警方式、支持callback调用

4. 单机支撑200万metric的上报、归档、存储

5. 采用rrdtool的数据归档策略,秒级返回上百个metric一年的历史数据

6. 多维度的数据展示,用户自定义Screen

7. 通过各种插件目前支持Linux、Windows、Mysql、Redis、Memache、RabbitMQ和交换机监控。

缺点:由于发布时间较短,很多基础的服务监控插件(如Tomcat、apache等)还不支持,很多功能还在不断完善中,另外由于缺少专门的支持,虽然有开放社区,但是解决问题的效率相对较低。

7、Cacti

推荐星级:★★★☆☆

官方网站:http://www.cacti.net

提示: 近几年cacti和nagios已经基本被zabbix代替

Cacti 在英文中的意思是仙人掌的意思,Cacti是一套基于PHP、MySQL、SNMP及RRDTool开发的网络流量监测图形分析工具。它通过snmpget来获取数据,使用 RRDtool绘画图形,它的界面非常漂亮,能让你根本无需明白rrdtool的参数能轻易的绘出漂亮的图形。而且你完全可以不需要了解RRDtool复杂的参数。它提供了非常强大的数据和用户管理功能,可以指定每一个用户能查看树状结 构、host以及任何一张图,还可以与LDAP结合进行用户验证,同时也能自己增加模板,让你添加自己的snmp_query和script!功能非常强大完善,界面友好。可以说,Cacti将rrdtool的所有“缺点”都补足了!下图是Cacti运行的主界面,

Cacti 工作流程

步骤一,snmp协议收集远程服务器的数据

步骤二,将snmp收集的数据内容保存到rrd数据库中

步骤三,若用户查看某台设备上的流量或其它状态信息 步骤四,在mysql数据库中查找该设备对应的rra数据库文件的名称

步骤五,通过rrdtool命令进行绘图即可

8、天兔开源监控(只适用于mysql、redis、oracle)

推荐星级:★★☆☆☆

官方网站:Lepus天兔开源企业级数据库监控系统 – MySQL监控|Oracle监控|PostgreSQL监控|MongoDB监控|Redis监控

简洁、直观、强大的开源数据库监控系统,MySQL/Oracle/MongoDB/Redis一站式性能监控,让数据库监控更简单

优点: 中文开源软件,里面监控mysql和redis可以精确到sql语句

缺点: 因为只有监控数据库和非关系数据库,监控项不能统一,不能结合其他监控平台

二、商用运维监控系统篇

1、监控宝

推荐星级:★★★★★

官方网站:http://www.jiankongbao.com

监控宝是云智慧为用户提供IT性能监控(IT Performance Monitoring)的SaaS产品,包含网站监控、服务器监控、中间件监控、数据库监控、应用监控、API监控和页面性能监控等功能。包含免费版、畅 享版和企业版,目前用户约40万,监控宝app也是国内唯一提供移动监控服务的产品。

免费的监控有限,但是报警确实不错

报警也是相当快的,有短信有邮件

优点:

作为国内最早提供基于SaaS服务的网络监控平台,监控宝不但为初级用户提供免费的标准服务,企业用户还可以按需购买所需的监控、告警资源,最大限度的节省企业运维成本;

监控宝通过遍布全球的300多个分布式监测节点,对网络进行稳定性和可用性的主动监控和实时分析,支持http(https)、ftp、ping、udp、tcp、smtp、traceroute等多种协议,测量CDN效果及DNS状态,全网全地域性能趋势分析。

缺点:除了花钱,没有不好的地方

2、听云

推荐星级:★★★★★

官方网站:http://www.tingyun.com

听云是帮助客户实时监控定位从崩溃报错、慢交互到网络环境出错等多维度复杂的性能问题。听云致力于用户视角的IT管理创新服务,为不同行业提供最终用户端到端的完整应用链的性能管理解决方案,帮助客户不断优化系统性能及用户体验,提高用户满意度和企业竞争力。

3、360网站服务监控

推荐星级:★★☆☆☆

360网站服务监控是一款面向广大站长的网站监控产品,提供免费的网站、服务器监控。

http://jk.cloud.360.cn/

用户群:个人站长

优点:

服务免费,支持网站HTTP监控、PING监控、域名DNS监控和服务器监控

提供网站访问全景数据和简单配置信息

缺点:

只支持简单的网站和服务器监控,历史数据保留15天,且免费监控点数量仅为四个

最后一次产品更新是2014年9月,目前已停止更新和运营支持

价格也不是很便宜

4、阿里云监控

官方网站:https://aliyun.com

推荐星级:★★★★☆

阿里云监控是一款免费网站监控产品,可监控站点和服务器,并提供多种告警方式:短信,旺旺,邮件。

用户群:阿里云用户

优点:

  1. 与阿里云服务捆绑紧密,允许用户自定义数据监控
  2. 阿里云多IDC间内网数据传输,不占用客户公网资源
  3. 支持对业务数据的通用统计,从各个角度反应服务的运行情况

缺点:

  1. 所有服务基于阿里云,功能单一,扩展性差
  2. 功能不够强大,只能满足基础监控需求

5、百度云观测

推荐星级:★★☆☆☆

官方网站:安全指数

百度云观测是百度推出的一款云服务产品,类似于360云监控、阿里云监控,主要是为站长提供免费的一站式网站监测、预警服务,功能覆盖网站运行状况、安全和访问速度等多个方面。

用户群:个人站长

优点:

对于用户每日访问的站点进行安全检测

国内各大城市云节点覆盖,支持CDN、DNS状态和主机监控

缺点:

需要进行网站认证

监控点少,功能简单,只能监测网站状态,不支持服务器、应用监控。

版权声明:本文为博主原创文章,遵循 CC 4.0 BY-SA 版权协议,转载请附上原文出处链接和本声明。
本文链接:https://blog.csdn.net/zfw_666666/article/details/125041866

智能推荐

java非负整数_(java)leetcode258 各位相加(给定一个非负整数 num,反复将各个位上的数字相加,直到结果为一位数。)(Add Digit)...-程序员宅基地

文章浏览阅读320次。题目描述:给定一个非负整数num,反复将各个位上的数字相加,直到结果为一位数。示例:输入: 38输出: 2解释: 各位相加的过程为:3 + 8 = 11, 1 + 1 = 2。 由于 2 是一位数,所以返回 2。解题思路:直接循环取出每一位上的数字,求和后,判断是否满足结束条件,若不满足,则继续对求和后的数字计算,知道满足条件为止。代码实现(java):class Solution {publi..._java 给定一个代表每个格子得分的非负整数数组,计算能够得到的

java 字节码指令_java 7e 01 0c 00 4b-程序员宅基地

文章浏览阅读730次。转:http://blog.csdn.net/coslay/article/details/43131645字节码格式字节码是JVM的机器语言。JVM加载类文件时,对类中的每个方法,它都会得到一个字节码流。这些字节码流保存在JVM的方法区中。在程序运行过程中,当一个方法被调用时,它的字节码流就会被执行。根据特定JVM设计者的选择,它们可以通过解释的方式,即时编译(Jus_java 7e 01 0c 00 4b

阿里云服务器默认初始密码是多少?_刚买的阿里云linux 密码多少-程序员宅基地

文章浏览阅读638次,点赞24次,收藏22次。​​默认密码是什么?没有默认密码,通过重置密码的方式来设置新的密码。阿里云服务器默认用户名Linux系统是root,Windows系统是administrator。阿里云服务器默认密码阿里云服务器没有默认密码,购买云服务器时没有创建密码,那么云服务器就没有密码。想要远程登录云服务器,需要先通过重置实例密码的方式来设置新的密码,然后通过设置的密码的登录。阿里云服务器没有默认密码阿里云服务器没有默认密码。_刚买的阿里云linux 密码多少

一文带你了解爬虫_爬虫是什么-程序员宅基地

文章浏览阅读2.8w次,点赞222次,收藏605次。前段时间我妈突然问我:儿子,爬虫是什么?我当时既惊讶又为难,惊讶的是为什么我妈会对爬虫好奇?为难的是我该怎么给她解释呢?老板:小明给你个重要任务。小明:就算996我也在所不辞(第一次接到老板的直接需求)!老板:你能不能搞到竞争对手的商品价格?小明:没问题(牛逼先吹出去),小事!老板:这可不是小事,只要你能持续获取竞品价格,我们就可以标价低于他们,持续如此大家就知道我们的价格肯定是比他们..._爬虫是什么

vue前端传递文件夹以及其他参数到后台_multipartfile前端怎么传-程序员宅基地

文章浏览阅读1.8k次。1、前端通过FormData进行传递,代码如下。2、后端通过如下方式进行接收和解析。_multipartfile前端怎么传

视角与焦距_当头鱼要拍到邓远处的物体需要切换到焦距正常镜头进行拍摄这是什么原理-程序员宅基地

文章浏览阅读205次,点赞6次,收藏6次。如果需要拍摄宽广的画面,可以选择具有较大视场角的镜头,但需要注意分辨率的降低可能会影响图像的清晰度和细节表现。这是因为短焦距镜头具有更宽的视角,能够捕捉到更多的画面,而长焦距镜头则具有更窄的视角,能够放大远处的物体。此外,需要注意的是,视场角和分辨率还受到其他因素的影响,如镜头的光学性能、相机的传感器尺寸和分辨率等。需要注意的是,视场角的计算可能受到镜头畸变、传感器尺寸和拍摄距离等因素的影响。另外,视场角的大小通常以度数表示,较大的视场角意味着更宽广的视野范围,而较小的视场角则意味着更狭窄的视野范围。_当头鱼要拍到邓远处的物体需要切换到焦距正常镜头进行拍摄这是什么原理

随便推点

DFS深度优先搜索-程序员宅基地

文章浏览阅读9.1k次,点赞19次,收藏58次。一、DFS的概念 {DFS的定义 DFS的搜索方式 DFS采用的数据结构 DFS的特点} 二、DFS的实战应用 {1.排列数字 2.n-皇后问题}_dfs

保密+完整+可用+安全,规避代码安全「马奇诺防线」,构建软件供应链整体安全_gitlab可以防止第三方人员泄露代码吗-程序员宅基地

文章浏览阅读1k次。3大阶段 + 4 大要点,打造软件供应链整体安全。_gitlab可以防止第三方人员泄露代码吗

电机学习笔记 无刷电机控制6步换相_无刷直流电机六步换相的初始角标定-程序员宅基地

文章浏览阅读1.6w次,点赞24次,收藏230次。无刷电机一般是三相这里控制电机靠的是三相六臂全桥电路。注意不能同侧导通,那就短路了,整个控制过程就是通过霍尔传感器的状态,判断在那一个位置,后按电机旋转真值表来控制。使用 PWM 控制直流无刷电机的策略包括PWM-ON、ON-PWM、H_PWM-L_ON、H_ONL_PWM 和 H_PWM-L_PWM。这 5 种控制策略,均是电机处于 120° 运行方式下进行的这 5 种调制方式为:PWM-ON 型。在 120° 导通区间,各开关管前 60° 采用 PWM 调制,后 60° 则恒通。_无刷直流电机六步换相的初始角标定

【生态伙伴】彬驰李俊杰:敏捷化开发永远是企业制胜的法宝-程序员宅基地

文章浏览阅读351次。慧聚行业英才,聚焦产业升级的CDEC2019中国数字智能生态大会暨第十二届中国软件渠道大会上海站已落下帷幕。会上有27家企业脱颖而出,入选“CDEC2019中国最具影响力...

html代码范例_最佳HTML范例和HTML5范例-程序员宅基地

文章浏览阅读4.4k次。html代码范例HTML provides the structure of websites. Here are some examples of how to use HTML syntax to build websites, including some examples of newer HTML5 features. HTML提供了网站的结构。 以下是一些如何使用HTML语法来构建网站..._html范例

unity如何通过代码修改Text/button等UI的RGB数值来控制UI颜色_unity 修改button rgb-程序员宅基地

文章浏览阅读4.3k次,点赞20次,收藏15次。错误的做法public Text text;text.color=new color(100,100,100,100);这样运行以后,ui的颜色一般为白色,无论你设置的是什么数字!正确做法public Text text;text.color=new color(100/255f,100/255f,100/255,100/255f);格式是new color(你需要设置的数字/255f,你需要设置的数字/255f,你需要设置的数字/255f,你需要设置的数字/255f)Warning千_unity 修改button rgb

推荐文章

热门文章

相关标签