标签: monitoring

为什么我应该关心 NTP 内核统计信息?

我注意到 munin 绘制了一些我从未完全理解的有关时序/内核统计信息的信息。我的大多数服务器似乎都接近于 0,我认为这很好,但其中一个在其中一个图表上缓慢但稳定地变得越来越负面。

Munin 绘制了以下统计数据随时间变化的图表:

  • NTP 内核 PLL 估计误差(秒)
  • NTP 内核 PLL 频率 (ppm + 0)
  • NTP 内核 PLL 偏移(秒)
  • 系统对等体的 NTP 计时统计

这是 munin 文档中的一个示例:http : //demo.munin-monitoring.org/time-year.html

在网络上搜索 NTP 的简洁、易懂的定义,一无所获(除了一堆 Nagios 和 Munin 图),搜索 Server Fault 会发现大量答案,假设读者已经对 NTP 有所了解。

Stack Overflow 是这样定义的:

NTP 代表网络时间协议,它是一种 Internet 协议,用于将计算机的时钟与某个时间参考同步。

但这似乎有点迟钝——这会影响 Web 服务器、加密或数据库同步吗?

什么是 NTP,我为什么要关心?是否有任何统计数据特别需要确保不会失控?

monitoring ntp

7
推荐指数
1
解决办法
3688
查看次数

如何根据 SNMP 中的原始 CPU 滴答计算 CPU %

根据http://net-snmp.sourceforge.net/docs/mibs/ucdavis.html#scalar_notcurrent ssCpuUserssCpuSystemssCpuIdle等被弃用,以支持原始变体(ssCpuRawUser等)。

前一个值(不包括 nice、wait、kernel、interrupt 等)返回一个百分比值:

在最后一分钟内计算的处理用户级代码所花费的 CPU 时间百分比。

此对象已被弃用,取而代之的是“ ssCpuRawUser(50)”,它可用于计算相同的指标,但可以在任何所需的时间段内计算。

原始值返回 CPU 花费的“原始”滴答数:

处理用户级代码所花费的“滴答”数(通常为 1/100 秒)。

在多处理器系统上,“ ssCpuRaw*”计数器在所有 CPU 上累积,因此它们的总和通常为 N*100(对于 N 个处理器)。

我的问题是:如何将刻度数转换为百分比?

也就是说,你怎么知道每秒有多少滴答声(通常——这意味着不总是——1/100s,这意味着每 100 秒一次,或者滴答声代表 1/100 秒)。

我想您还需要知道有多少个 CPU,或者您需要获取所有 CPU 值以将它们加在一起。我似乎找不到一个 MIB,它可以为您提供 CPU 数的整数值,这使得前一条路线很尴尬。后一条路线似乎不可靠,因为一些数字重叠(有时)。例如,ssCpuRawWait有以下警告:

此对象不会在底层操作系统不测量此特定 CPU 指标的主机上实现。 该时间也可能包含在“ ssCpuRawSystem(52)”计数器内。

一些帮助将不胜感激。似乎到处都在说 % 已被弃用,因为它可以派生,但我还没有找到任何显示执行此派生的官方标准方法的地方。

第二个组成部分是这些“滴答声”似乎是累积的,而不是在某个时间段内。如何在一段时间内对值进行采样?

我想要的最终信息是:“当前”(过去 1-60 秒可能就足够了)的用户、系统、空闲、好(理想情况下是窃取,尽管似乎没有标准 MIB)的百分比,偏好较小的时间跨度)。

monitoring central-processing-unit nagios snmp

7
推荐指数
1
解决办法
2万
查看次数

访问 ESXi5.1 上的温度数据?

对于 ESXi5.1 (VMWare vSphere) 映像,我可以在 vSphere 用户界面(在监视器/硬件状态下)看到温度数据。我尝试使用 snmpwalk 搜索可用的 snmp 数据,但在那里的任何地方都找不到数据。

也许我错过了一些东西。有人知道温度数据的正确 MIB 吗?

否则,如何访问这些数据?

顺便说一下,这是一台从HP 提供的映像安装的机器。

编辑:硬件是 ProLiant DL360 G7。

我不想监控服务器,而是绘制可用的温度计。

monitoring ilo snmp vmware-esxi

7
推荐指数
1
解决办法
2万
查看次数

内存使用率非常高,但没有被任何进程声明?

在我们的一台 Debian 服务器上对 LVM 进行压力测试时,我遇到了这个问题,即内存会被大量填满,导致服务器内存不足,但没有进程会占用内存。有关htop 中使用的颜色的说明,请参见http://i.imgur.com/cLn5ZHS.png,并参见https://serverfault.com/a/449102/125894

为什么会这样?
有什么方法可以查看正在使用内存的进程吗?
htop 被配置为不隐藏任何进程,那么 htop 缺少什么?

在这种特殊情况下,我可以肯定地说它是由 lvmcreate、lvmremove 或 dmsetup 直接或间接引起的,因为我正在对其进行压力测试。请注意,这个问题不是关于解决 LVM 问题,而是关于为什么任何进程都没有声明内存。停止所有 LVM 命令确实会将内存降低到 <600MB。

的输出free -m

             total       used       free     shared    buffers     cached
Mem:         32153      31958        194          0         52       3830
-/+ buffers/cache:      28075       4077
Swap:          975          0        975
Run Code Online (Sandbox Code Playgroud)


由于它的长度,顶部的输出,在 pastebin 上:http : //pastebin.com/WchrpF7W

linux monitoring memory lvm memory-usage

7
推荐指数
1
解决办法
8662
查看次数

如何远程安装、配置和维护 SNMP?

我希望在 Windows Server 2008 R2 上远程安装 SNMP 和 SNMP WMI 提供程序服务,为代理、陷阱和安全选项卡配置特定选项,然后确保这些服务和设置未被删除或关闭。这个目标是由希望使用 Zenoss 远程监控服务器健康状况促成的。

通过我在网上的搜索,我觉得这可以用 Powershell 完成,然后通过组策略推出,但我对此很陌生,有点令人困惑;我也可能错了。

我的一些服务器是企业版,而一些是标准版,都是 R2。我假设我必须为所有服务器安装 SP1、.Net 4.0 和 Powershell 3.0 才能在任何脚本中获得奇偶校验和可靠性。

到目前为止,我已经能够为 Powershell 编写一个脚本来调用 DISM 来安装 SNMP 服务并将该脚本设置为 GPO 中的登录脚本,但我知道这不是最好的方法,因为我不能只是去重新启动整个企业的服务器。

我需要指定以下项目: 代理 - 联系人和位置陷阱 - 社区名称和陷阱目标安全 - 发送身份验证陷阱 = 是,接受的社区名称只读并接受来自任何主机的 SNMP 陷阱 = 是

任何帮助将不胜感激!

remote-access monitoring snmp zenoss windows-server-2008-r2

7
推荐指数
1
解决办法
2万
查看次数

无代理监控:它是如何工作的?与传统监控相比的优势?

无代理监控如何工作?

根据我的理解(或不理解),这似乎是通过从中央服务器登录被监控的节点并在其上上传然后运行脚本来实现的?

基于代理和无代理的监控之间的主要区别是什么?无代理监控解决方案有哪些优点和缺点?

monitoring system-monitoring

7
推荐指数
1
解决办法
1905
查看次数

ssh 主机密钥证书,远程查找有效期?

我有一个使用 ssh 证书来验证 ssh 主机密钥的环境。我说的是通过运行创建的证书类型ssh-keygen -s /path/to/ca -h ...。这些证书还创建了一个有效期间隔,说明它们何时到期。这些证书现在已经使用了足够长的时间,我需要开始监控它们,以便在它们即将到期时提防。

我可以通过任何方式进行远程连接,而无需登录,并且以某种方式获取显示的有效间隔 alt。下载证书?跑步ssh -vvv似乎没有显示我需要的信息。两者ssh-keyscan似乎都不知道证书。也许是我没有仔细研究过的一些图书馆?

最坏的情况我总是可以编写一个在本地运行的监控插件并解析ssh-keygen -L -f. 尽管如此,远程扫描确实感觉是更可取的方法。

monitoring ssh

7
推荐指数
1
解决办法
4135
查看次数

缺少 SNMP 服务安全选项卡 - Windows Server 2012 R2 - DC

我必须为 Windows 服务器上的 SNMP 服务配置安全设置。但是他们不见了!

以下是事实:

  • 操作系统:Windows Server 2012 R2

  • 我安装了 SNMP 功能,我相信我已经配置了服务(但我忘记在Security选项卡下添加另一个 IP )

  • 我知道在安装该功能后必须重新启动 SNMP 服务才能看到Security选项卡的问题(所以我已经重新启动了一些。)

  • 我的同事现在安装了 DC 服务器角色。

  • 现在我看不到Security选项卡了(我不知道它是否与 DC 角色的安装有关)。

  • 出于监控原因,我真的需要SNMP。(所以请不要建议使用WMI或其他东西)

  • 单击“SNMP-Service”-->“属性”时,我使用了域管理员

我该怎么做才能Security再次看到该标签?或者是否有可能通过 CMD 或 PowerShell 配置 SNMP 服务?

monitoring domain-controller snmp system-monitoring windows-server-2012-r2

7
推荐指数
2
解决办法
5万
查看次数

Monit:如何以最佳方式监控 URL

我的网络服务器使用 php5-fpm 运行 nginx。如果出现一些问题,通常是php5-fpm挂了,导致“bad gateway”服务器错误。当然,我永远不知道 nginx 是否会在某一天崩溃。

当发生某些事情时,这两个进程(广告它们的线程)通常都存在并且需要重新启动。我对当前问题的原因不太感兴趣,但想重新启动两个进程。为此,我创建了两个 bash 脚本 /etc/monit/webserver.start.sh 和 /etc/monit/webserver.stop.sh。

这是我的 monit 配置文件(在 conf.d 中):

check process webserver with pidfile /var/run/nginx.pid
   start program = "/etc/monit/webserver.start.sh"
   stop program  = "/etc/monit/webserver.stop.sh"
   if failed (url https://www.myserver.com/example/ and content == 'test string' and timeout 20 seconds)
     then alert
   if failed (url https://www.myserver.com/example/ and content == 'test string' and timeout 20 seconds)
     for 2 cycles
     then restart
   if failed (url https://www.myserver.com/example/ and content == 'test string' and timeout 20 seconds)
     for 4 …
Run Code Online (Sandbox Code Playgroud)

monitoring web-server monit

7
推荐指数
1
解决办法
1万
查看次数

监控 HP ProLiant DL380 G7 没有膨胀

我从eBay 上购买了翻新的HP Proliant DL380 G7。我运行CentOS,我想知道驱动器何时出现故障。一位朋友告诉我,前面的灯可能不会亮,因为我没有在服务器上安装 HP 软件 - 我必须通过一些实用程序找出驱动器状态。

我在网上看到过 HP 的实用程序,但它们看起来非常庞大和笨重,甚至具有侵入性。我只想知道我的驱动器状态。我不想注册 HP 帐户。我不想每周都收到 HP 的电子邮件。我不想安装千兆字节的软件只是为了查看我的驱动器是否正在运行。

这是可能的,还是我任由惠普摆布?

linux monitoring hp hp-proliant

7
推荐指数
3
解决办法
4297
查看次数