标签: monitoring

在 Windows Server 2008 R2 中监视 Active Directory (AD) 复制

使用 Active Directory,监控复制的好方法是什么?

我有多个站点和多个位置,因此理想情况下,站点之间和站点内的复制都会受到监控。我不确定是否需要监视每个 DC、每个 NTDS 连接或每个 DC *每个 NTDS 连接。

为了适应标准的警报方法,如果复制延迟 X 分钟,性能计数器将允许我发出警报,这似乎是理想的。

monitoring active-directory windows-server-2008-r2

6
推荐指数
1
解决办法
757
查看次数

间歇性 munin-cron 错误“这里无事可做,因为没有带有任何插件的节点”

我们在其中一台服务器上安装了 munin 监控。一般来说,它似乎运行良好,但有时,准确地说是 2 个月内 4 次,munin-cron 会产生以下错误:

[致命] 这里没有什么可做的,因为没有带有任何插件的节点。请参阅http://munin-monitoring.org/wiki/FAQ_no_graphs在 /usr/share/munin/munin-html 第 38 行

在搜索此错误时,我只能找到 munin 根本无法工作的问题,而不是我们面临的间歇性问题。

一些帮助防止此错误或如何调试它将不胜感激。

我们正在运行 CentOS 5.5,使用 yum 安装的 Munin 1.4.5。

linux monitoring munin centos system-monitoring

6
推荐指数
1
解决办法
689
查看次数

使用 Nagios 监控日志文件并发送日志详细信息

我知道 Nagios 可以监控日志文件中的内容并发出警报,但是有谁知道插件或其他工具可以监控特定字符串的日志文件,然后在电子邮件中发送整行那场比赛发生了?

monitoring nagios

6
推荐指数
1
解决办法
2万
查看次数

在监控 64 位 IIS 上运行的 32 位应用程序池时遇到问题

我正在我的 64 位 Web 服务器上执行监控任务,该服务器有几个以 32 位模式运行的应用程序池。我在 perfmon 中使用 .Net CLR Memory 对象来监视它们。但是,我的性能监视器显示 0,除了 GC 句柄和正在使用的接收器块数之外的所有内容。其余的应用程序池工作正常。在以完全相同的方式配置的另一台服务器(在 64 位 IIS 上运行的 32 位应用程序池)上,WMI 甚至不会枚举我的所有 w3wp 实例。

有没有人对这些问题有任何想法?或者是否有工具可以监控在 64 位平台上运行的 32 位应用程序池,而不是使用内置的性能监控器?

另外,在 WMI 没有枚举所有 w3wp 实例的服务器上,我们在事件日志中有以下三个错误消息。

  1. “ASP”服务的性能库“C:\WINDOWS\system32\aspperf.dll”的配置信息与存储在注册表中的可信性能库信息不匹配。该库中的函数不会被视为受信任的。(事件 ID 2003,源 Perflib)

  2. “W3SVC”服务的性能库“C:\WINDOWS\system32\inetsrv\w3ctrs.dll”的配置信息与存储在注册表中的可信性能库信息不匹配。此库中的函数不会被视为受信任的。(事件 ID 2003,源 Perflib)

  3. “InetInfo”服务的性能库“C:\WINDOWS\system32\infoctrs.dll”的配置信息与存储在注册表中的可信性能库信息不匹配。此库中的函数不会被视为受信任的。(事件 ID 2003,源 Perflib)

  4. 由于“ASP.NET_2.0.50727”服务的性能计数器库为该服务生成了一个或多个错误,因此该会话已禁用该服务的性能计数器数据收集。强制执行此操作的错误已写入应用程序事件日志。(事件 ID 1018,源 Perflib)

这些错误可能与我的问题有关。即使我在 wbem 目录中重新注册所有 .dll 文件,它仍然出现。有谁知道这些错误消息的含义以及如何修复它们?

另外对于.Net CLR Memory 对象中第一个值为0 的服务器,事件日志中没有错误消息。

iis windows-server-2003 monitoring performance-monitoring wmi

6
推荐指数
1
解决办法
2999
查看次数

如何检查 aws ec2 gpu 实例上的 gpu 使用情况?

我正在 AWS ec2 上运行一个 ubuntu gpu 实例。我不确定我的应用程序是否使用 GPU 加速。那么如何检查 aws gpu 实例上的 gpu 使用情况?

monitoring amazon-ec2 cpu-usage

6
推荐指数
2
解决办法
1万
查看次数

是否有用于监控正常运行时间/响应时间的本地托管服务(类似于 Pingdom)?

可能的重复:
您使用什么工具来监控您的服务器?

我正在寻找一些东西来监控 Intranet 应用程序和内部 Web 服务,并在系统变得不可用时提供历史响应时间、正常运行时间、警报的日志......

简而言之,我正在寻找与 Pingdom 几乎相同的东西,但它可以在内部监控服务器上运行,这样我们就不必向外界公开我们的内部网页面和 API 端点。

开源、商业、免费——其实并不重要。只是想知道那里有什么!

monitoring uptime

6
推荐指数
1
解决办法
1万
查看次数

将 Nagios 配置为根据服务警报源自的主机组发出警报

所以我的设置:

  • 服务在所有主机(CPU/RAM/磁盘/服务)之间共享。

  • 主机分为两个主要组:“生产”和“开发”。

  • 我们有两个联系小组:“生产”和“开发”。

假设我的开发 SQL 服务器在 RAM 上运行不足,我希望它只提醒“开发”联系人组中的人(此服务当然分配给“开发”主机组中的主机,使用共享 RAM 监视服务)。

我对此感到非常困惑......我无法在服务级别配置它(它们在那里共享),而且我似乎也无法升级为我做这件事......

我是否需要将服务组与升级一起使用并在构建该列表时咬紧牙关?还是我错过了一些非常简单的东西?

如果有帮助,我正在使用 Centreon 进行配置。

monitoring nagios centreon

6
推荐指数
1
解决办法
6797
查看次数

在 Centos 7 上监控 Docker 容器的 cpu 和内存使用情况

我正在尝试在 docker 容器中运行应用程序构建并收集资源使用统计信息。

我可以通过以下检查收集使用指标,例如在 Ubuntu 14.04 主机上运行 docker 的 id 为 foobar 的容器的内存使用详细信息:

/sys/fs/cgroups/memory/docker/foobar/memory.stat

但是在 Centos 7 主机上,缺少“/sys/fs/cgroups/memory/docker”目录。

如何在 Centos 7 主机上了解容器特定的内存或 CPU 使用情况。谢谢

monitoring docker centos7

6
推荐指数
1
解决办法
8166
查看次数

如何将 Windows 性能计数器发送到 Logstash + Kibana?

我想在我的 Windows 服务器上设置对系统资源的监控。我注意到 Linux 中的一个常见配置是使用 collectd 守护程序来获取系统指标信息。从收集到的数据可以通过logstash 读取,最终放入Elastic Search 中用Kibana 查看。

这很好,并且在 Linux 世界中运行良好。但是我坚持使用 Windows 服务器,我需要一些关于最佳工具的建议来实现类似的工作流程。作为一个侧节点,我已经在使用 Nxlog 将 IIS 日志发送到 logstash。

windows monitoring performance-counters logstash

6
推荐指数
1
解决办法
1万
查看次数

Nagios hostgroup_name 排除项中的通配符

我很难在 Nagios 中为通配符和正则表达式(尤其是当它们与排除一起工作时)找到好的文档。这是我正在尝试做的一个例子:

在 中nagios.cfg,设置了以下内容,假设启用*?作为通配符:

use_regexp_matching=1
use_true_regexp_matching=0
Run Code Online (Sandbox Code Playgroud)

在 中services.cfg,我们有一项服务,我们希望将其应用于除少数对象之外的所有对象;那是所有 Linux 主机,但不是负载平衡器。显式排除工作:

define service {
     use                  generic-service
     service_description  Puppet check
     hostgroup_name       prod, staging, !prod-site_a-lbs
     check_command        check_puppet_alive_nrpe
}
Run Code Online (Sandbox Code Playgroud)

但是,我们有很多站点,每个站点在自己的主机组中都有负载均衡器(因此站点可以轻松管理通知)。而不是有一长串!prod-site_a-lbs, !staging-site_a-lbs, !prod-site_b-lbs。我希望能够将该hostgroup_name行修改为:

     hostgroup_name       prod, staging, !*-lbs
Run Code Online (Sandbox Code Playgroud)

我已经尝试过了,虽然我们没有收到错误消息,但此服务检查仍在应用于我们的负载平衡器。为了仔细检查,我也试过:

     hostgroup_name        prod, staging, !.*-lbs
Run Code Online (Sandbox Code Playgroud)

但是,这use_true_regexp_matching在运行时失败了,正如预期的那样(因为未设置)checkconfig-noprecache

 Error: Could not find any hostgroup matching '!.*lbs' ...
Run Code Online (Sandbox Code Playgroud)

在测试中,.*被接受的checkconfig-noprecacheif!被删除。

我们正在尝试的可能吗?我们可以使用通配符来排除匹配的主机组吗?或者,有没有一种替代方法同样干净?


更新(2015-09-21):在测试 Keith 的回答后,此配置有效:

services.cfg …

monitoring nagios

6
推荐指数
1
解决办法
2464
查看次数