使用 Active Directory,监控复制的好方法是什么?
我有多个站点和多个位置,因此理想情况下,站点之间和站点内的复制都会受到监控。我不确定是否需要监视每个 DC、每个 NTDS 连接或每个 DC *每个 NTDS 连接。
为了适应标准的警报方法,如果复制延迟 X 分钟,性能计数器将允许我发出警报,这似乎是理想的。
我们在其中一台服务器上安装了 munin 监控。一般来说,它似乎运行良好,但有时,准确地说是 2 个月内 4 次,munin-cron 会产生以下错误:
[致命] 这里没有什么可做的,因为没有带有任何插件的节点。请参阅http://munin-monitoring.org/wiki/FAQ_no_graphs在 /usr/share/munin/munin-html 第 38 行
在搜索此错误时,我只能找到 munin 根本无法工作的问题,而不是我们面临的间歇性问题。
一些帮助防止此错误或如何调试它将不胜感激。
我们正在运行 CentOS 5.5,使用 yum 安装的 Munin 1.4.5。
我知道 Nagios 可以监控日志文件中的内容并发出警报,但是有谁知道插件或其他工具可以监控特定字符串的日志文件,然后在电子邮件中发送整行那场比赛发生了?
我正在我的 64 位 Web 服务器上执行监控任务,该服务器有几个以 32 位模式运行的应用程序池。我在 perfmon 中使用 .Net CLR Memory 对象来监视它们。但是,我的性能监视器显示 0,除了 GC 句柄和正在使用的接收器块数之外的所有内容。其余的应用程序池工作正常。在以完全相同的方式配置的另一台服务器(在 64 位 IIS 上运行的 32 位应用程序池)上,WMI 甚至不会枚举我的所有 w3wp 实例。
有没有人对这些问题有任何想法?或者是否有工具可以监控在 64 位平台上运行的 32 位应用程序池,而不是使用内置的性能监控器?
另外,在 WMI 没有枚举所有 w3wp 实例的服务器上,我们在事件日志中有以下三个错误消息。
“ASP”服务的性能库“C:\WINDOWS\system32\aspperf.dll”的配置信息与存储在注册表中的可信性能库信息不匹配。该库中的函数不会被视为受信任的。(事件 ID 2003,源 Perflib)
“W3SVC”服务的性能库“C:\WINDOWS\system32\inetsrv\w3ctrs.dll”的配置信息与存储在注册表中的可信性能库信息不匹配。此库中的函数不会被视为受信任的。(事件 ID 2003,源 Perflib)
“InetInfo”服务的性能库“C:\WINDOWS\system32\infoctrs.dll”的配置信息与存储在注册表中的可信性能库信息不匹配。此库中的函数不会被视为受信任的。(事件 ID 2003,源 Perflib)
由于“ASP.NET_2.0.50727”服务的性能计数器库为该服务生成了一个或多个错误,因此该会话已禁用该服务的性能计数器数据收集。强制执行此操作的错误已写入应用程序事件日志。(事件 ID 1018,源 Perflib)
这些错误可能与我的问题有关。即使我在 wbem 目录中重新注册所有 .dll 文件,它仍然出现。有谁知道这些错误消息的含义以及如何修复它们?
另外对于.Net CLR Memory 对象中第一个值为0 的服务器,事件日志中没有错误消息。
iis windows-server-2003 monitoring performance-monitoring wmi
我正在 AWS ec2 上运行一个 ubuntu gpu 实例。我不确定我的应用程序是否使用 GPU 加速。那么如何检查 aws gpu 实例上的 gpu 使用情况?
可能的重复:
您使用什么工具来监控您的服务器?
我正在寻找一些东西来监控 Intranet 应用程序和内部 Web 服务,并在系统变得不可用时提供历史响应时间、正常运行时间、警报的日志......
简而言之,我正在寻找与 Pingdom 几乎相同的东西,但它可以在内部监控服务器上运行,这样我们就不必向外界公开我们的内部网页面和 API 端点。
开源、商业、免费——其实并不重要。只是想知道那里有什么!
所以我的设置:
服务在所有主机(CPU/RAM/磁盘/服务)之间共享。
主机分为两个主要组:“生产”和“开发”。
我们有两个联系小组:“生产”和“开发”。
假设我的开发 SQL 服务器在 RAM 上运行不足,我希望它只提醒“开发”联系人组中的人(此服务当然分配给“开发”主机组中的主机,使用共享 RAM 监视服务)。
我对此感到非常困惑......我无法在服务级别配置它(它们在那里共享),而且我似乎也无法升级为我做这件事......
我是否需要将服务组与升级一起使用并在构建该列表时咬紧牙关?还是我错过了一些非常简单的东西?
如果有帮助,我正在使用 Centreon 进行配置。
我正在尝试在 docker 容器中运行应用程序构建并收集资源使用统计信息。
我可以通过以下检查收集使用指标,例如在 Ubuntu 14.04 主机上运行 docker 的 id 为 foobar 的容器的内存使用详细信息:
/sys/fs/cgroups/memory/docker/foobar/memory.stat
但是在 Centos 7 主机上,缺少“/sys/fs/cgroups/memory/docker”目录。
如何在 Centos 7 主机上了解容器特定的内存或 CPU 使用情况。谢谢
我想在我的 Windows 服务器上设置对系统资源的监控。我注意到 Linux 中的一个常见配置是使用 collectd 守护程序来获取系统指标信息。从收集到的数据可以通过logstash 读取,最终放入Elastic Search 中用Kibana 查看。
这很好,并且在 Linux 世界中运行良好。但是我坚持使用 Windows 服务器,我需要一些关于最佳工具的建议来实现类似的工作流程。作为一个侧节点,我已经在使用 Nxlog 将 IIS 日志发送到 logstash。
我很难在 Nagios 中为通配符和正则表达式(尤其是当它们与排除一起工作时)找到好的文档。这是我正在尝试做的一个例子:
在 中nagios.cfg,设置了以下内容,假设启用*并?作为通配符:
use_regexp_matching=1
use_true_regexp_matching=0
Run Code Online (Sandbox Code Playgroud)
在 中services.cfg,我们有一项服务,我们希望将其应用于除少数对象之外的所有对象;那是所有 Linux 主机,但不是负载平衡器。显式排除工作:
define service {
use generic-service
service_description Puppet check
hostgroup_name prod, staging, !prod-site_a-lbs
check_command check_puppet_alive_nrpe
}
Run Code Online (Sandbox Code Playgroud)
但是,我们有很多站点,每个站点在自己的主机组中都有负载均衡器(因此站点可以轻松管理通知)。而不是有一长串!prod-site_a-lbs, !staging-site_a-lbs, !prod-site_b-lbs。我希望能够将该hostgroup_name行修改为:
hostgroup_name prod, staging, !*-lbs
Run Code Online (Sandbox Code Playgroud)
我已经尝试过了,虽然我们没有收到错误消息,但此服务检查仍在应用于我们的负载平衡器。为了仔细检查,我也试过:
hostgroup_name prod, staging, !.*-lbs
Run Code Online (Sandbox Code Playgroud)
但是,这use_true_regexp_matching在运行时失败了,正如预期的那样(因为未设置)checkconfig-noprecache:
Error: Could not find any hostgroup matching '!.*lbs' ...
Run Code Online (Sandbox Code Playgroud)
在测试中,.*被接受的checkconfig-noprecacheif!被删除。
我们正在尝试的可能吗?我们可以使用通配符来排除匹配的主机组吗?或者,有没有一种替代方法同样干净?
更新(2015-09-21):在测试 Keith 的回答后,此配置有效:
在services.cfg …