我开始使用 Munin 进行监控,但我想更改由插件绘制的图形的颜色loggrep。
有没有办法在配置文件中指定颜色?
我想获得有关由我的服务器(运行 Debian)上的特定进程(或进程组或 cgroup)引起的 CPU 使用率、RAM 使用率、磁盘使用率百分比的图表。
该工具必须是 FOSS,如果有 Debian 软件包,那就更好了。
该工具确实不是需要做的意义监控“如果资源X是发送电子邮件> 75%”,只是提供了图形是配不上我。
我想检查我的 nagios 监控是否每个节点都使用 puppetmaster 提供的当前目录版本。
在我的情况下,有:
我想在 host1、host2、hostX 上创建nrpe插件以:
问题:
所以我的问题是,如何监控傀儡代理的健康状况,并在任何主机使用旧的傀儡目录时得到通知?有什么意义吗?
在我的 DL380 G6 上的 ILO2 固件 2.15 中,Temp 30 传感器(位置:I/O 板区域)指示 65C,我的风扇以 78% 的容量运行。该区域的注意级别为 110C,临界级别为 115C。
有谁知道 Temp 30 传感器在哪里?还有其他 8 个传感器指向“I/O 板区域”位置。
谢谢,
亚历山大
是否有一个应用程序可以将所有邮件处理步骤从连接到交付链接在一起,以实时显示整个过程和决策?
我知道可以使用 tail -f /var/log/mail.log,但是当出现大量连接和内部步骤(客户端授权、收件人授权、中继、退回等)时,此日志可能会变得非常耗时-消耗和容易遗漏步骤。
我想的东西有点像“顶部”,但对于电子邮件。
例如
然后可以在类似顶部的显示中显示:
CONNECT FROM TO POLICY DELIVERY RESULT
example.com [1.2.3.4] me@example.com you@example.com OK Maildir 2.5.0 OK
spam.com [1.2.4.5] bad@spam.com you@example.com SBL Fail Reject 5.7.1 Deny
1.2.4.6 NO_FQDN Reject 4.7.1 Retry
Run Code Online (Sandbox Code Playgroud)
(请原谅过于简单化)
此外,这可用于构建/存储有关邮件接受/拒绝的统计信息,进而可用于发现意外的错误配置。有没有人见过这样的事情?
我之前的工作(主要是 Nagios)对服务器监控产品有一点经验,但从来没有机会从头开始设置监控方案。每次都有许多需要监控的机器,运行 Nagios 守护程序(我认为这有一个奇特的名字,但此时我没有记忆),以及运行 Nagios 的专用机器。
现在我是个体经营者,大多数时候,我发现自己为我的客户(存储、邮件、WLAN 控制器等)设置了一个服务器。
是否有某种轻量级的监控解决方案可以在它应该监控的同一台机器上运行?我很清楚 Nagios(以及其他商业和开源监控应用程序)能够做到这一点,但我反对的理由是 - 一个 - 它是矫枉过正(更不用说滥用系统资源)和 - 二 -这样做的坏习惯。
请随时提出任何解决方案,当然,如果我对某些事情有错误,请教育我。请注意,我对可能需要我进行一定程度“黑客攻击”的想法持开放态度。我没有明确设置部署预构建的应用程序,任何解决方案都可以并且可以考虑。
编辑:对此有一个要求。我需要它能够以自定义方式响应事件(分配脚本作为对触发器的响应就可以)。
我刚刚安装了 sensu(使用 debian“omnibus”软件包),但找不到任何更改日志级别的方法。
有没有办法在客户端和服务器上做到这一点?
我有一台驻留在隔离网络上的 OpenVPN 服务器机器,公司防火墙中的 NAT 规则将端口 1194 (tcp) 上的所有流量从我选择的公共 IP 重定向到 OpenVPN 服务器机器的内部地址。我想创建一个 Nagios 检查来监控 OpenVPN 服务器的可用性。考虑到检查将从世界(Nagios 服务器)而不是从公司内部运行,监视它的最佳方法是什么?
我有三个 DNS 服务,每个服务都在 Nagios 中配置的不同主机上。每项服务在出现故障时都会通知我(主机 A 上的 DNS 故障)。
是否可以配置 Nagios,以便当所有三个 DNS 服务都通过寻呼机关闭(DNS 不工作)和邮件时我只收到(自定义)通知,以防只有一个服务关闭(主机 A 上的 DNS 关闭) )。
我看到如何实现这样的事情的唯一方法是使用服务依赖项,这些依赖项使用起来很麻烦。他们也没有自己的通知。
你会怎么做?
我一直在照看一些 Debian 机器,偶尔我会看到网络流量出现大幅飙升。我正在用石墨绘制指标(由每分钟收集每个接口指标的 sensu 检查提供),偶尔会看到这样的事情:

我不知道是什么导致了这种情况,因为在它进行时我从来没有设法抓住它。找出导致这种情况的原因会很好,那么尝试找出这可能是什么的最佳方法是什么?
我想我真正想要的是:如果发送/接收的数据量超过一定数量或速率,是否有办法审核网络连接(和进程 ID/名称)?