我是一名拥有大约 100 个客户的顾问,我很想监控我所有的客户网络,最好是从云中监控,这样我就可以判断他们的互联网是否已关闭。我希望它提供许多与发送警报相同的监视功能(类似于 Microsoft 的 SBS 产品)。外面有什么?在这方面,谁是事实上的标准?我只需要一些选项,这样我就可以知道我客户网站上发生了什么!
我有大约 70 台服务器,我需要密切关注它们的磁盘空间使用情况。我不需要信息是实时的。我正在考虑每天运行一个脚本或运行计划任务来收集磁盘信息并将其保存到文本文件或其他东西。
什么是最好的方法来做到这一点?如何?
如果我想监控一些我不是主要维护者的机器(即,我无权访问安装包),是否有像 Nagios 这样的轻量级替代品?我正在寻找一个脚本(bash、Perl、PHP 等),它可以对 Linux 服务器和服务(磁盘空间、Web 服务器、可能是 CPU 使用率等)进行基本监控,并在必要时发送警报。
我最近开始研究网络监控解决方案。我已经在我们的 cisco 催化剂上配置了 SPAN,它工作正常,但我也一直在阅读水龙头。我看过的大多数文章都将参考成本视为主要缺点。除非我对这项技术有什么遗漏,否则它似乎可以用一台商用 PC 和三个 NIC(输入、输出和监视器端口)来实现。这样的事情是否存在,或者我离题了?
我怎样才能让 monit 继续每隔一段时间提醒我,直到问题得到解决?这是一个示例配置:
使用路径 /dev/sda1 检查文件系统数据文件 如果空间使用率在 15 个周期内连续 5 次 > 80%,则发出警报
在这里,我会收到一次警报,然后不会再收到。我希望 monit 在问题解决之前不要关闭。
我看到了很多监控工具,并且大多显示相同的东西。但我想知道是否真的有必要观看所有这些东西。
我想知道哪些指标真正重要,例如主要运行网站的 Web 服务器,使用 PHP-FPM、Nginx 和 MySQL。
而且,我正在研究图形,但是如何理解它们并分析它们以防止将来出现任何故障?
(我在 Stack Overflow 上问了这个问题,他们把我送到了这里。很抱歉这个非常基本的问题,但我有纯粹的编码经验 - 根本没有服务器管理的东西 - 这让我不知所措,至少可以说......)
我只是无法理解这些产品之间的差异。我从未使用过它们中的任何一个 - 我正在撰写一篇引用所有三个的技术文章。
我目前的理解是,Windows/MS System Center 和 HP Operations Manager 是不同公司对同一需求的回应:系统管理、监视器和日志的收集等。这是正确的理解吗?
至于 SCOM,一些消息来源似乎认为它是 Windows System Center 的另一个名称,而其他消息来源似乎说它是一个 UI 和通知类型的插件?!
非常感谢您提供任何帮助。所有这些名字都如此相似,我读得越多,我就越困惑……
我的 monit 脚本用于检测进程中断并在规则为时通知我:
IF DOES NOT EXIST THEN ALERT
Run Code Online (Sandbox Code Playgroud)
我的 monit 脚本用于检测中断并在规则为时自动修复它:
IF DOES NOT EXIST THEN START
Run Code Online (Sandbox Code Playgroud)
但是,我想要它做的是通知我并修复它。
连续两条规则似乎使它忽略了除最后一条之外的所有规则:
IF DOES NOT EXIST THEN ALERT
IF DOES NOT EXIST THEN START
# No alert given.
Run Code Online (Sandbox Code Playgroud)
我可以使用一个自定义脚本来做这两个,并且
IF DOES NOT EXIST THEN EXEC "my_handwritten_script"
Run Code Online (Sandbox Code Playgroud)
但我试图从一堆手写脚本转向干净的 Monit 配置。
我可以将 Monit 配置为采取两项行动吗?
我将我的一个 freebsd 盒子更新为 9-stable(全新安装)并安装 net-snmp 进行监控。
uname -r
9.1-PRERELEASE
pkg_info net-snmp-5.7.1_7
Information for net-snmp-5.7.1_7:
Comment:
An extendable SNMP implementation
....
cat /var/db/ports/net-snmp/options
# This file is auto-generated by 'make config'.
# Options for net-snmp-5.7.1_7
_OPTIONS_READ=net-snmp-5.7.1_7
_FILE_COMPLETE_OPTIONS_LIST= IPV6 MFD_REWRITES PERL PERL_EMBEDDED PYTHON DUMMY TKMIB DMALLOC MYSQL AX_SOCKONLY UNPRIVILEGED
OPTIONS_FILE_UNSET+=IPV6
OPTIONS_FILE_UNSET+=MFD_REWRITES
OPTIONS_FILE_SET+=PERL
OPTIONS_FILE_SET+=PERL_EMBEDDED
OPTIONS_FILE_UNSET+=PYTHON
OPTIONS_FILE_SET+=DUMMY
OPTIONS_FILE_UNSET+=TKMIB
OPTIONS_FILE_SET+=DMALLOC
OPTIONS_FILE_UNSET+=MYSQL
OPTIONS_FILE_UNSET+=AX_SOCKONLY
OPTIONS_FILE_UNSET+=UNPRIVILEGED
Run Code Online (Sandbox Code Playgroud)
我在这台机器上有大约 500 个 vlan,并通过 snmpd 收集有关接口的信息到 2 个不同的软件,zabbix 和 cacti。
他们都用空白字段绘制图形。

我尝试将 zabbix 中的轮询时间从 15 秒更改为 30、60、90、120、10。无论如何,我有空白字段。
snmpd.conf 是空的——只有一个访问控制。
此配置在 freebsd 8 …
我们正在建立我们的办公网络,并希望跟踪我们员工访问过的所有网站。但是,我们不想使用任何基于代理的解决方案。
我们的工作高度依赖于您无法配置代理的应用程序。因此,我们想要遵循的方法是在计算机内设置路由器(类似于:http : //www.techrepublic.com/article/configure-windows-server-2003-to-act-as-a-路由器/5844624)
这也将允许我们连接多个以太网卡,并在互联网连接中具有冗余,并从用户那里完全抽象出正在使用的连接。
但最重要的是,由于所有流量都将通过计算机(配置为路由器),我假设将有一种方法可以对所有请求/响应运行数据包分析。例如,列出连接到(端口 21)的所有 FTP 服务器,按频率给出每天访问的所有 URL 的图表。
是否已经有一个软件可以做到这一点?或者是否有可能构建这样的东西?