标签: monitoring

监控 Linux 上的物理 RAM 错误

我想监控两个 linux 系统(Ubuntu 和 Red Hat)的内存。我意识到我可以从启动运行 memtest86 来诊断坏内存。但是是否有任何解决方案可以在系统仍在运行时监控 ram。我在想一个守护进程,它可以从随机未使用的内存中写入和读取。以前有人见过这样的吗?

linux monitoring memory

3
推荐指数
1
解决办法
2571
查看次数

监控两个站点之间的带宽/延迟/抖动?

我有 2 个站点通过 MPLS 网络连接,我想执行以下操作:

  • 在每一端设置一个主机,它可以在彼此之间来回“交谈”,并以某种方式报告/记录他们在 5 分钟间隔内经历的吞吐量、抖动、延迟等类型。

类似于 Qcheck 的东西,但可以自动化。

最重要的是,我正在尝试确定 WAN 网络是否全天“稳定”,或者是否有问题。我们在这些站点之间进行视频会议,即使在 1024kbps 的通话中,我们也会遇到延迟和抖动。我希望通过一些测试来免除网络的责任。

networking monitoring

3
推荐指数
1
解决办法
2576
查看次数

保持 htop 运行的坏主意?

我现在正在监控多台服务器 (3),并且在接下来的几周内会增加(接近 5 或 6)。我一直在通过 SSH 打开运行 htop 的三个终端窗口,现在我想知道不断打开与生产服务器的连接是否有任何缺点?

monitoring performance-monitoring

3
推荐指数
1
解决办法
1516
查看次数

有人知道适用于 Windows 的免费洪水 ping 实用程序吗?

有谁知道适用于 Windows 的免费 ping flood(有些人称之为 flood ping)实用程序?我想要一些可以安装在任何地方的便携设备。我使用 ping 泛洪主要测试数据包丢失和抖动,并发现 Windows 上的本机工具相当令人沮丧,有时它们是唯一可用于测试端到端连接的工具。

networking windows monitoring tcpip ping

3
推荐指数
1
解决办法
2万
查看次数

通过 VPN 的 Jconsole

我正在尝试使用 jconsole 监视远程 jvm。我需要通过 OpenVPN 网络进行这种监控,这可能是我的问题的一部分。这是网络配置:

 Server A         Server B         Server C
 Jconsole                             JVM
10.171.0.1 <---> 10.170.0.1 <---> 10.170.0.14
Run Code Online (Sandbox Code Playgroud)

当所有服务器都在不同的物理网络上时,它不起作用。当Server AServer C在同一个物理网络中时,它可以工作。在这两种情况下,traceroute 都是在网络配置中描述的,看起来像这样:

traceroute to 10.170.0.14 (10.170.0.14), 64 hops max, 52 byte packets
 1  10.170.0.1 (10.170.0.1)  114.440 ms  109.152 ms  109.581 ms
 2  10.170.0.14 (10.170.0.14)  234.207 ms  228.535 ms  229.630 ms
Run Code Online (Sandbox Code Playgroud)

关于如何解决这个问题的任何想法?

[编辑]

所有系统都是linux。

Jmx 远程参数为:

-Dcom.sun.management.jmxremote.port=8086 
-Dcom.sun.management.jmxremote.ssl=false 
-Dcom.sun.management.jmxremote.authenticate=false
Run Code Online (Sandbox Code Playgroud)

服务器Server B (10.170.0.1)用作两个网络之间的桥梁和防火墙。防火墙10.170.0.1如下:

*filter
:INPUT DROP [1000:900000]
:FORWARD DROP [0:0]
:OUTPUT DROP [0:0] …
Run Code Online (Sandbox Code Playgroud)

monitoring vpn java iptables openvpn

3
推荐指数
1
解决办法
1630
查看次数

良好的企业级网络/服务器监控器

寻找一些软件来帮助监控路由器/交换机和服务器中断的网络,并在出现问题时发送电子邮件警报。如果它可以帮助显示流量模式和具有过度广播的潜在节点,那将是一个奖励。

我想了解发现重大问题的用户(即“互联网是否关闭?”)

有人喜欢 Orion 或 What's up Gold?

networking monitoring

3
推荐指数
1
解决办法
563
查看次数

Munin 的 fw_conntrack 在 TIME_WAIT 报告奇怪数量的套接字

  • Ubuntu 服务器 10.04.1 x86
  • 穆宁 1.4.4

以下是 Munin 告诉我的有关通过服务器上的防火墙进行连接的信息:

时间的等待

下面是netstat -n关于这个的内容:

$ netstat -an|awk '/tcp/ {print $6}'|sort|uniq -c
      2 CLOSE_WAIT
      1 结束
   3720 成立
     34 FIN_WAIT1
     21 FIN_WAIT2
     13 LAST_ACK
      6 听
      4 SYN_RECV
    第394话

netstat,10% 的插座在TIME_WAIT; 根据穆宁的说法,75% 或更多。

这很奇怪。谁是对的?

有关配置等的更多详细信息,请访问:How to reduce number of sockets in TIME_WAIT?

unix ubuntu monitoring munin

3
推荐指数
1
解决办法
2207
查看次数

MyTop 不显示已执行的查询

我正在尝试使用 mytop 来确定正在执行哪些查询以及它们需要多长时间。我可以正确连接到数据库,但是

MySQL on localhost (5.1.41-3ubuntu12.8)                 up 0+01:50:47 [09:30:43]
Queries: 3.0     qps:    0 Slow:     0.0         Se/In/Up/De(%):    68767/00/00/00

Key Efficiency: 99.1%  Bps in/out:   0.0/  1.2

        Id      User         Host/IP         DB      Time    Cmd Query or State
        --      ----         -------         --      ----    --- --------------
       225      root       localhost                    0  Query show full processlist
       186      joom       localhost   culinary      5684  Sleep
Run Code Online (Sandbox Code Playgroud)

查询的数量会随着时间的推移而增加,但查询本身不会出现在列表中。是否需要进行某种类型的配置才能启用它?

mysql monitoring command-line-interface

3
推荐指数
1
解决办法
4915
查看次数

使用 Zenoss 监控定制软件

我们有很多需要监控性能的后端应用程序(指标,例如等待处理的订单、自上次运行以来的时间等)。目前,这是由内部看门狗应用程序完成的,该应用程序在超过阈值时发出电子邮件,但无法确认问题并消除这些警报。

我们不想构建我们自己的完整警报系统,而是希望与我们用来监控服务器的 Zenoss 安装相关联。我找到了几篇关于以编程方式创建事件的文章,但我更愿意 Zenoss 本身监控当前看门狗应用程序正在查看的值(因此我们也能从图形和历史中获得好处)。

那么,是否有可能以编程方式向 Zenoss 提供数据馈送(而不是事件)?或者还有其他方法可以解决这个问题吗?

monitoring performance-monitoring zenoss

3
推荐指数
1
解决办法
400
查看次数

监控社交网站的使用情况并向超过每日配额的用户发送警告

是否有任何工具可以监控社交网站(Facebook、Twitter 等)的使用情况,如果特定用户过度使用他/她的每日配额,向他/她发送警告?

monitoring

3
推荐指数
2
解决办法
187
查看次数