我在 Dell PowerEdge R200 上运行 CentOS 5。我专门安装了 OpenManage Server Administrator 来监控机器中的 HDD (x2 250GB RAID1) 并在出现任何问题或故障时发出警报。
我还安装了 SAS 5/iR / 6/iR 设备驱动程序,因为机器有 SATA2 HDD,是 R200。
但是,我无法在 OMSA Web 界面中显示存储设备。我在其他任何地方都找不到答案,所以我想知道你们中是否有人遇到过同样的问题。
先感谢您,
轻弹。
::更新::
按照 David 的建议重新启动所有服务后,会发生以下情况:
[root@xx ~]# for i in dsm_om_shrsvc instsvcdrv dataeng dsm_om_connsvc ; do service $i stop ; done
Shutting down DSM SA Shared Services: [ OK ]
Stopping Systems Management Data Engine:
Stopping dsm_sa_snmp32d: [ OK ]
Stopping dsm_sa_eventmgr32d: [ OK ]
Stopping dsm_sa_datamgr32d: [ OK ] …Run Code Online (Sandbox Code Playgroud) 有没有办法强制我的戴尔 BMC 和 iDrac 卡只使用 lanplus 接口而不使用不安全的“lan”接口。我知道 IPMI 规范中有一些“防火墙”功能。限制机箱等之间的某些功能,但我不知道它是否可以以这种方式使用。
更新:我所有的盒子都在一个交换环境中。我的服务器或我的工作桌面之间没有进行 NAT。我正在使用 ipmitool -I lanplus -H myhost -u root -p password -K sol activate" 通过 IPMI 与串行控制台对话。
更新 2:当我处于切换环境中时,我无法控制切换。如果我不能在主机或 iDRAC 本身上做到这一点,那么它就无法启动。
我有各种戴尔服务器(所有 2950 年代),我想放入一些 SSD。我已经通过电话与戴尔通话并询问 2950 年代 128GB SSD 的报价,他们告诉我他们不为这台服务器出售它们。
这些都含有 Perc 6/i。我可以购买任何我喜欢的带有 SATA II 连接的 SSD 并进行连接吗?或者它们会被“阻止”,还是因为它们没有戴尔固件而无法按预期工作?
我之前在 Perc 5/i 卡上使用非戴尔品牌的 HDD 遇到过(次要)问题。它们确实工作得很好(我采购了与失败的原装戴尔驱动器完全相同的品牌和型号驱动器,并从第三方供应商那里购买了它们),但是在启动时服务器总是会显示有关硬盘驱动器兼容性的警告(我假设只是被 RAID 控制器传递给操作系统来吓唬我?)。
戴尔的英语专业学生向我提供了 PowerEdge 2950 提供的此错误消息。
CPU2 状态:CPU2 的处理器传感器,IERR无效
我用谷歌搜索过,随机的论坛帖子没有给我一个明确的答案。
这显然也不是一个词:http : //dictionary.reference.com/browse/deassert? s= t
我能猜到意思。断言:
用保证、信心或力量陈述
好的。所以否定的。缺乏信心的状态?此错误消息试图告诉我什么?内存错误与此归为一组:是否试图说应该设置IERRCPU2 ,但不是?当前系统状态是 SNAFU 但 CPU2 认为一切正常?
我正在尝试完全锁定必须存在于防火墙之外/直接路由到 Internet 的服务器,虽然我已尽我所能强化基本操作系统,但当我想到如果最坏的情况应该发生并且有人能够获得访问权限,DRAC 可能会被用作我们管理网络的后门。
据我所知,不可能只连接和运行任意命令,你需要一个用户名和密码 - 但是,如果给予无限时间和 root 访问权限,我想可能会使用蛮力,所以,我想知道我将如何保护 DRAC?
除了最后一个崩溃屏幕功能之外,我真的想不出本地主机甚至需要访问 DRAC 的任何原因,因此,我想完全禁用本地访问。
从 drac 运行以下内容是否足够:
racadm config -g cfgRacTune -o cfgRacTuneLocalConfigDisable 1
Run Code Online (Sandbox Code Playgroud)
通过运行这个,有什么缺点吗?
我只能找到旧 iDrac 5 的小指南,但是,我想知道此后是否有任何更改/添加?
这是一个带有专用网络端口的专用 Drac(附加)卡,管理网络是一个完全不同的子网/网络。
当通过 SSH 登录到 Drac 时,我注意到你可以做一些时髦的事情,我只是想确保如果这个盒子曾经被 root/黑客入侵过,它是不可能登录到 DRAC(即使给予无限来自主机的时间/蛮力)并基本上确保它是完全 100% 隔离的。
我们使用 Nagios 进行监控。有没有办法使用 SNMP MIB 为运行 ESXi5.x 的 R820 服务器创建硬件检查?现在我们正在使用这个python插件:
但是由于组织内的安全策略,我们不能再使用它。我们对当前插件的输出感到满意,因此如果我们可以使用类似的代理使用 SNMP 进行更少的检查,那就太好了。谢谢
我们有许多戴尔 PowerEdge 服务器,第九代及更高版本。
根据在第九代 Dell PowerEdge 服务器中使用 LAN 和串行接口:
作为对前几代 Dell PowerEdge 服务器的增强,共享 NIC 模式支持通过任一 LOM 连接到 BMC,而不仅仅是一个 LOM。
我们对此有点担心,因为在我们的几台服务器上,LOM1 连接到专用管理网络,而 LOM2 连接到 LAN,我们不希望从 LAN 访问 DRAC。
在令人费解的是,实验,它似乎并不为真。(详情如下。)在共享模式下配置 DRAC 时,DRAC 只能从 LOM1 访问,不能从 LOM2 访问。
文章错了吗?如果没有,我如何让 DRAC 在 LOM2 上做出响应?(不使用故障转移模式,根据文章需要组合,即两个 LOM 必须在同一网络上。)
最重要的是,如果有的话,我需要做什么来确保我们的所有 DRAC 都不能通过 LOM2 访问?
测试程序
我正在试验的机器是带有 DRAC 5、硬件版本 A00、固件版本 1.60 (11.03.03) 的 PowerEdge 2970。BMC 固件版本为 2.50。
NIC Selection 设置为 Shared 并启用 NIC。
静态 IP 地址为 192.168.241.100,子网掩码为 255.255.255.0。我们的管理网络上没有网关,所以我将其设置为 0.0.0.0。自动协商已开启。没有配置任何其他设置。
将管理网络连接到 LOM1(并将 LAN …
我们进行需要大量使用 LLDP 的特殊硬件配置。我们有一些新的服务器机架,它们都使用 Intel X710 10Gb 网卡。LLDP 突然停止工作。我们的 LLDP 实现很简单。使用默认 TLV 在 TOR(架顶)交换机上启用 LLDP。使用 lldpad (CentOS 6.5) 在 Linux 映像上启用 LLDP,并使用 lldptool 提取邻居信息,这在过去已用于数千台机器。只是,对于这些带有这些 NIC 的机器,整个事情就停止了。
使用来自交换机和服务器的数据包转储显示帧从服务器正确发送到交换机,相反,交换机正确接收来自服务器的帧并将 TLV 帧发送回服务器。然而,服务器没有接收到交换帧 TLV,这让我们摸不着头脑。我们将使用不同 NIC 的其他机器放置在 TOR 上,它们按预期获得 LLDP 数据。
我问过谷歌...
根据此链接,这些 X710 似乎正在运行内部 LLDP 代理,该代理正在拦截来自交换机的 LLDP 帧。我们看到的受影响机器上的固件是:
# ethtool -i eth2
driver: i40e
version: 1.3.47
firmware-version: 4.53 0x80001e5d 17.0.10
bus-info: 0000:01:00.2
supports-statistics: yes
supports-test: yes
supports-eeprom-access: yes
supports-register-dump: yes
supports-priv-flags: yes
Run Code Online (Sandbox Code Playgroud)
在 NIC 上禁用内部 LLDP 代理的方法不起作用。尽管如此,我仍在四处寻找,但我想我有几个选择:
我有一个戴尔 R320,它在 RAID1 阵列中有两个物理驱动器。RAID 控制器是 PERC H310 Mini。
在日常维护期间,我发现其中一个显示为故障。我不得不重新启动服务器,现在以前的故障显示为外来的(但没有故障)。
不管怎样,我都会更换驱动器,但我不确定在物理更换出现故障的驱动器后该怎么做。
当我创建 RAID 阵列时,我是通过 RAID 实用程序作为启动 (BIOS) 序列的一部分来完成的。
我现在可以通过 OMSA 重建阵列吗?如果是,执行此操作的过程是什么?显然,我担心执行此任务时会丢失数据。
更换到位后,我可以热插拔有故障的“外来”磁盘吗?或者我是否需要关闭服务器电源并离线更换,然后重新启动?
当前在“虚拟磁盘”下,C 驱动器(使用 RAID 阵列)因此显示为“降级”(正常)。
我在任何地方都没有看到任何“重建阵列”选项,这本来是我的第一个选项,尽管这可能是因为我尚未更换驱动器并且系统认为它有问题?
鉴于上述信息,希望任何帮助我成功重建数组的指针。
谢谢。
更新:
在“外部配置”下,我发现了这个:
PERC H310 Mini:导入/恢复外部配置
说明:导入/恢复外部配置任务导入外部虚拟磁盘并尝试恢复处于故障或降级状态的虚拟磁盘。某些情况(例如不兼容的 RAID 级别或不完整的磁盘组)可能会阻止导入或恢复外部虚拟磁盘。导入操作会导入所有外部虚拟磁盘,以便它们可以由 Storage Management 进行管理。当虚拟磁盘驻留在从另一个控制器移出的物理磁盘上时,它就是外部磁盘。恢复操作尝试将降级、失败或丢失的虚拟磁盘恢复到正常状态。由于断电、电缆连接错误或其他故障而失去与控制器的通信后,虚拟磁盘可能处于降级、故障或丢失状态。恢复操作完成后,重建或后台初始化可能会自动启动。恢复后虚拟磁盘数据可能不一致。在导入/恢复外部配置任务完成后,您应该始终验证虚拟磁盘数据。你确定你要继续吗?
这是我应该做的吗?
我在戴尔服务器的 raid10 阵列中有 4 个磁盘。现在有 2 个驱动器出现故障。故障驱动器不在同一组(1+2 和 3+4),故障驱动器为 2 和 3。服务器仍在运行,但阵列已降级。我正在等待新驱动器的到来。
更换驱动器的最佳方法是什么?我可以同时更换两个磁盘吗?或者最好先重建第一组,然后再更换另一组?