从过去几天开始,我不断收到这条烦人的消息。谁能告诉我这是什么意思,我应该怎么做才能解决这个问题?我正在使用 Opensuse 12.1
Message from syslogd@linux-hse7 at Jul 24 18:38:57 ...
kernel:[ 723.595032] [Hardware Error]: MC4_STATUS[-|CE|MiscV|-|AddrV|CECC]: 0x9c0240006b080813
Message from syslogd@linux-hse7 at Jul 24 18:38:57 ...
kernel:[ 723.595042] [Hardware Error]: Northbridge Error (node 0): DRAM ECC error detected on the NB.
Message from syslogd@linux-hse7 at Jul 24 18:38:57 ...
kernel:[ 723.595062] [Hardware Error]: cache level: L3/GEN, mem/io: MEM, mem-tx: RD, part-proc: SRC (no timeout)
Message from syslogd@linux-hse7 at Jul 24 18:38:57 ...
kernel:[ 723.605030] [Hardware Error]: MC4_STATUS[-|CE|MiscV|-|AddrV|CECC]: 0x9c0240006b080813
Run Code Online (Sandbox Code Playgroud) 我正在考虑将自动加载磁带驱动器作为备份策略的一部分。这将是我第一次体验磁带备份。磁带驱动器的成本效益似乎取决于它们将提供多年服务的假设。然而,我很难评估磁带驱动器的预期服务年限。它们有很多活动部件和易损部件要损坏,这意味着它们应该是可修复的;但产品文献并没有太多关于维修的说明。具体来说,我正在寻找以下问题的答案:
背景:我对磁带驱动器维护的理解主要基于我使用激光打印机的经验。一些入门级打印机显然根本不值得维修。另一方面,我仍在维护一些相对容易维修的LaserJet 4V打印机。我想知道自动加载磁带驱动器适合该范围的哪些地方。
我正在建造一台新机器,raid 控制器要求我为每个轨道提供扇区。我已经有很长时间(1998 年?)没有处理磁盘数学问题了,而且我找不到任何与现代硬件有关的东西。这些是在 p420i 控制器上运行 2.8 内核的 2TB SAS 驱动器。
32(这是默认值,对我来说似乎是错误的)和每轨道 63 个扇区的选项之间有什么区别?我什么时候需要其中一个?
我有几个包含备份数据的 HDD。我想把它们存放在一个安全的地方。我知道一些好的做法,例如将它们存储在不同的建筑物中,因此如果发生火灾,您仍然可以恢复数据。但我更关心的是 HDD 的退化,例如湿度。我应该将它们存放在塑料袋中吗?有没有什么特殊的方法来存放硬盘,使其不受环境损坏?
我们不幸地发现,我们办公室服务器机房中的服务器正在生锈。这在第一个失败后曝光。
一个明显的候选者是 AC 装置,它的湿度调节有问题。所以,我绘制了温度和湿度。有很多话要说,但这很好地说明了我的问题:
在相对密封的房间(1.5 x 2.5 米左右)中,我怀疑每个恒温器循环后湿度保持如此高的事实。此外,关闭交流电可以明显抑制湿度峰值。
这是正常的交流行为吗?我没想到湿度总是回到如此高的水平。即使在图表的右侧,它也不只是保持低位,它“希望”稳定在相当高的位置。
我还研究了其他问题,例如含硫的细颗粒物质会导致腐蚀,但实际上,这更像是一个抽象的想法。我不知道如何衡量和/或测试。
我也有一家空调维修/空气质量公司看它,但他们似乎从办公室空气质量的角度考虑,并且不能完全理解我对服务器的要求与人不同。一方面,他们的建议是不断向房间注入新鲜空气。对我来说似乎不合逻辑。
编辑:更高的缩放级别,也可以看到温度上升/下降与湿度上升/下降之间的相关性:
过去几天,我一直在为内部网络上的少数最终用户寻找数据包丢失和网络稳定性问题......这些问题上周浮出水面,但该位置在六周前被闪电击中。
我发现在 77 米跑道的另一侧,四个 Cisco 2960 与几台 PC 和电话的堆栈之间的数据包丢失率为 5-10%。PC 通过中继链路(switchport 配置 pastebin)与电话串联运行。我们在客户端-服务器应用程序和 Microsoft Exchange 连接中看到掉线和中断。
我远程尝试了通常的故障排除步骤,让本地技术人员在用户和生产活动中断期间执行以下操作:
sh int)test cable-diagnostics tdr int Gi4/0/9(干净)*从 Cisco 2960 运行测试电缆最终,换了3次交换机端口才找到稳定的解决方案。唯一合乎逻辑的结论是一些 Cisco 2960 交换机端口坏了或不稳定……没有死,但行为也不一致。我不习惯看到单个端口以这种方式死亡。
我还可以测试或检查什么来确定这些设备是否有问题?
验证这一点的最佳实践方法是什么?
单个端口出现问题而不是连续的一组端口是否常见?
顺便说一句 -show cable-diagnostics tdr int Gi4/0/14非常酷......
Interface Speed Local pair Pair length Remote pair Pair status …Run Code Online (Sandbox Code Playgroud) 以下是我使用 i3 机器的 DIY 6 节点 Hadoop 集群的链接,

保护我的设计免受灰尘影响并提供更好的热传递的最佳方法是什么?我应该用什么来覆盖机架的四个侧面以防止灰尘进入?
我与许多拥有 IT 员工或本地顾问的仓储和工业应用客户打交道。这些站点中的许多站点仍在使用 10/100 兆位交换主干网……我设法让一些客户投资于网络,作为更大、更明显的计划的一部分;例如安全、仓库管理或 VoIP(感谢 PoE)。
我的问题实际上是关于如何在服务器机房/机柜中安排一组 3 个以上的独立交换机。假设这些交换机属于 Web 管理的第 2 层全千兆类别 ( HP ProCurve 1800-24G ),并且没有专用的堆叠接口。假设有正常范围的服务器和一个上行链路到 Cisco ASA 防火墙以实现互联网连接。很多时候,我看到这样的开关只是菊花链式的。

只有两个交换机,我会在单元之间设置一个 LACP 绑定。生成树(如果支持)。但是三个或更多单元呢?
在我自己的环境中,由于需要 PoE 或更复杂的路由,我可以使用更高质量的可堆叠设备或仅利用全机箱交换机(Cisco 4507、HP 5400zl)。但是对于上面描述的情况,正确的过程是什么?
我需要一个更好的存储和归档系统来存放我的小型企业的文件。具体来说,这些文件是已完成的视频项目。除了时间和成本限制之外,阻碍我的是我不相信我考虑过的任何解决方案。因此,我正在列出问题和我的想法。我将不胜感激任何意见。
预算: 我相信花它所需要的。话虽如此,我们是一家小企业。我希望我能以 <5k 和更多的 1-3k 摆脱这种情况。那可能是白日做梦。就这么告诉我吧。
问题:
我们目前在做什么:
当前解决方案有什么问题:
选项:
本地服务器
基于云的备份服务(CrashPlan.com、BackBlaze.com、Carbonite.com)
一个大 NAS
其他想法是:
我在一家大约有 50 人的公司工作。我们的两台服务器(相同)是根据以下规格定制的:
Xeon E3-1270 V3
Intel Entry Server Board
32 GB DDR3 ECC
2x 256 GB SSD RAID1 (for System)
4x 1TB SSD RAID10 (for Hyper-V VMs)
Windows Server 2012 R2 as Host and VMs
Run Code Online (Sandbox Code Playgroud)
每个服务器托管两个 VM(2 个 AD + 文件共享 + 漫游配置文件,1 个 SQL 服务器用于测试,1 个其他(不重要)。
我们在 QNAP NAS (2x 2TB RAID1) 上托管的 iSCSI 目标上使用内置的 Windows 备份执行每日备份。
服务器没有很多负载,我们从来没有遇到任何问题。我们的大部分数据都存储在云中(VS Online、SharePoint)。
但我想知道继续这种设置是否明智,或者切换到专业服务器硬件,即一台大型机器是否更好。
那么有哪些陷阱,我应该怎么做呢?
hardware ×10
backup ×3
hard-drive ×2
networking ×2
switch ×2
airflow ×1
archive ×1
cable ×1
cisco ×1
cluster ×1
cooling ×1
hadoop ×1
hp ×1
lto ×1
maintenance ×1
opensuse ×1
server-room ×1
server-setup ×1
storage ×1
tapedrive ×1