我已经在 x86_64 机器上使用 mdadm 管理的软件突袭设置了一个 4 驱动器 RAID-10 阵列。
它会启动并运行并按预期工作,
cat /proc/mdstat
md127 : active raid10 sdc2[2] sdd2[3] sda2[0] sdb2[1]
1951397888 blocks super 1.2 512K chunks 2 far-copies [4/4] [UUUU]
bitmap: 9/466 pages [36KB], 2048KB chunk
Run Code Online (Sandbox Code Playgroud)
atm 四个 SATA 驱动器物理插入主板的第一个四个 SATA 端口。
我想为灾难性恢复收集必要/完整的信息。从这里开始阅读,http://neil.brown.name/blog和邮件列表,我还不能完全相信我做对了。
我理解“驱动顺序很重要”。逻辑和/或物理顺序重要吗?
如果我拔掉这个阵列中的四个驱动器,然后将它们分别插回主板或 pci 卡上的不同端口,只要我没有更改软件配置中的任何内容,阵列会正确地自动重新组装吗?
我在戴尔服务器的 raid10 阵列中有 4 个磁盘。现在有 2 个驱动器出现故障。故障驱动器不在同一组(1+2 和 3+4),故障驱动器为 2 和 3。服务器仍在运行,但阵列已降级。我正在等待新驱动器的到来。
更换驱动器的最佳方法是什么?我可以同时更换两个磁盘吗?或者最好先重建第一组,然后再更换另一组?
是的,这是那些“为我做我的工作”的问题,有点遗憾:)
在不花费大量资金的情况下,我可以使用服务器中的硬盘驱动器的数量达到极限。我还有四个驱动器需要配置,我可以将它们设置为 RAID 5 并提供热备用,或者设置为没有热备用的 RAID 10。每个的大小将相同,RAID 5 将提供足够的性能。
我不喜欢 RAID 5,但我也不喜欢在没有热备件的情况下运行的想法。我对性能下降不太感兴趣,但系统没有足够冗余的时间。服务器和驱动器根据 13x5 4 小时响应合同(虽然我碰巧知道最近的服务提供商在冬天开车至少需要 2-3 小时)。
我应该注意到服务器还有两个 RAID 1 阵列,它们也受热备份保护。他们为什么不制作带有 9 个托架的驱动器笼!呵呵。
我在某处读过一篇博客文章,说 EC2 上的 RAID10 与 RAID0 相比将性能降低了一半。
但是,当卷上有关键的数据库数据时,如果卷坏了,您还能如何防止数据丢失?
(我刚刚遇到一个 RAID0 阵列中的一个卷停止响应的情况......)
我确实有带日志传送的主/从复制,但如果 RAID10 可以帮助我避免它,我不想进行故障转移。
设想:
是否可以使用服务器 A 的两个阵列的磁盘(例如:托架 1 和 3 的磁盘)将其复制到服务器 B(仍未配置)上?
我有一个HP Smart Array P400i RAID 控制器,有6 个磁盘,在 RAID 1+0 中工作。这是它的样子:
Mirror Group 0:
physicaldrive 1I:1:1 (port 1I:box 1:bay 1, SAS, 72 GB, OK)
physicaldrive 1I:1:2 (port 1I:box 1:bay 2, SAS, 72 GB, OK)
physicaldrive 1I:1:3 (port 1I:box 1:bay 3, SAS, 72 GB, OK)
Mirror Group 1:
physicaldrive 1I:1:4 (port 1I:box 1:bay 4, SAS, 72 GB, OK)
physicaldrive 2I:1:5 (port 2I:box 1:bay 5, SAS, 72 GB, OK)
physicaldrive 2I:1:6 (port 2I:box 1:bay 6, SAS, 72 GB, OK) …Run Code Online (Sandbox Code Playgroud) 因此,我们运行 4 个磁盘的 RAID10 阵列的虚拟机(实际上是 Azure 中的 Linux 计算机)已损坏。这是一个ubuntu盒子。据我所知,四个数据磁盘都很好,只是虚拟机坏了。
现在,我可以从该计算机上分离磁盘并创建一个新的 Linux 实例,然后将磁盘附加到该新实例。问题是,如何让 mdadm 使用这些磁盘上的数据设置 RAID10 阵列(我不希望将其作为新驱动器删除)。
另外,我附加磁盘的顺序是否重要,或者 mdadm 会找出阵列中的哪个磁盘吗?
我们的几台服务器在使用 Adaptec 2405 控制器的 RAID 10 中具有 ST32000641AS(2TB 希捷台式机驱动器)。Adaptec 告诉我这是一个坏主意,事实上,我们已经看到使用这些驱动器的一个突袭系统出现故障。由于这是一个 24/7 系统,我的问题是是否可以通过热交换来切换到 WD RE4 2TB RAID 版驱动器(型号 WD2003FYYS),直到我们迁移过来。我们会在每个驱动器之间等待,以确保突袭已自行重建。
从理论上讲,这应该可行……但是,我无法弄清楚的一件事是这些驱动器的大小是否完全相同。不幸的是,在 ST32000641AS 驱动器上构建的突袭是按容量分区的。如果 WD2003FYYS 驱动器再小一点,它就行不通。关于我可以去哪里了解 WD2003FYYS 驱动器是否与 ST32000641AS 一样大(或更大)的任何想法?
是的,我意识到这两个驱动器都标榜自己为 2TB 驱动器...
我在带有 PERC H700 RAID 控制器的戴尔服务器上运行 CentOS 7(XFS 文件系统)。在这台服务器中,我有 6 个三星 850 Evo 250GB SSD(是的,它们是消费类驱动器,但是,这是一台家用服务器。无论如何,我进行了 DD 测试,获得了大约 550MB/s 的速度,这将是近似写入单个 SSD 的速度,但这些驱动器处于 RAID 10 中......人们会期待更多。
写测试的输出:
[root@localhost] sync; dd if=/dev/zero of=tempfile bs=1M count=1024; sync
1024+0 records in
1024+0 records out
1073741824 bytes (1.1 GB) copied, 1.95942 s, 548 MB/s
Run Code Online (Sandbox Code Playgroud)
读取测试的输出:
[root@localhost]# dd if=tempfile of=/dev/null bs=1M count=1024
1024+0 records in
1024+0 records out
1073741824 bytes (1.1 GB) copied, 0.171463 s, 6.3 GB/s
Run Code Online (Sandbox Code Playgroud)
任何人都可以说明这种情况是否是可接受的写入速度?我对在这里做什么感到很困惑。感谢你的帮助 :)
我的四台服务器中的两台目前拥有mismatch_cnt大约 40000 个服务器,这让我很担心。我们正在使用 RAID10 设置。手册指出,
然而,在 RAID1 和 RAID10 上,软件问题可能会导致报告不匹配。这并不一定意味着阵列上的数据已损坏。可能只是系统不关心数组的该部分存储了什么 - 它是未使用的空间。
我们的服务器上不使用任何交换文件。服务器的其中一个 HDD SMART 自检失败,Available_Reservd_Space 过低。托管提供商表示,只有在硬盘出现物理故障时才会更换硬盘。
我想我不明白这个参数的真正含义和用处。该参数具有如此大值的其他原因可能是什么?如果这是镜像阵列,系统怎么可能不关心阵列的该部分上有什么?出于安全考虑,我认为系统也应该同步可用空间,然后 - 还剩下什么?
有没有可靠的方法来估计服务器中特定硬盘的风险?