我最近刚买了一台新服务器 HP DL380 G6。我用 LSI 9211-8i 替换了库存的智能阵列 p410 控制器。
我的计划是使用 ZFS 作为 XEN 的底层存储,它将在同一裸机上运行。
有人告诉我,您可以将 SATA 磁盘与智能阵列控制器一起使用,但由于消费驱动器缺少 TLER、CCTL 和 ERC,因此不推荐使用。是这种情况吗?
我想知道在 JBOD(RAID 直通模式)中使用 LSI 控制器是否真的像使用智能阵列控制器那样产生影响?
我知道尝试使用没有写缓存支持的 RAID 系统进行虚拟化对性能不利。但我正在考虑为 ZFS 添加一个 SSD。那会有什么不同吗?
我之所以如此痴迷于使用 ZFS 是为了进行重复数据删除和压缩。我不认为智能阵列控制器可以执行任何这些功能。
最近我办公室的 Buffalo TeraStation NAS 出现了一个问题,这让我开始调查 Raid 5。
我发现了几篇不同的文章,讨论在大型阵列或大型磁盘中使用 raid 5 的不合适性
我想弄清楚什么算作“大”?
我们这里的 NAS 是一个 4 驱动器 Raid 5 设置,每个驱动器是 1 TB。驱动器发生故障并已更换,阵列当前正在重建。
就重建期间可能会出现问题而言,此设置是否构成如此之大?
这种设置在日常使用中的可靠性如何?
据我了解,由于必须读取大量数据来执行任务,因此在重建期间您很有可能遇到 URE。
这个问题是否也影响到大量数据的备份和恢复场景?如果您必须对 10 TB 备份进行完整还原,则 URE 似乎同样可能。
在了解了一些 LVM 镜像之后,我考虑更换我正在使用的当前 RAID-1 方案以获得一些灵活性。
问题是,根据我在网上查到的,LVM是:
http://www.joshbryan.com/blog/2008/01/02/lvm2-mirrors-vs-md-raid-1/
此外,至少对于我阅读的几个设置指南(http://www.tcpdump.com/kb/os/linux/lvm-mirroring/intro.html),该指南实际上需要第三个磁盘来存储 LVM 日志. 这使得设置在 2 个磁盘安装上完全无法使用,并降低了更多磁盘上使用的镜像磁盘的数量。
任何人都可以评论上述事实,并让我知道他使用 LVM 镜像的经验吗?
谢谢。
我的问题是:什么时候适合简单地创建一个具有快速读写性能的大型阵列,例如 RAID 10,而不是为特定应用程序创建较小的阵列?
在我看来,如果我的整体 I/O 要求不是特别繁重,具有出色读写性能的单个阵列可以为所有应用程序提供更好的整体性能,除非那些(可能很少)具有不同访问模式的应用程序达到峰值同时(在数据库崩溃时复制大量大文件)。
如果我将一对主轴专用于特定任务(例如事务日志),并且它们甚至没有为工作负载出汗......为什么不将该工作负载放在更大的 RAID 10 上?然后,这些心轴将能够为其他工作负载做出贡献,而不是 60% 的时间坐在那里抓挠自己。
PS,在我的特殊情况下,RAID 10 的成本开销不是一个因素,因为我正在考虑创建多个 RAID 1 阵列和一个较小的 RAID 5。使用 RAID 10 来获得我需要的空间量将是可比的。
如果服务器安装在大小合适的 UPS 上,电池是否是多余的?有一个选项可以强制写回模式,我想了解风险。据我了解,它有助于防止电源故障,而缓存中的数据尚未写出到物理磁盘。但如果服务器使用 UPS,则不存在断电风险,特别是如果它是智能 UPS 并且服务器配置为在电池电量不足时正常关闭。我错过了什么吗?
我已经设置了一个由 4 * 2 TB 磁盘组成的 Linux 软件 raid 级别 5。磁盘阵列是使用 64k 条带大小创建的,没有其他配置参数。在初始重建之后,我尝试创建一个文件系统,这一步需要很长时间(大约半小时或更长时间)。我尝试创建一个 xfs 和 ext3 文件系统,都花了很长时间,使用 mkfs.ext3 我观察到以下行为,这可能会有所帮助:
单个磁盘的性能非常好,我分别在每个磁盘上运行 bonnie++,写入/读取值约为 95/110MB/s。即使我在每个驱动器上并行运行 bonnie++,这些值也仅减少了大约 10 MB。因此,我通常将硬件/I/O 调度排除在问题来源之外。
我为 stripe_cache_size 和 readahead size 尝试了不同的配置参数,但没有成功,但我认为它们与文件系统创建操作无关。
服务器详细信息:
有没有人有关于如何进一步调试的建议?
关于对齐 4k 扇区磁盘的 Serverfault 有很多问题,但有一件事对我来说还不是很清楚。
我成功地对齐了我的 RAID1+LVM。我所做的其中一件事是使用 mdadm superblock 1.0 版(将超级块存储在磁盘的末尾)。
手册页是这样说的:
不同的子版本将超级块存储在设备的不同位置,要么在末尾(对于 1.0),要么在开头(对于 1.1),要么从开头开始 4K(对于 1.2)。“1”相当于“1.0”。“默认”相当于“1.2”。
默认的 1.2 版本是为 4k 扇区驱动器制作的吗?在我看来,事实并非如此,因为从一开始的 4k + 超级块的长度并不是 4k 的众多(如果我没记错的话,超级块大约有 200 字节长)。
欢迎对此有任何见解。
编辑:
下面的回答是 mdadm superblock 1.1 和 1.2 用于 4k 对齐。我刚刚创建了一个全设备突袭:
mdadm --create /dev/md4 -l 1 -n 2 /dev/sdb /dev/sdd
Run Code Online (Sandbox Code Playgroud)
然后我给它添加了一个逻辑卷:
vgcreate universe2 /dev/md4
Run Code Online (Sandbox Code Playgroud)
阵列以 16 MB/s 的速度同步:
md4 : active raid1 sdd[1] sdb[0]
1465137424 blocks super 1.2 [2/2] [UU]
[>....................] resync = 0.8% (13100352/1465137424) finish=1471.6min speed=16443K/sec
Run Code Online (Sandbox Code Playgroud)
所以我怀疑它是否正确对齐。
(磁盘为 1.5 TB …
我在 3ware 9650SE-16ML 卡上有一个糟糕的 RAID 阵列。我不知道是我刚刚遇到了双磁盘故障(糟糕!)还是我读错了。的相关输出/c0 show all是:
Port Status Unit Size Blocks Serial
---------------------------------------------------------------
p0 DEGRADED u0 931.51 GB 1953525168 5QJ07MAH
p1 ECC-ERROR u0 931.51 GB 1953525168 5QJ0DCW9
p2 OK u0 931.51 GB 1953525168 5QJ0DW9C
p3 OK u0 931.51 GB 1953525168 5QJ0CKXJ
Run Code Online (Sandbox Code Playgroud)
失败是(来自show alarms):
Ctl Date Severity Alarm Message
------------------------------------------------------------------------------
c0 [Sun Nov 20 07:47:23 2011] INFO Rebuild started: unit=0
c0 [Sun Nov 20 08:20:12 2011] ERROR Drive ECC error reported: port=1, unit=0
c0 [Sun …Run Code Online (Sandbox Code Playgroud) 在一个不同的问题有关配置RAID阵列,作者是建设有8个驱动RAID阵列。
一个答案建议在 RAID 5 中使用 7 个驱动器,剩下的一个作为热备用。由于 RAID 6 可以防止两次故障,即使它们是并发的,我认为它总是更好的选择。
您什么时候会使用热备份而不是额外的奇偶校验驱动器?