标签: bad-blocks

一个 RAM 模块中的坏字节 / RAM 的块区域被使用

我在一台服务器中有四个 512 MB RAM 模块。当我使用 memtest86+ 测试 RAM 时,第四个 RAM 仅显示一位错误。即使当我将第四个插槽中的 RAM 与其他一些 RAM 交换时,我仍然在完全相同位置的第四个插槽中的 RAM 中出现错误。所以我想阻止服务器使用 RAM 的一个特定地址(或 4kb 页,如有必要)。服务器装有 fedora 11,仅用于测试目的。它不托管任何用户应用程序。关于如何阻止使用 RAM 的某些部分的任何想法?或者是什么导致错误出现在特定字节,而不管安装的 RAM 模块如何。

linux memory fedora bad-blocks

5
推荐指数
1
解决办法
1689
查看次数

Windows 重复数据删除:确定哪些文件使用给定的块文件?

使用Windows Server的重复数据删除功能:

给定块存储中的特定块文件,是否可以确定哪个文件包含该块?

这里的用例是磁盘上的不可读块可以映射回块文件,这意味着该特定块文件中可能发生损坏,我想知道哪些文件使用该块,因此我可以手动检查这些文件是否以任何方式损坏,和/或假设它们已损坏并恢复它们等。

***Logical sector 4298505920 (0x10035fec0) on drive X is in file number 144581.
\System Volume Information\Dedup\ChunkStore\{F3F1DCDF-134B-4A3E-AFD5-5F698E42667A}.ddp\Data\000004ad.00000001.ccc
Run Code Online (Sandbox Code Playgroud)

换句话说,我可以找出哪些文件正在使用上述块文件中的数据吗?

corruption data-recovery deduplication bad-blocks

5
推荐指数
1
解决办法
145
查看次数

RAID 中哪个驱动器有坏扇区?

我使用 LSI MegaRaid SAS 控制器在单个虚拟驱动器中有 4 个物理驱动器。似乎(至少)其中一个驱动器有坏扇区,因为:

  • 尝试备份某些文件时出现 io 错误
  • 运行badblocks报告一些坏扇区

我希望解决这个问题就像换出有问题的磁盘并重建 RAID 阵列一样简单。我认为 LSI MegaRaid WebBIOS 可以让我识别有问题的磁盘,但我找不到任何检查坏扇区的选项。

以下是 WebBIOS 的屏幕截图: 在此处输入图片说明

任何人都可以就如何识别有问题的磁盘提供任何建议吗?

raid lsi bad-blocks megaraid hardware-raid

3
推荐指数
2
解决办法
5246
查看次数

我的硬盘坏了吗?

我刚刚更换了服务器上的硬盘。

它是 RAID 1 阵列的一部分。sdb1 分区现在每隔几个小时就会出现故障。

# cat /proc/mdstat
Personalities : [linear] [raid0] [raid1] [raid10] [raid6] [raid5] [raid4] [multi                                                                                                 path] [faulty]
md1 : active raid1 sdb1[2](F) sda1[0]
      463216576 blocks [2/1] [U_]

md3 : active raid1 sdb3[1] sda3[0]
      20970432 blocks [2/2] [UU]
Run Code Online (Sandbox Code Playgroud)

妈妈:

# mdadm -D /dev/md1
/dev/md1:
        Version : 0.90
  Creation Time : Tue Dec 25 15:04:23 2012
     Raid Level : raid1
     Array Size : 463216576 (441.76 GiB 474.33 GB)
  Used Dev Size : 463216576 (441.76 GiB 474.33 GB)
   Raid …
Run Code Online (Sandbox Code Playgroud)

raid hard-drive bad-blocks smartctl

2
推荐指数
1
解决办法
587
查看次数

SMART 与坏块,谁是对的?

我有一个半旧的硬盘(磁性硬盘,不是固态硬盘),我打算将它用作新 NAS 的系统驱动器。

所以我在它上面运行了 SMART 自测,它以“已完成:读取失败”状态结束。但是,badblock 在驱动器上完成了破坏性测试(因此 4 次通过)而没有错误。这两个程序中哪个更可能是正确的?

hard-drive smart bad-blocks

1
推荐指数
1
解决办法
623
查看次数

ext4 在故障磁盘上。如何避免重新挂载只读?

问题:

我负责 44 个节点的 Hadoop 集群。我们有 1.5TB WD Green Drives(非常未知)负载循环计数问题。

这些磁盘工作正常,但随着它们变老,它们显示出越来越多的坏块。重写这些坏块有一段时间了,但它们会重新出现在不同的地方。

由于这些磁盘中的大多数仅用于 Hadoop 数据节点,我们没有预算来替换它们,因此我正在寻找一种策略

  1. 不要疯狂维护集群,磁盘错误和相关的文件系统问题几乎每天都会出现。我目前的流程是:

    • 停止 Hadoop 服务、卸载磁盘、使用dmesg输出定位坏块并smartctl使用hdparm --write-sector.
    • fsck -f -y在磁盘上运行并重新安装它。
  2. 保持系统稳定。

    • Hadoop 负责处理磁盘错误(3 倍冗余),但我不想冒险损坏文件系统。

我做了什么?

目前我已将mount选项更改为:

  • erros=continue,noatime 但由于日记错误,我得到了 occosial 只读重新安装。

然后我尝试禁用日志:

  • tune2fs -O ^has_journal 这避免了只读重新挂载但似乎损坏了文件系统(这是有道理的,没有日志)

现在我正在考虑切换到

  • tune2fs -o journal_data_writebackmountdata=writeback,nobh,barrier=0

但我不确定这是否会重新引入只读重新安装。

所以,我想避免只读重新挂载,想要维护稳定的文件系统元数据但不关心数据中的错误(Hadoop 会处理这个问题)。速度也不应该受到影响。

我有哪些选择?我知道这对任何系统管理员来说都是一个噩梦。操作系统分区安装了完整的日志,我不打算在生产数据上进行测试。这严格适用于 Hadoop 数据节点/任务跟踪器硬盘。

linux ext4 bad-blocks hadoop

0
推荐指数
1
解决办法
2344
查看次数

是否有文件系统可以自动镜像数据并重新分配避免坏块?

让我在这里更好地解释一下...我有一个带有坏块的 1 TB HDD,我知道它会降级直到停止,但我仍然想继续使用它。所以,我的问题是:是否有任何文件系统能够对此驱动器进行分区,例如两个 500GB,在分区上镜像数据并自动执行以下操作:

  1. 尝试从磁盘读取数据。
  2. 发现一个分区有一个坏块。
  3. 将此有风险的数据(现在只能从一个分区读取)复制到同一分区(坏块)上的另一个块。
  4. 减少磁盘上的总空间(减少一个块?),因为您不能再完全镜像 500GB。

我不是基础设施方面的专家,我是一名开发人员,所以,也许有一些非常了解的东西,比如 RAID os 可以为我做到这一点,但我真的不知道。我尝试过一次 RAID,但是当我失败 1 次时,Windows 会自动提醒我,并且分区再也不会“同步”了。

任何操作系统上的任何解决方案对我来说都可以。

谢谢!

raid hard-drive bad-blocks

-2
推荐指数
1
解决办法
69
查看次数