跳转到内容

RAID 级别怎么选

RAID 解决的是一个很具体的问题:一块硬盘坏了,数据还在,服务不中断。它不解决别的任何问题。明确这一点,选型会简单很多。

对照表

假设每块盘容量相同,都是 4 TB:

方式最少盘数可用容量可容忍故障适合
单盘 / Basic14 TB配合严格备份的入门方案
JBOD / 线性拼接2盘容量之和把零散容量拼起来放不重要的数据
RAID 0(条带)2盘容量之和无,坏一块全丢临时高速暂存,不要放重要数据
RAID 1(镜像)2最小盘容量1 块两盘位机器的默认选择
RAID 5(单校验)3(n−1)×最小盘1 块4–5 盘位,容量与冗余的平衡点
RAID 6(双校验)4(n−2)×最小盘2 块大容量盘、盘数较多时更稳妥
RAID 104(偶数)总容量的一半每组各 1 块需要较好随机读写性能时

按盘数给建议

  • 1 块盘:单盘 + 把重要数据自动备份到别处。这不丢人,比勉强凑冗余却没有备份好得多。
  • 2 块盘:RAID 1。简单、可靠、换盘直观。
  • 3–4 块盘:RAID 5。用一块盘的容量换一块盘的容错。
  • 5 块盘以上,且单盘容量较大(8 TB 以上):认真考虑 RAID 6。

为什么大容量盘要考虑 RAID 6

关键在重建这个环节。RAID 5 只能坏一块盘;当它坏掉后,系统要读取其余所有盘的全部数据来重算出新盘的内容。这个过程有两个风险:

  1. 时间长。大容量盘重建可能需要十几个小时到几天,期间所有盘都在高负载运行。
  2. 期间没有任何冗余。此时再坏一块,或者在读取时遇到某个无法读出的坏扇区,重建就会失败。

盘越大、盘越多,重建期间出问题的概率越高。RAID 6 多付出一块盘的容量,换来的是重建期间仍有一层保护

重建期间不要做的事

重建时不要重启、不要拔盘、不要同时跑大量读写任务。如果这时候发现自己没有备份,正确的做法是先把最重要的数据拷出来,再让重建继续——而不是祈祷它顺利完成。

常见误解

「RAID 1 就等于有备份了」 —— 不是。你在一边删掉的文件,另一边会同步删掉。

「RAID 5 比 RAID 1 安全,因为它有校验」 —— 不是。两者都只能容忍一块盘故障,RAID 5 的重建过程反而更漫长、更吃力。

「盘数越多越安全」 —— 相反。在同样的冗余级别下,盘越多,同时出现两块故障的概率越高。

检查结果

写下三个数字:可用容量、能坏几块盘、重建大约需要多久(按单盘容量粗估)。如果「能坏几块」是 0,那么你的备份方案必须是完整且经过验证的。

延伸阅读

fnOS 非官方中文使用指南,与飞牛官方无隶属关系。