外观
RAID 级别怎么选
RAID 解决的是一个很具体的问题:一块硬盘坏了,数据还在,服务不中断。它不解决别的任何问题。明确这一点,选型会简单很多。
对照表
假设每块盘容量相同,都是 4 TB:
| 方式 | 最少盘数 | 可用容量 | 可容忍故障 | 适合 |
|---|---|---|---|---|
| 单盘 / Basic | 1 | 4 TB | 无 | 配合严格备份的入门方案 |
| JBOD / 线性拼接 | 2 | 盘容量之和 | 无 | 把零散容量拼起来放不重要的数据 |
| RAID 0(条带) | 2 | 盘容量之和 | 无,坏一块全丢 | 临时高速暂存,不要放重要数据 |
| RAID 1(镜像) | 2 | 最小盘容量 | 1 块 | 两盘位机器的默认选择 |
| RAID 5(单校验) | 3 | (n−1)×最小盘 | 1 块 | 4–5 盘位,容量与冗余的平衡点 |
| RAID 6(双校验) | 4 | (n−2)×最小盘 | 2 块 | 大容量盘、盘数较多时更稳妥 |
| RAID 10 | 4(偶数) | 总容量的一半 | 每组各 1 块 | 需要较好随机读写性能时 |
按盘数给建议
- 1 块盘:单盘 + 把重要数据自动备份到别处。这不丢人,比勉强凑冗余却没有备份好得多。
- 2 块盘:RAID 1。简单、可靠、换盘直观。
- 3–4 块盘:RAID 5。用一块盘的容量换一块盘的容错。
- 5 块盘以上,且单盘容量较大(8 TB 以上):认真考虑 RAID 6。
为什么大容量盘要考虑 RAID 6
关键在重建这个环节。RAID 5 只能坏一块盘;当它坏掉后,系统要读取其余所有盘的全部数据来重算出新盘的内容。这个过程有两个风险:
- 时间长。大容量盘重建可能需要十几个小时到几天,期间所有盘都在高负载运行。
- 期间没有任何冗余。此时再坏一块,或者在读取时遇到某个无法读出的坏扇区,重建就会失败。
盘越大、盘越多,重建期间出问题的概率越高。RAID 6 多付出一块盘的容量,换来的是重建期间仍有一层保护。
重建期间不要做的事
重建时不要重启、不要拔盘、不要同时跑大量读写任务。如果这时候发现自己没有备份,正确的做法是先把最重要的数据拷出来,再让重建继续——而不是祈祷它顺利完成。
常见误解
「RAID 1 就等于有备份了」 —— 不是。你在一边删掉的文件,另一边会同步删掉。
「RAID 5 比 RAID 1 安全,因为它有校验」 —— 不是。两者都只能容忍一块盘故障,RAID 5 的重建过程反而更漫长、更吃力。
「盘数越多越安全」 —— 相反。在同样的冗余级别下,盘越多,同时出现两块故障的概率越高。
检查结果
写下三个数字:可用容量、能坏几块盘、重建大约需要多久(按单盘容量粗估)。如果「能坏几块」是 0,那么你的备份方案必须是完整且经过验证的。