跳转到内容

磁盘与数据问题

这一类问题的第一原则:先别动

发现硬盘报错或存储空间异常时,最危险的动作是「先重启试试」「先重建看看」。在确认状态之前,每一次额外的读写都可能让数据更难恢复。先读完下面的处置顺序。

处置顺序(适用于所有存储异常)

  1. 停止非必要的读写:暂停备份、媒体库扫描、下载任务。
  2. 确认当前状态:哪块盘有问题、存储空间是降级还是已无法挂载、数据还读不读得到。
  3. 如果还能读到数据,立刻拷出最重要的文件。 这一步优先于任何修复操作。
  4. 数据安全后,再考虑换盘、重建,见扩容与换盘
  5. 如果已经读不到且没有备份:停止操作,断电静置,评估数据价值后决定是否送专业恢复。

症状一:某块硬盘掉线

先区分是硬盘本身的问题还是连接问题:

线索倾向于
SMART 有重映射、待定扇区且在增长硬盘劣化
SMART 正常,但日志里有大量 I/O 错误线材、扩展卡或供电
只在高负载时掉线供电不足或扩展卡不稳
换一根线、换一个口后正常连接问题

排查命令:dmesg -T | grep -i 'ata\|i/o error' 通常能直接看到是哪个设备在报错。

症状二:存储空间显示降级

意味着冗余已经用掉了,现在没有保护

  1. 确认是哪块盘离线。
  2. 检查重要数据是否有备份,没有就先拷出来。
  3. 准备同等或更大容量的新盘。
  4. 扩容与换盘的步骤更换和重建。
  5. 重建期间不要重启、不要拔盘、不要跑大任务。

症状三:空间莫名其妙占满

按这个顺序找:

sh
df -h                                  # 先确认是哪个挂载点满了
du -h --max-depth=1 /路径 | sort -h    # 逐层找出最占地方的目录

常见的隐形占用:

  • 快照:改动量大的目录,快照会持续增长。
  • 回收站:删除的文件还在占空间。
  • 容器镜像和日志docker system df 可以看到占用情况。
  • 备份任务的历史版本:没设保留策略时会无限增长。
  • 虚拟机磁盘:动态分配的磁盘只增不减。

症状四:文件打不开或内容损坏

  1. 从快照或备份中取回一个早期版本,确认是文件本身坏了还是应用的问题。
  2. 检查该存储空间的 SMART 和日志,看是否有读取错误。
  3. Btrfs 存储空间可以查看是否有校验错误记录——校验能告诉你文件坏了,但单盘上无法修复
  4. 这是一个信号:检查你的备份是否覆盖了这份数据。

症状五:硬盘温度偏高

  • 确认机箱前部有风扇正对硬盘笼。
  • 检查盘与盘之间是否有间隔。
  • 查看是否有任务让硬盘持续满负载运行。
  • 长期高于 45 °C 需要改善风道,见机箱与散热

继续浏览

fnOS 非官方中文使用指南,与飞牛官方无隶属关系。