Tutoriales

Cómo verificar la salud del disco en Linux: una guía para principiantes

La unidad de disco de la computadora almacena todos sus archivos importantes. Fotos, documentos, videos y todo en el disco. Pero, ¿qué sucede cuando su disco comienza a fallar? Puede perderlo todo. ¡No te preocupes! Linux tiene herramientas incorporadas Revise la salud de su disco. Puede detectar problemas relacionados con el disco y guardar datos lo antes posible.

En esta guía detallada, discutiremos cómo:

  • Pruebe SSD y HDD Health con datos inteligentes,
  • Explicar datos inteligentes (es decir, comprender varios atributos inteligentes),
  • Comprender las señales de advertencia clave de la falla de la unidad,
  • Autodificación usando SmartCTL,
  • Escanear el mal departamento,
  • Verifique la integridad del sistema de archivos,
  • Establecer Monitoreo de nivel de desgaste SSD,
  • Resolver problemas comunes.

Comencemos.

¿Por qué revisar la salud de su disco?

Al igual que un automóvil necesita mantenimiento regular, su disco duro o SSD pueden desgastarse con el tiempo. Esto puede ser un problema:

  • Falla mecánica – descomposición de partes móviles
  • Mal departamento – Parte del disco se vuelve ilegible
  • Tener puesto – El ciclo de escritura de SSD es limitado
  • Problemas de temperatura – Componentes de daño por calor

Algunos signos comunes de un disco fallido incluyen:

  • Rendimiento lento (Archivo se carga para siempre)
  • Sonido extraño (Haga clic en el sonido HDD)
  • Frascos o errores frecuentes
  • Archivos faltantes o corruptos

Es por eso que necesita monitorear la salud de su disco regularmente. Al verificar la salud del disco lo antes posible, puede:

  • Evitar la pérdida de datos Retrocediendo antes del fracaso,
  • Extender la vida del disco Detectando problemas lo antes posible,
  • Evite el colapso repentino Eso arruina tu trabajo.

¿Qué son los datos inteligentes?

Elegante representar sDuendemetroOnitoring, unoAnálisis nal y riñonaleportación TTecnología. Está integrado en la mayoría de los discos duros y SSD modernos. Piense en ello como una boleta de calificaciones para el disco.

Rastrear inteligentemente métricas importantes, como:

  • ¿Cuántas veces ha sido conducido el disco?
  • Temperatura actual
  • Número de sectores malos encontrados
  • Cuántos datos se escribieron (SSD)

Herramientas de escaneo de disco Linux requeridas que necesita

Para los fines de esta guía, utilizaremos las siguientes herramientas:

  • Inteligente: De smartmontools Paquetes que leen datos inteligentes de unidades.
  • Malas barreras: Escanee el departamento de Body Bad en el disco.
  • FSCK: Verifique y repare los errores del sistema de archivos.
  • Disco enano: Herramienta gráfica para ver la información del disco y ejecutar pruebas.

Instale las herramientas de escaneo de disco necesarias en Linux

La mayoría de los sistemas de Linux tienen smartctl Ya instalado. Si no, aquí le mostramos cómo instalarlo:

Arch Linux:

sudo pacman -S smartmontools

Debian, Ubuntu, Linux Mint:

sudo apt update
sudo apt install smartmontools

Fedora, Rhel, Almalinux, Rocky Linux:

sudo dnf install smartmontools

Para interfaces gráficas, instale el disco GNOME:

sudo apt install gnome-disk-utility

Encuentra el nombre del disco

Debe conocer el nombre del disco antes de consultar el disco de salud. Hay varias herramientas para ayudarte Encuentre los detalles de su unidad de disco en Linux.

Aquí usaremos lsblk Orden:

lsblk

Verá la salida similar a:

NAME        MAJ:MIN RM   SIZE RO TYPE MOUNTPOINTS
sda           8:0    0 931.5G  0 disk 
├─sda1        8:1    0 931.5G  0 part /media/ostechnix/WD_SSD
└─sda2        8:2    0    32M  0 part 
nvme0n1     259:0    0 465.8G  0 disk 
├─nvme0n1p1 259:1    0   512M  0 part /boot/efi
├─nvme0n1p2 259:2    0 464.3G  0 part /
└─nvme0n1p3 259:3    0   976M  0 part [SWAP]

Su disco principal puede ser sda,,,,, sdbo similar. NVME SSD muestra como nvme0n1.

Ejecutar una verificación básica de salud del disco

Use controles básicos de salud del disco smartctlcorrer:

sudo smartctl -H /dev/sda

reemplazar sda Use su nombre de disco real.

Obtendrá el siguiente resumen de salud rápida:

smartctl 7.3 2022-02-28 r5338 [x86_64-linux-6.14.5-1-bpo12-pve] (local build)
Copyright (C) 2002-22, Bruce Allen, Christian Franke, www.smartmontools.org

=== START OF READ SMART DATA SECTION ===
SMART overall-health self-assessment test result: PASSED
Ejecución de verificaciones básicas de salud del disco en Linux

Si la salida dice «pasado»tu disco se ve bien. Si dice «fallido», tiene problemas.

Obtenga información detallada de salud del disco

Para recopilar más detalles sobre discos, use -a bandera:

sudo smartctl -a /dev/sda

Esto muestra todo sobre su disco.

Salida de muestra:

smartctl 7.3 2022-02-28 r5338 [x86_64-linux-6.14.5-1-bpo12-pve] (local build)
Copyright (C) 2002-22, Bruce Allen, Christian Franke, www.smartmontools.org

=== START OF INFORMATION SECTION ===
Model Family:     WD Blue / Red / Green SSDs
Device Model:     WDC WDS100T2G0A-00JH30
Serial Number:    21XXXXXXXXX
LU WWN Device Id: 5 002c45 7av462801
Firmware Version: UH450400
User Capacity:    1,000,204,886,016 bytes [1.00 TB]
Sector Size:      512 bytes logical/physical
Rotation Rate:    Solid State Device
Form Factor:      2.5 inches
TRIM Command:     Available, deterministic
Device is:        In smartctl database 7.3/5319
ATA Version is:   ACS-3, ACS-2 T13/2015-D revision 3
SATA Version is:  SATA 3.2, 6.0 Gb/s (current: 6.0 Gb/s)
Local Time is:    Tue Jun  3 13:32:12 2025 IST
SMART support is: Available - device has SMART capability.
SMART support is: Enabled

=== START OF READ SMART DATA SECTION ===
SMART overall-health self-assessment test result: PASSED

General SMART Values:
Offline data collection status:  (0x00)    Offline data collection activity
                    was never started.
                    Auto Offline Data Collection: Disabled.
Self-test execution status:      (   0)    The previous self-test routine completed
                    without error or no self-test has ever 
                    been run.
Total time to complete Offline 

[...]

SMART Attributes Data Structure revision number: 1
Vendor Specific SMART Attributes with Thresholds:
ID# ATTRIBUTE_NAME          FLAG     VALUE WORST THRESH TYPE      UPDATED  WHEN_FAILED RAW_VALUE
  5 Reallocated_Sector_Ct   0x0032   100   100   000    Old_age   Always       -       0
  9 Power_On_Hours          0x0032   100   100   000    Old_age   Always       -       6425
 12 Power_Cycle_Count       0x0032   100   100   000    Old_age   Always       -       1220
165 Block_Erase_Count       0x0032   100   100   000    Old_age   Always       -       597
166 Minimum_PE_Cycles_TLC   0x0032   100   100   ---    Old_age   Always       -       4
167 Max_Bad_Blocks_per_Die  0x0032   100   100   ---    Old_age   Always       -       105
168 Maximum_PE_Cycles_TLC   0x0032   100   100   ---    Old_age   Always       -       9
169 Total_Bad_Blocks        0x0032   100   100   ---    Old_age   Always       -       773
170 Grown_Bad_Blocks        0x0032   100   100   ---    Old_age   Always       -       0
171 Program_Fail_Count      0x0032   100   100   000    Old_age   Always       -       0
172 Erase_Fail_Count        0x0032   100   100   000    Old_age   Always       -       0
173 Average_PE_Cycles_TLC   0x0032   100   100   000    Old_age   Always       -       4
174 Unexpected_Power_Loss   0x0032   100   100   000    Old_age   Always       -       662
184 End-to-End_Error        0x0032   100   100   ---    Old_age   Always       -       0
187 Reported_Uncorrect      0x0032   100   100   000    Old_age   Always       -       0
188 Command_Timeout         0x0032   100   100   ---    Old_age   Always       -       0
194 Temperature_Celsius     0x0022   055   067   000    Old_age   Always       -       45 (Min/Max 0/67)
199 UDMA_CRC_Error_Count    0x0032   100   100   ---    Old_age   Always       -       0
230 Media_Wearout_Indicator 0x0032   100   100   000    Old_age   Always       -       0x014600500146
232 Available_Reservd_Space 0x0033   100   100   005    Pre-fail  Always       -       100
233 NAND_GB_Written_TLC     0x0032   100   100   ---    Old_age   Always       -       3518
234 NAND_GB_Written_SLC     0x0032   100   100   000    Old_age   Always       -       8056
241 Host_Writes_GiB         0x0030   100   100   000    Old_age   Offline      -       3794
242 Host_Reads_GiB          0x0030   100   100   000    Old_age   Offline      -       3427
244 Temp_Throttle_Status    0x0032   000   100   ---    Old_age   Always       -       0

SMART Error Log Version: 1
No Errors Logged

SMART Self-test log structure revision number 1
No self-tests have been logged.  [To run self-tests, use: smartctl -t]

Selective Self-tests/Logging not supported

Explicar los datos inteligentes

Basado en los datos inteligentes anteriores, el siguiente es un análisis de los atributos clave:

Estado de salud general

Resultados de las pruebas de autoevaluación de salud holística inteligente: aprobar

Esto indica que la unidad no ha detectado ningún problema crítico y se está ejecutando dentro de los parámetros normales.

Comprender las propiedades inteligentes

La tabla de atributos es la parte más importante. Cada línea muestra diferentes indicadores de salud.

Cada propiedad tiene varias columnas:

  • IDENTIFICACIÓN – Número de atributo
  • attribute_name – su medición
  • valor – Valor actual (generalmente mejor)
  • Límite – Umbral de falla
  • RAW_VALUE – Medición real

RAW_VALUE suele ser el más útil. Muestra el número real.

Entendamos algunas propiedades inteligentes importantes.

1. RealLocated_Sector_CT (ID 5): 0

No hay sectores reasignados, lo que indica que la unidad no ha encontrado sectores ilegibles que necesiten ser remapdados.

2. Power_on_Hours (ID 9): 6425 horas

El disco ha sido conducido durante unos 267 días. Esta es una duración moderada de uso y no atraerá atención directa.

3. Power_cycle_count (ID 12): 1220

La unidad tiene 1,220 ciclos de energía. Los ciclos de energía frecuentes pueden causar desgaste, pero este número está dentro de la gama típica de unidades de consumo.

4. Grown_bad_blocks (ID 170): 0

No se desarrollaron nuevos bloques malos durante la operación de la unidad, lo que indica la memoria flash NAND estable.

5. Program_Fail_Count (ID 171) y ERASE_FAIL_COUNT (ID 172): 0

No hay falla durante el programa o la operación de borrar, que es una señal positiva de integridad de datos.

6. Promedio_pe_cycles_tlc (ID 173): 4

Cada célula se sometió a un promedio de 4 ciclos de programa/borrado. Teniendo en cuenta que TLC NANDS generalmente soporta miles de tales ciclos, esto sugiere poco desgaste.

7. Temperatura_Celsius (ID 194): 45 ° C (min/máximo 0/67 ° C)

La temperatura actual está dentro del rango de funcionamiento seguro. La temperatura máxima registrada era alta a 67 ° C, pero aún era aceptable para los SSD.

8. HOST_WRITES_GIB (ID 241): 3794 GIB

Se han escrito aproximadamente 3.7 TB de datos en la unidad. Esta es una cantidad relativamente baja para SSD de 1 TB y se recomienda para uso de la luz.

9. Host_reads_gib (ID 242): 3427 GIB

Se han leído alrededor de 3.3 TB de datos de la unidad, de acuerdo con el monto de escritura e indican el uso del uso del balance.

Western Digital Forum tiene Informes detallados sobre todos los atributos inteligentes. Eche un vistazo y esté familiarizado con los atributos importantes.

Registro de autocomprobación

No se registró una autocomprobación.

No hice ninguna mejor prueba, por eso obtuve esto. Se recomienda realizar una breve autoestima para verificar de manera proactiva los posibles problemas:

sudo smartctl -t short /dev/sda

Una vez terminado, vea los resultados de la siguiente manera

sudo smartctl -l selftest /dev/sda

En general, los datos inteligentes de mi SSD muestran que es de buena salud sin signos obvios de desgaste o falla.

Tenga cuidado con las señales de advertencia

Estos signos significan que su disco puede fallar:

Banderas rojas:

  • La salud general muestra «falló»
  • Departamentos reasignados por encima de 0
  • Para determinar el departamento o superior
  • 0 El departamento incorrecto de arriba
  • La temperatura siempre excede los 60 ° C

Bandera amarilla:

  • El disco es muy antiguo (HDD es de más de 5 años, SSD barato es de más de 3 años)
  • Muchas horas eléctricas (HDD 40,000)
  • Recuento de nivel de desgaste alto en SSD

Autodificación con SmartCTL

Smart puede ejecutar pruebas reales en el disco:

Prueba corta (2 minutos):

sudo smartctl -t short /dev/sda

Prueba larga (horas):

sudo smartctl -t long /dev/sda

Verifique los resultados de la prueba:

sudo smartctl -l selftest /dev/sda

Verá la siguiente salida:

=== START OF READ SMART DATA SECTION ===
SMART Self-test log structure revision number 1
Num  Test_Description    Status                  Remaining  LifeTime(hours)  LBA_of_first_error
# 1  Short offline       Completed without error       00%      6428      

Escanee el departamento malo para el mal departamento

este Malas barreras Las empresas de servicios públicos le permiten identificar departamentos malos que pueden causar pérdida de datos.

Prueba de lectura sin pérdidas:

sudo badblocks -v /dev/sdX

La prueba es segura y no modifica los datos.

Prueba de escritura destructiva (datos de borrado):

sudo badblocks -wsv /dev/sdX

Use esta función solo si está listo para perder todos los datos en la unidad.

Verifique la integridad del sistema de archivos utilizando FSCK

Asegúrese de que su sistema de archivos esté protegido de los errores FSCK Orden.

sudo umount /dev/sdX1
sudo fsck /dev/sdX1

reemplazar /dev/sdX1 Con tu partición específica. Es mejor ejecutar esto en particiones no contundidas o modo de recuperación.

Lectura relacionada: cómo verificar y reparar el sistema de archivos Linux con comandos FSCK

Opcional: use el disco GNOME para interfaces gráficas

Para los que les gusta la GUI:

  1. Abierto Disco enano.
  2. Seleccione la unidad de la lista.
  3. Haga clic en el menú (☰) y seleccione Datos inteligentes y autoevaluación.
  4. Consulte su salud y pruebela según sea necesario.

Configuración de monitoreo

No solo verifique una vez, debe monitorear el disco regularmente. este smartd El demonio observa automáticamente el disco.

Editar archivos de configuración inteligente:

sudo nano /etc/smartd.conf

Agregue esta línea para monitorear todos los discos:

DEVICESCAN -a -o on -S on -s (S/../.././02|L/../../6/03)

Esta configuración garantiza smartd Monitoree automáticamente todos los dispositivos de características inteligentes, realice breves autocompas a las 2:00 a.m. todos los días y las autoevaluaciones semanales a las 3:00 am todos los sábados.

Hacer cambios en sus preferencias. Guarde y cierre el archivo.

Servicio de inicio:

sudo systemctl enable smartd
sudo systemctl start smartd

Cuándo preocuparse y que hacer

Tome medidas inmediatamente si:

  • Los programas de cheques de salud «Falló»
  • Verá la reasignación o el departamento pendiente
  • El disco hace un sonido excepcional
  • El sistema se vuelve muy lento

Tomar medidas:

  1. Hacer una copia de seguridad de datos importantes inmediatamente. Revisa el nuestro Herramienta de respaldo categoría. Hemos revisado algunas herramientas de respaldo importantes, como Borgbackup,,,,, deja dup,,,,, rsync,,,,, aún,,,,, Servidor de copia de seguridad de proxmox. Elija el que le convenga.
  2. Realizar pruebas inteligentes a largo plazo
  3. Considere reemplazar el disco
  4. No ignore las advertencias

Comentarios especiales a SSD

Los SSD son diferentes de los discos duros tradicionales:

  • No tienen partes móviles
  • Se desaniman de la escritura, no de la edad
  • La temperatura no es crítica
  • Buscando niveles de desgaste y recuentos de programas/borradores

La mayoría de los SSD muestran un «indicador de desgaste» cae de 100 a 0.

Resolver las preguntas frecuentes

1. Soporte inteligente no está disponible

  • Tu disco puede ser demasiado viejo
  • Pruebe otra interfaz (los adaptadores USB a SATA generalmente no admiten Smart)

2. Dejar rechazar

  • usar sudo Use el comando smartCTL
  • Asegúrese de ingresar al grupo de disco

3. No existe tal dispositivo

  • Nombre del disco de doble verificación lsblk
  • El disco puede fallar por completo

en conclusión

El monitoreo regular de la salud del disco puede ayudar a prevenir la pérdida de datos y garantizar la confiabilidad del sistema.

Usando este smartctl,,,,, badblocksy fsckpuede identificar y resolver de manera proactiva posibles problemas. Para una experiencia fácil de usar, Gnome Discks ofrece una alternativa gráfica.

Sus datos son importantes. Tomar unos minutos para verificar la salud del disco puede ahorrarle horas de dolor. Linux lo facilita con las herramientas incorporadas.

Tenga en cuenta que la vigilancia inteligente no siempre es perfecta, pero tendrá la mayoría de los problemas antes de que se conviertan en desastres. Combinado con copias de seguridad regulares, esta es su mejor defensa contra la pérdida de datos.

Imágenes destacadas por Myo min kyaw de Pixabay.

Publicaciones relacionadas

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Botón volver arriba