
La unidad de disco de la computadora almacena todos sus archivos importantes. Fotos, documentos, videos y todo en el disco. Pero, ¿qué sucede cuando su disco comienza a fallar? Puede perderlo todo. ¡No te preocupes! Linux tiene herramientas incorporadas Revise la salud de su disco. Puede detectar problemas relacionados con el disco y guardar datos lo antes posible.
En esta guía detallada, discutiremos cómo:
- Pruebe SSD y HDD Health con datos inteligentes,
- Explicar datos inteligentes (es decir, comprender varios atributos inteligentes),
- Comprender las señales de advertencia clave de la falla de la unidad,
- Autodificación usando SmartCTL,
- Escanear el mal departamento,
- Verifique la integridad del sistema de archivos,
- Establecer Monitoreo de nivel de desgaste SSD,
- Resolver problemas comunes.
Comencemos.
¿Por qué revisar la salud de su disco?
Al igual que un automóvil necesita mantenimiento regular, su disco duro o SSD pueden desgastarse con el tiempo. Esto puede ser un problema:
- Falla mecánica – descomposición de partes móviles
- Mal departamento – Parte del disco se vuelve ilegible
- Tener puesto – El ciclo de escritura de SSD es limitado
- Problemas de temperatura – Componentes de daño por calor
Algunos signos comunes de un disco fallido incluyen:
- Rendimiento lento (Archivo se carga para siempre)
- Sonido extraño (Haga clic en el sonido HDD)
- Frascos o errores frecuentes
- Archivos faltantes o corruptos
Es por eso que necesita monitorear la salud de su disco regularmente. Al verificar la salud del disco lo antes posible, puede:
- Evitar la pérdida de datos Retrocediendo antes del fracaso,
- Extender la vida del disco Detectando problemas lo antes posible,
- Evite el colapso repentino Eso arruina tu trabajo.
¿Qué son los datos inteligentes?
Elegante representar sDuendemetroOnitoring, unoAnálisis nal y riñonaleportación TTecnología. Está integrado en la mayoría de los discos duros y SSD modernos. Piense en ello como una boleta de calificaciones para el disco.
Rastrear inteligentemente métricas importantes, como:
- ¿Cuántas veces ha sido conducido el disco?
- Temperatura actual
- Número de sectores malos encontrados
- Cuántos datos se escribieron (SSD)
Herramientas de escaneo de disco Linux requeridas que necesita
Para los fines de esta guía, utilizaremos las siguientes herramientas:
- Inteligente: De
smartmontoolsPaquetes que leen datos inteligentes de unidades. - Malas barreras: Escanee el departamento de Body Bad en el disco.
- FSCK: Verifique y repare los errores del sistema de archivos.
- Disco enano: Herramienta gráfica para ver la información del disco y ejecutar pruebas.
Instale las herramientas de escaneo de disco necesarias en Linux
La mayoría de los sistemas de Linux tienen smartctl Ya instalado. Si no, aquí le mostramos cómo instalarlo:
Arch Linux:
sudo pacman -S smartmontools
Debian, Ubuntu, Linux Mint:
sudo apt update sudo apt install smartmontools
Fedora, Rhel, Almalinux, Rocky Linux:
sudo dnf install smartmontools
Para interfaces gráficas, instale el disco GNOME:
sudo apt install gnome-disk-utility
Encuentra el nombre del disco
Debe conocer el nombre del disco antes de consultar el disco de salud. Hay varias herramientas para ayudarte Encuentre los detalles de su unidad de disco en Linux.
Aquí usaremos lsblk Orden:
lsblk
Verá la salida similar a:
NAME MAJ:MIN RM SIZE RO TYPE MOUNTPOINTS sda 8:0 0 931.5G 0 disk ├─sda1 8:1 0 931.5G 0 part /media/ostechnix/WD_SSD └─sda2 8:2 0 32M 0 part nvme0n1 259:0 0 465.8G 0 disk ├─nvme0n1p1 259:1 0 512M 0 part /boot/efi ├─nvme0n1p2 259:2 0 464.3G 0 part / └─nvme0n1p3 259:3 0 976M 0 part [SWAP]
Su disco principal puede ser sda,,,,, sdbo similar. NVME SSD muestra como nvme0n1.
Ejecutar una verificación básica de salud del disco
Use controles básicos de salud del disco smartctlcorrer:
sudo smartctl -H /dev/sda
reemplazar sda Use su nombre de disco real.
Obtendrá el siguiente resumen de salud rápida:
smartctl 7.3 2022-02-28 r5338 [x86_64-linux-6.14.5-1-bpo12-pve] (local build) Copyright (C) 2002-22, Bruce Allen, Christian Franke, www.smartmontools.org === START OF READ SMART DATA SECTION === SMART overall-health self-assessment test result: PASSED
Si la salida dice «pasado»tu disco se ve bien. Si dice «fallido», tiene problemas.
Obtenga información detallada de salud del disco
Para recopilar más detalles sobre discos, use -a bandera:
sudo smartctl -a /dev/sda
Esto muestra todo sobre su disco.
Salida de muestra:
smartctl 7.3 2022-02-28 r5338 [x86_64-linux-6.14.5-1-bpo12-pve] (local build)
Copyright (C) 2002-22, Bruce Allen, Christian Franke, www.smartmontools.org
=== START OF INFORMATION SECTION ===
Model Family: WD Blue / Red / Green SSDs
Device Model: WDC WDS100T2G0A-00JH30
Serial Number: 21XXXXXXXXX
LU WWN Device Id: 5 002c45 7av462801
Firmware Version: UH450400
User Capacity: 1,000,204,886,016 bytes [1.00 TB]
Sector Size: 512 bytes logical/physical
Rotation Rate: Solid State Device
Form Factor: 2.5 inches
TRIM Command: Available, deterministic
Device is: In smartctl database 7.3/5319
ATA Version is: ACS-3, ACS-2 T13/2015-D revision 3
SATA Version is: SATA 3.2, 6.0 Gb/s (current: 6.0 Gb/s)
Local Time is: Tue Jun 3 13:32:12 2025 IST
SMART support is: Available - device has SMART capability.
SMART support is: Enabled
=== START OF READ SMART DATA SECTION ===
SMART overall-health self-assessment test result: PASSED
General SMART Values:
Offline data collection status: (0x00) Offline data collection activity
was never started.
Auto Offline Data Collection: Disabled.
Self-test execution status: ( 0) The previous self-test routine completed
without error or no self-test has ever
been run.
Total time to complete Offline
[...]
SMART Attributes Data Structure revision number: 1
Vendor Specific SMART Attributes with Thresholds:
ID# ATTRIBUTE_NAME FLAG VALUE WORST THRESH TYPE UPDATED WHEN_FAILED RAW_VALUE
5 Reallocated_Sector_Ct 0x0032 100 100 000 Old_age Always - 0
9 Power_On_Hours 0x0032 100 100 000 Old_age Always - 6425
12 Power_Cycle_Count 0x0032 100 100 000 Old_age Always - 1220
165 Block_Erase_Count 0x0032 100 100 000 Old_age Always - 597
166 Minimum_PE_Cycles_TLC 0x0032 100 100 --- Old_age Always - 4
167 Max_Bad_Blocks_per_Die 0x0032 100 100 --- Old_age Always - 105
168 Maximum_PE_Cycles_TLC 0x0032 100 100 --- Old_age Always - 9
169 Total_Bad_Blocks 0x0032 100 100 --- Old_age Always - 773
170 Grown_Bad_Blocks 0x0032 100 100 --- Old_age Always - 0
171 Program_Fail_Count 0x0032 100 100 000 Old_age Always - 0
172 Erase_Fail_Count 0x0032 100 100 000 Old_age Always - 0
173 Average_PE_Cycles_TLC 0x0032 100 100 000 Old_age Always - 4
174 Unexpected_Power_Loss 0x0032 100 100 000 Old_age Always - 662
184 End-to-End_Error 0x0032 100 100 --- Old_age Always - 0
187 Reported_Uncorrect 0x0032 100 100 000 Old_age Always - 0
188 Command_Timeout 0x0032 100 100 --- Old_age Always - 0
194 Temperature_Celsius 0x0022 055 067 000 Old_age Always - 45 (Min/Max 0/67)
199 UDMA_CRC_Error_Count 0x0032 100 100 --- Old_age Always - 0
230 Media_Wearout_Indicator 0x0032 100 100 000 Old_age Always - 0x014600500146
232 Available_Reservd_Space 0x0033 100 100 005 Pre-fail Always - 100
233 NAND_GB_Written_TLC 0x0032 100 100 --- Old_age Always - 3518
234 NAND_GB_Written_SLC 0x0032 100 100 000 Old_age Always - 8056
241 Host_Writes_GiB 0x0030 100 100 000 Old_age Offline - 3794
242 Host_Reads_GiB 0x0030 100 100 000 Old_age Offline - 3427
244 Temp_Throttle_Status 0x0032 000 100 --- Old_age Always - 0
SMART Error Log Version: 1
No Errors Logged
SMART Self-test log structure revision number 1
No self-tests have been logged. [To run self-tests, use: smartctl -t]
Selective Self-tests/Logging not supportedExplicar los datos inteligentes
Basado en los datos inteligentes anteriores, el siguiente es un análisis de los atributos clave:
Estado de salud general
Resultados de las pruebas de autoevaluación de salud holística inteligente: aprobar
Esto indica que la unidad no ha detectado ningún problema crítico y se está ejecutando dentro de los parámetros normales.
Comprender las propiedades inteligentes
La tabla de atributos es la parte más importante. Cada línea muestra diferentes indicadores de salud.
Cada propiedad tiene varias columnas:
- IDENTIFICACIÓN – Número de atributo
- attribute_name – su medición
- valor – Valor actual (generalmente mejor)
- Límite – Umbral de falla
- RAW_VALUE – Medición real
RAW_VALUE suele ser el más útil. Muestra el número real.
Entendamos algunas propiedades inteligentes importantes.
1. RealLocated_Sector_CT (ID 5): 0
No hay sectores reasignados, lo que indica que la unidad no ha encontrado sectores ilegibles que necesiten ser remapdados.
2. Power_on_Hours (ID 9): 6425 horas
El disco ha sido conducido durante unos 267 días. Esta es una duración moderada de uso y no atraerá atención directa.
3. Power_cycle_count (ID 12): 1220
La unidad tiene 1,220 ciclos de energía. Los ciclos de energía frecuentes pueden causar desgaste, pero este número está dentro de la gama típica de unidades de consumo.
4. Grown_bad_blocks (ID 170): 0
No se desarrollaron nuevos bloques malos durante la operación de la unidad, lo que indica la memoria flash NAND estable.
5. Program_Fail_Count (ID 171) y ERASE_FAIL_COUNT (ID 172): 0
No hay falla durante el programa o la operación de borrar, que es una señal positiva de integridad de datos.
6. Promedio_pe_cycles_tlc (ID 173): 4
Cada célula se sometió a un promedio de 4 ciclos de programa/borrado. Teniendo en cuenta que TLC NANDS generalmente soporta miles de tales ciclos, esto sugiere poco desgaste.
7. Temperatura_Celsius (ID 194): 45 ° C (min/máximo 0/67 ° C)
La temperatura actual está dentro del rango de funcionamiento seguro. La temperatura máxima registrada era alta a 67 ° C, pero aún era aceptable para los SSD.
8. HOST_WRITES_GIB (ID 241): 3794 GIB
Se han escrito aproximadamente 3.7 TB de datos en la unidad. Esta es una cantidad relativamente baja para SSD de 1 TB y se recomienda para uso de la luz.
9. Host_reads_gib (ID 242): 3427 GIB
Se han leído alrededor de 3.3 TB de datos de la unidad, de acuerdo con el monto de escritura e indican el uso del uso del balance.
Western Digital Forum tiene Informes detallados sobre todos los atributos inteligentes. Eche un vistazo y esté familiarizado con los atributos importantes.
Registro de autocomprobación
No se registró una autocomprobación.
No hice ninguna mejor prueba, por eso obtuve esto. Se recomienda realizar una breve autoestima para verificar de manera proactiva los posibles problemas:
sudo smartctl -t short /dev/sda
Una vez terminado, vea los resultados de la siguiente manera
sudo smartctl -l selftest /dev/sda
En general, los datos inteligentes de mi SSD muestran que es de buena salud sin signos obvios de desgaste o falla.
Tenga cuidado con las señales de advertencia
Estos signos significan que su disco puede fallar:
Banderas rojas:
- La salud general muestra «falló»
- Departamentos reasignados por encima de 0
- Para determinar el departamento o superior
- 0 El departamento incorrecto de arriba
- La temperatura siempre excede los 60 ° C
Bandera amarilla:
- El disco es muy antiguo (HDD es de más de 5 años, SSD barato es de más de 3 años)
- Muchas horas eléctricas (HDD 40,000)
- Recuento de nivel de desgaste alto en SSD
Autodificación con SmartCTL
Smart puede ejecutar pruebas reales en el disco:
Prueba corta (2 minutos):
sudo smartctl -t short /dev/sda
Prueba larga (horas):
sudo smartctl -t long /dev/sda
Verifique los resultados de la prueba:
sudo smartctl -l selftest /dev/sda
Verá la siguiente salida:
=== START OF READ SMART DATA SECTION === SMART Self-test log structure revision number 1 Num Test_Description Status Remaining LifeTime(hours) LBA_of_first_error # 1 Short offline Completed without error 00% 6428
Escanee el departamento malo para el mal departamento
este Malas barreras Las empresas de servicios públicos le permiten identificar departamentos malos que pueden causar pérdida de datos.
Prueba de lectura sin pérdidas:
sudo badblocks -v /dev/sdX
La prueba es segura y no modifica los datos.
Prueba de escritura destructiva (datos de borrado):
sudo badblocks -wsv /dev/sdX
Use esta función solo si está listo para perder todos los datos en la unidad.
Verifique la integridad del sistema de archivos utilizando FSCK
Asegúrese de que su sistema de archivos esté protegido de los errores FSCK Orden.
sudo umount /dev/sdX1
sudo fsck /dev/sdX1
reemplazar /dev/sdX1 Con tu partición específica. Es mejor ejecutar esto en particiones no contundidas o modo de recuperación.
Lectura relacionada: cómo verificar y reparar el sistema de archivos Linux con comandos FSCK
Opcional: use el disco GNOME para interfaces gráficas
Para los que les gusta la GUI:
- Abierto Disco enano.
- Seleccione la unidad de la lista.
- Haga clic en el menú (☰) y seleccione Datos inteligentes y autoevaluación.
- Consulte su salud y pruebela según sea necesario.
Configuración de monitoreo
No solo verifique una vez, debe monitorear el disco regularmente. este smartd El demonio observa automáticamente el disco.
Editar archivos de configuración inteligente:
sudo nano /etc/smartd.conf
Agregue esta línea para monitorear todos los discos:
DEVICESCAN -a -o on -S on -s (S/../.././02|L/../../6/03)
Esta configuración garantiza smartd Monitoree automáticamente todos los dispositivos de características inteligentes, realice breves autocompas a las 2:00 a.m. todos los días y las autoevaluaciones semanales a las 3:00 am todos los sábados.
Hacer cambios en sus preferencias. Guarde y cierre el archivo.
Servicio de inicio:
sudo systemctl enable smartd sudo systemctl start smartd
Cuándo preocuparse y que hacer
Tome medidas inmediatamente si:
- Los programas de cheques de salud «Falló»
- Verá la reasignación o el departamento pendiente
- El disco hace un sonido excepcional
- El sistema se vuelve muy lento
Tomar medidas:
- Hacer una copia de seguridad de datos importantes inmediatamente. Revisa el nuestro Herramienta de respaldo categoría. Hemos revisado algunas herramientas de respaldo importantes, como Borgbackup,,,,, deja dup,,,,, rsync,,,,, aún,,,,, Servidor de copia de seguridad de proxmox. Elija el que le convenga.
- Realizar pruebas inteligentes a largo plazo
- Considere reemplazar el disco
- No ignore las advertencias
Comentarios especiales a SSD
Los SSD son diferentes de los discos duros tradicionales:
- No tienen partes móviles
- Se desaniman de la escritura, no de la edad
- La temperatura no es crítica
- Buscando niveles de desgaste y recuentos de programas/borradores
La mayoría de los SSD muestran un «indicador de desgaste» cae de 100 a 0.
Resolver las preguntas frecuentes
1. Soporte inteligente no está disponible
- Tu disco puede ser demasiado viejo
- Pruebe otra interfaz (los adaptadores USB a SATA generalmente no admiten Smart)
2. Dejar rechazar
- usar
sudoUse el comando smartCTL - Asegúrese de ingresar al grupo de disco
3. No existe tal dispositivo
- Nombre del disco de doble verificación
lsblk - El disco puede fallar por completo
en conclusión
El monitoreo regular de la salud del disco puede ayudar a prevenir la pérdida de datos y garantizar la confiabilidad del sistema.
Usando este smartctl,,,,, badblocksy fsckpuede identificar y resolver de manera proactiva posibles problemas. Para una experiencia fácil de usar, Gnome Discks ofrece una alternativa gráfica.
Sus datos son importantes. Tomar unos minutos para verificar la salud del disco puede ahorrarle horas de dolor. Linux lo facilita con las herramientas incorporadas.
Tenga en cuenta que la vigilancia inteligente no siempre es perfecta, pero tendrá la mayoría de los problemas antes de que se conviertan en desastres. Combinado con copias de seguridad regulares, esta es su mejor defensa contra la pérdida de datos.
Imágenes destacadas por Myo min kyaw de Pixabay.








