Procedimientos de mantenimiento preventivo
3.4 Procedimientos de mantenimiento preventivo
Un sistema de información es como cualquier otro activo organizacional: requiere mantenimiento regular para garantizar que funciona correctamente, tiene vida útil prolongada y evita costosos tiempos de inactividad. El mantenimiento preventivo es infinitamente menos costoso que reparación de emergencia después de un fallo. Un servidor que falla inesperadamente puede inmovilizar la productividad de decenas o cientos de usuarios, causando pérdida de datos, interrupciones de servicio e impacto en la reputación organizacional.
Este apartado proporciona procedimientos prácticos de mantenimiento preventivo que pueden ser implementados por gestores de información, reduciéndose así la dependencia de especialistas externos para tareas rutinarias mientras se garantiza que los sistemas informáticos permanecen confiables y seguros.
Mantenimiento físico de hardware
El polvo y la suciedad son enemigos silenciosos de los ordenadores. El polvo obstruye ventiladores y radiadores, reduciendo la eficiencia de refrigeración y causando sobrecalentamiento. El polvo también contiene partículas conductoras que pueden causar cortocircuitos en circuitos electrónicos delicados.
Limpieza de equipos: trimestralmente, debe abrirse la carcasa de servidores y ordenadores de escritorio críticos, y usar aire comprimido (a baja presión, nunca aire de compresor industrial que puede dañar componentes) para remover polvo de ventiladores, radiadores y filtros. Las áreas más propensas a acumulación de polvo son ventiladores de entrada y salida, disipadores de calor de procesadores y filtros de aire.
Verificación de contactos y conexiones: verificar regularmente que todos los cables están firmemente conectados. Un cable ligeramente suelto puede causar fallos intermitentes que son extremadamente difíciles de diagnosticar. En servidores, todos los conectores deben estar correctamente asegurados.
Monitoreo de temperaturas: la mayoría de sistemas BIOS incluyen sensores de temperatura. Se debe monitorear regularmente que procesadores, memoria y discos permanecen dentro de rangos seguros (típicamente < 80°C bajo carga normal). Si las temperaturas aumentan gradualmente, es señal de que la refrigeración necesita limpieza.
Verificación de ventiladores: los ventiladores son componentes mecánicos que se desgastan. Un ventilador que hace ruido anormal o gira irregularmente es probable que falle pronto y debe ser reemplazado proactivamente.
Mantenimiento de discos duros y almacenamiento
Los discos duros mecánicos (HDD) tienen partes móviles que se desgastan con el tiempo. Las unidades de estado sólido (SSD) tienen un número finito de ciclos de escritura antes de degradarse. El mantenimiento de almacenamiento incluye:
Monitoreo SMART (Self-Monitoring, Analysis and Reporting Technology): esta tecnología integrada en discos modernos monitorea parámetros de salud como errores de lectura, temperatura, ciclos de encendido y uso de almacenamiento. Herramientas gratuitas como CrystalDiskInfo (Windows) o smartctl (Linux) permiten revisar el estado SMART de discos. Si SMART reporta problemas, el disco está fallando y debe ser reemplazado antes de que se pierdan datos.
Desfragmentación (solo para HDD): los discos duros se fragmentan gradualmente; fragmentación significa que archivos se dispersan en múltiples ubicaciones físicas del disco, ralentizando lecturas. Desfragmentar regularmente (mensualmente en HDD pesadamente utilizados) reorganiza archivos contiguamente, mejorando rendimiento. Los SSD no deben ser desfragmentados, pues reduce su vida útil sin mejorar rendimiento.
Copias de seguridad regulares: es el procedimiento más importante. Se debe realizar backup completo semanalmente de datos críticos y backup incremental diario. El backup debe almacenarse en dispositivo separado (preferentemente offsite, fuera de las instalaciones) en caso de desastre como incendio o robo que destruya los sistemas primarios.
Pruebas de restauración: periódicamente (trimestral, mínimo) se debe restaurar datos desde backup en un sistema de prueba, verificando que los datos pueden recuperarse efectivamente. Muchas organizaciones descubren que sus backups no funcionan solo cuando realmente necesitan usarlos, demasiado tarde.
Mantenimiento del sistema operativo y software
El software requiere actualización continua para parches de seguridad, corrección de bugs y mejoras de rendimiento.
Actualizaciones de sistema operativo: Microsoft, Apple y Linux emiten actualizaciones regularmente. Las actualizaciones de seguridad son críticas y deben instalarse dentro de días de su liberación. Las actualizaciones de funcionalidad (como cambios mayores de versión) pueden programarse en periodos de mantenimiento cuando afecten menos a usuarios. Se recomienda actualizar servidores durante ventanas de mantenimiento programado (por ejemplo, 2am-4am los domingos).
Parches de software de aplicación: cualquier software que accede a internet (navegadores, lectores PDF, etc.) requiere parches regulares. Vulnerabilidades descubiertas son explotadas rápidamente, así que no actualizar es riesgo de seguridad significativo.
Actualización de controladores (drivers): drivers de tarjetas de red, gráficas e impresoras requieren actualización ocasional para compatibilidad con nuevo hardware o sistemas operativos. Sin embargo, actualizar drivers solo si hay problemas conocidos; actualizar innecesariamente puede introducir inestabilidad.
Mantenimiento de seguridad
Antivirus y antimalware: software de seguridad debe mantener definiciones de amenazas actualizadas (automáticamente, idealmente a diario). Se debe realizar escaneo completo del sistema semanalmente en horarios de poco uso (por ejemplo, domingo por la noche). Antivirus consume recursos, así que escaneos en horario laboral pueden ralentizar usuarios.
Firewall: tanto en nivel de sistema operativo como de red, el firewall debe estar configurado y monitoreado. Periodicamente se debe revisar las reglas de firewall para asegurar que siguen siendo apropiadas (por ejemplo, puertos abiertos solo para servicios que realmente se usan).
Cambio de contraseñas administrativas: contraseñas de sistemas críticos (acceso a servidores, cuentas administrativas) deben cambiarse cada 90 días. La mejor práctica moderna es usar autenticación multifactor (MFA), requiriendo tanto contraseña como un segundo factor como código de teléfono móvil.
Logs de auditoría: los servidores y sistemas deben mantener logs detallados de acceso y actividad. Se debe revisar estos logs regularmente para detectar acceso no autorizado o comportamiento anómalo.
Planificación de capacidad
El crecimiento de datos es predecible. Si un sistema almacena 5 TB y crece 500 GB anualmente, el disco estará lleno en 2 años. La planificación de capacidad implica:
- Monitorear tendencias actuales de crecimiento de datos
- Proyectar necesidades futuras (1 año, 3 años, 5 años)
- Presupuestar e instalar capacidad adicional antes de llegar al límite
- Planificar upgrading de hardware antes de que el actual sea insuficiente
Un servidor que está al 90% de capacidad está en estado de emergencia, pues cualquier error podría causar problemas. El objetivo es mantener sistemas entre 60-80% de capacidad máxima.
Documentación y seguimiento de mantenimiento
Se debe mantener un registro detallado de todas las actividades de mantenimiento:
| Tipo de Mantenimiento | Frecuencia | Responsable | Notas |
|---|---|---|---|
| Limpieza física | Trimestral | Soporte técnico | Especialmente en entornos polvorientos |
| Monitoreo SMART | Semanal | Automatizado | Alerta si hay problemas |
| Backup completo | Semanal | Automatizado | Verificar regularmente |
| Actualizaciones SO | Después de testing | Soporte técnico | Probar primero en sistema de prueba |
| Escaneo antivirus | Semanal | Automatizado | Fuera de horario laboral |
| Revisión de logs | Semanal | Seguridad | Detectar anomalías |
| Cambio de contraseñas | Cada 90 días | Administrador | Usar autenticación multifactor |
| Planificación de capacidad | Trimestral | Gestor de sistemas | Proyectar 1-5 años |
Ejemplo práctico: Plan de mantenimiento para un archivo digital
Una organización que gestiona un archivo digital con 1.715 cursos y miles de documentos asociados podría implementar un calendario de mantenimiento así:
Diario: sistema automático verifica que backups se completaron exitosamente
Semanalmente: monitoreo SMART de discos, escaneo antivirus en horarios no laborales, revisión de logs de acceso
Mensualmente: desfragmentación de discos HDD si aplica, revisión de uso de almacenamiento y tendencia de crecimiento, prueba de restauración de backup en sistema de prueba
Trimestralmente: limpieza física de polvo en servidores, auditoría de permisos de acceso, planificación de capacidad para próximos 12 meses
Anualmente: renovación de certificados SSL, revisión completa de política de seguridad, planificación de upgrades de hardware, entrenamiento de personal en procedimientos actualizados
Ideas clave
- El mantenimiento preventivo es mucho más económico que reparación de emergencia; requiere disciplina pero previene costosos tiempos de inactividad.
- El mantenimiento físico incluye limpieza de polvo, verificación de contactos y monitoreo de temperaturas; el objetivo es extender la vida útil del hardware.
- El monitoreo SMART de discos permite detectar fallos inminentes antes de que ocurran; combinado con backups regulares, garantiza recuperación de datos.
- Las actualizaciones de sistema operativo y software deben ser regulares por seguridad; deben ser probadas primero en sistemas no-críticos.
- La seguridad requiere antivirus actualizado, firewall configurado, cambio de contraseñas regular y revisión de logs de auditoría.
- La planificación de capacidad previene situaciones de emergencia; sistemas deben mantenerse entre 60-80% de capacidad máxima.
- La documentación detallada de actividades de mantenimiento permite auditoría, cumplimiento normativo y análisis de tendencias a lo largo del tiempo.