Seguridad

Un plan de resiliencia ante apagones al estilo Crowdstrike

Este verano, una actualización defectuosa del Falcon Sensor de CrowdStrike provocó una interrupción global que afectó a 8,5 millones de dispositivos Windows, lo que revela la importancia crucial de un plan de resiliencia real y, por lo tanto, de estrategias de respaldo y recuperación ante desastres. , en un mundo digital interconectado.

En julio de 2024, un intento de CrowdStrike de actualizar Falcon Sensor para la detección de amenazas en tiempo real y la protección de terminales provocó una falla del sistema que afectó a 8,5 millones de dispositivos Microsoft. Windows y causando interrupciones operativas y de TI generalizadas en todo el mundo.

Aunque este incidente no fue causado por un ciberataque o malware, resalta la importancia de contar con una estrategia integral y confiable de respaldo y recuperación ante desastres para evitar interrupciones en las operaciones comerciales.

CrowdStrike causa un impacto global inmediato

El apagón se detectó por primera vez en Australia, antes “pantalla azul de la muerte” se está extendiendo a dispositivos Windows en todo el mundo, perturbando no sólo a los usuarios, sino también a las empresas y proveedores de servicios críticos. Han surgido informes de disrupción en varias industrias, incluidas finanzas, TI, manufactura y más. A primera hora de la tarde, unos 2.600 vuelos en Estados Unidos fueron cancelados, mientras que más de 4.200 vuelos se vieron afectados en todo el mundo y tuvieron que recurrir al check-in manual, según el Wall Street Journal.

Cómo los RTO (objetivos de tiempo de recuperación) impactan las operaciones comerciales

Después de este incidente, CrowdStrike brindó soporte técnico y lanzó una revisión para ayudar a restaurar las operaciones del sistema. Sin embargo, muchos sistemas utilizados por las organizaciones no se pudieron recuperar automáticamente mediante un programa de reparación. La mayoría de las veces, los administradores de TI tuvieron que iniciar manualmente cada dispositivo afectado en modo seguro y eliminar manualmente las actualizaciones problemáticas de CrowdStrike.

Aunque Microsoft introdujo una solución de «minimización de procesos» al día siguiente, que ayudó a eliminar automáticamente los archivos defectuosos, la operación de reparación siguió siendo un proceso laborioso con dispositivos individuales que se iniciaban manualmente en WinPE a través de una unidad USB.

Dicho tiempo de inactividad genera interrupciones operativas, pérdida de productividad, costos adicionales, mayores riesgos de cumplimiento y, en última instancia, una experiencia negativa para el cliente y una reputación comercial dañada.

Un plan de protección de 5 puntos

Un incidente de este tipo debería alentar a todas las empresas, e incluso a todos los usuarios, a desarrollar un plan sólido de protección de datos para mantener la continuidad del negocio en todo momento. Estos son los 5 pasos clave de dicho plan:

Copias de seguridad completas : Implementar una estrategia de respaldo que cubra periódicamente todas las fuentes y dispositivos sin datos aislados es crucial para las empresas, especialmente aquellas que operan en múltiples plataformas o herramientas.

Ejercicios de restauración regulares. : Las fallas de equipos y sistemas nunca son predecibles. Probar continuamente la recuperabilidad de los datos de respaldo es esencial para verificar la efectividad y disponibilidad de los planes de recuperación ante desastres de la organización.

Recuperación instantánea de máquinas virtuales : Virtualizar los servicios y restaurar las operaciones lo más rápido posible garantiza una reducción del tiempo de inactividad y la continuidad del negocio.

Restauración multiplataforma : En el caso de CrowdStrike, sólo una plataforma se vio afectada. Las empresas pueden minimizar el riesgo de pérdida de datos garantizando que todos los datos, aplicaciones y sistemas puedan recuperarse y reintegrarse en múltiples entornos.

Copia de seguridad y recuperación fuera del sitio : Además de realizar una copia de seguridad de los datos en el sitio, la implementación de una copia de seguridad externa mitiga los riesgos asociados con la pérdida de datos. Si una empresa hubiera implementado una copia de seguridad en la nube externa durante el evento CrowdStrike, podría haber reanudado fácilmente los servicios desde ese sitio de copia de seguridad externo.

Las copias de seguridad son la clave para la resiliencia de los datos

Tener un plan seguro de respaldo y recuperación ante desastres es clave para la resiliencia de los datos y un paso crucial para cualquier empresa que busque una transformación digital.

El incidente de CrowdStrike resalta claramente la importancia de establecer una estrategia de respaldo sólida y probar los respaldos periódicamente para mantener la continuidad ante circunstancias imprevistas.
____________________________

Par Iván LebowskiLíder del equipo de ventas chez Sinología

Lea también:

Quick Machine Recovery, el arma antiincidentes Crowdstrike de Windows

La disculpa pública de Crowdstrike ante el Congreso de EE.UU.

Microsoft quiere encontrar una solución a incidentes como Crowdstrike

Sabemos por qué Crowdstrike arruinó el mundo

Seis lecciones de la interrupción de Crowdstrike atribuida falsamente a Microsoft

Una actualización defectuosa de Crowdstrike genera pánico y confusión. Microsoft no tiene nada que ver con eso..

[

Related posts
Seguridad

Contraseñas en la era de la IA: 7 reflejos para revisar

¿Qué pasaría si el 7 de mayo de 2026 fuera el último “día de la contraseña”? Frente a la…
Read more
Seguridad

por qué “el menor privilegio” sigue fuera de nuestro alcance

El principio de privilegio mínimo se ha vuelto obvio en el gobierno de TI. En todos lados. Incluso…
Read more
Seguridad

Todo sobre el riesgo de fuga de datos del navegador

El nuevo riesgo cibernético ya no implica necesariamente un archivo adjunto con trampa explosiva…
Read more

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *