Explora
Medición, elaboración de informes y mejora de la resiliencia operativa
La resiliencia operativa representa la capacidad de su organización para prevenir, adaptarse, responder y recuperarse ante interrupciones, sin dejar de prestar los servicios empresariales esenciales.
¿Qué son las métricas de resiliencia operativa?
La resiliencia operativa se ha convertido en el factor determinante que distingue a las organizaciones que prosperan de aquellas que simplemente sobreviven a las interrupciones. Dado que el 78 % de las organizaciones afirma haber sido víctima de un ataque de ransomware en el último año, la capacidad de mantener los servicios empresariales críticos durante y después de los incidentes marca la diferencia en la ventaja competitiva.
Las empresas modernas se enfrentan a un triple reto: ciberamenazas sofisticadas, requisitos normativos estrictos y la complejidad de las infraestructuras distribuidas. La mediana global de 11 días entre el momento en que se produce la intrusión inicial y su detección demuestra que los enfoques de seguridad tradicionales por sí solos pueden no ser suficientes para proteger plenamente la continuidad del negocio.
Desarrollar una verdadera resiliencia suele implicar algo más que planes de respaldo y procedimientos de Recovery ante desastres. Exige un enfoque sistemático para medir, informar y mejorar continuamente la capacidad de su organización para absorber las interrupciones y recuperarse de ellas, al tiempo que se mantiene la prestación de servicios dentro de unos límites aceptables.
Definición de resiliencia operativa
La resiliencia operativa representa la capacidad de su organización para prevenir, adaptarse, responder y recuperarse ante interrupciones, al tiempo que sigue prestando servicios empresariales críticos. A diferencia de la planificación tradicional de la continuidad del negocio, que se centra en escenarios específicos, la resiliencia operativa adopta una visión holística de todo su ecosistema, incluyendo la tecnología, los procesos, las personas y las dependencias de terceros.
Los cinco pilares de la resiliencia operativa proporcionan un marco estratégico para desarrollar un enfoque integral de protección:
- Taxonomía de servicios y umbrales de tolerancia: Identificar los servicios empresariales críticos (CBS) y establecer umbrales de tolerancia al impacto.
- Mapeo de dependencias: comprender todos los componentes, incluidos los proveedores externos.
- Pruebas de escenarios: ejercicios periódicos para validar las capacidades de Recovery.
- Respuesta y recuperación: planes contrastados mediante pruebas que garanticen el cumplimiento de los límites de tolerancia.
- Gobernanza y mejora continua: supervisión por parte del consejo de administración, autoevaluación y medidas correctoras financiadas.
La continuidad del negocio suele centrarse en la recuperación tras incidentes específicos, mientras que la resiliencia operativa puede abordar el reto más amplio de mantener los servicios ante diversos tipos de interrupciones. Este cambio refleja las expectativas normativas: por ejemplo, en el Reino Unido, la Autoridad de Conducta Financiera (FCA) comenzó a exigir a las empresas que demuestren que pueden mantenerse dentro de los límites de tolerancia de impacto en 2025.
Guía de implementación: Establecimiento de los cinco pilares
Esta tabla ofrece una hoja de ruta estructurada para la implementación de cada pilar, con hitos y criterios de validación claros.
| Pilar | Medidas que deben adoptarse | Plazo | Puntos de control de éxito |
| Taxonomía de servicios |
• Realizar un inventario de todos los servicios empresariales. • Clasificarlos por nivel de criticidad (niveles 0-3). • Definir los umbrales de impacto para cada servicio. |
Semanas 1 a 4 |
• Todos los servicios catalogados. • Aprobación de la lista CBS por parte del consejo de administración. • Tolerancias documentadas. |
| Mapeo de dependencias |
• Mapear las dependencias tecnológicas. • Documentar las relaciones con terceros. • Identificar los puntos únicos de fallo. |
Semanas 5 a 8 |
• Árboles de dependencias completados. • Puntuaciones de riesgo asignadas. • Proveedores alternativos identificados. |
| Pruebas de escenarios |
• Diseñar escenarios de interrupción. • Programar ejercicios trimestrales. • Crear scripts de prueba automatizados. |
Semanas 9–12 |
• Plan de pruebas aprobado. • Primer ejercicio completado. • Deficiencias documentadas. |
| Respuesta y Recovery |
• Elaborar manuales de procedimientos específicos para cada servicio. • Implementar la coordinación de la Recovery. • Validar las capacidades de Recovery completa. |
Semanas 13-16 |
• Manuales de procedimientos probados. • Tiempos de Recovery medidos. • Pruebas recopiladas. |
| Gobernanza |
• Establecer la periodicidad de los informes. • Crear cuadros de mando ejecutivos. • Financiar programas de corrección. |
De forma continua |
• Informes mensuales al consejo de administración. • Tendencia positiva de los indicadores clave de rendimiento (KPI). • Presupuesto asignado. |
Métricas de resiliencia operativa frente a los KPI
Comprender la distinción entre métricas e indicadores clave de rendimiento (KPI) es fundamental para una gestión eficaz de la resiliencia. Las métricas representan datos brutos que miden aspectos específicos de sus operaciones, mientras que los KPI son indicadores de rendimiento seleccionados que se vinculan directamente con los objetivos estratégicos de resiliencia y los requisitos normativos.
Métricas clave de resiliencia que hay que supervisar
Las siguientes métricas constituyen la base de la medición cuantitativa de la resiliencia y contribuyen a facilitar la toma de decisiones basada en datos:
- Tiempo de detección (TTD): mide la rapidez con la que sus sistemas identifican anomalías o incidentes de seguridad. Con un tiempo medio de permanencia de 11 días a nivel mundial, las organizaciones que reducen el TTD limitan significativamente los daños potenciales y la complejidad de Recovery.
- Tiempo medio de recuperación limpia (MTCR): representa el tiempo real necesario para restaurar los servicios a un estado limpio y verificado, lo que ayuda a confirmar que están libres de malware conocido o de corrupción. Esta métrica va más allá de la simple restauración; valida que los sistemas recuperados son fiables. Las organizaciones señalan que, sin embargo, la recuperación limpia suele llevar más tiempo.
- Tasa de éxito de la recuperación: realiza un seguimiento del porcentaje de pruebas de recuperación que cumplen los objetivos de tolerancia al impacto definidos. Dado que solo el 13 % de las organizaciones recupera íntegramente sus datos tras un ataque de ransomware, esta métrica pone de relieve la brecha entre los intentos de recuperación y los resultados satisfactorios.
- Análisis de desviaciones/brechas: cuantifica en qué medida el estado actual del CBS se desvía de los niveles de resiliencia deseados. Esto incluye brechas en la cobertura de los controles, como servicios que carecen de copias de seguridad inmutables o manuales de procedimientos probados.
Informes sobre la tolerancia al impacto: el enfoque ejecutivo
Los miembros del consejo de administración y los organismos reguladores se centran principalmente en una cuestión fundamental: ¿puede la organización mantener los servicios dentro de los límites de tolerancia al impacto definidos durante las interrupciones? Este enfoque específico determina la estructura y el contenido de unos informes eficaces sobre resiliencia operativa.
Los informes sobre la tolerancia al impacto deben demostrar claramente la capacidad de la organización para mantener los servicios críticos para el negocio (CBS). Un informe eficaz sobre resiliencia operativa contiene tres secciones esenciales que ofrecen una visión completa del estado de Readiness de la organización:
- Resumen del estado de los CBS: esta sección ofrece una representación visual clara de la situación actual de cada servicio crítico en relación con su umbral de tolerancia. Utilice indicadores tipo semáforo (rojo/ámbar/verde) para mostrar si los servicios operan dentro de los límites de tolerancia, se acercan a ellos o superan los límites aceptables.
- Pruebas que avalan la fiabilidad: documente la evidencia de que todos los planes de recuperación se someten a una validación periódica mediante pruebas automatizadas. Incluya métricas como las tasas de éxito de Commvault Cleanroom, la frecuencia de las pruebas y los tiempos de recuperación alcanzados. Esta evidencia demuestra no solo la capacidad teórica, sino también un rendimiento contrastado.
- Hoja de ruta de corrección: Presente un resumen priorizado de los riesgos identificados y los recursos necesarios para subsanar las deficiencias de resiliencia. Céntrese en las mejoras de gran impacto que afectan directamente al cumplimiento de los umbrales de tolerancia del CBS, con plazos claros y asignación de responsabilidades.
El papel de las operaciones de resiliencia (ResOps) en la medición
ResOps transforma los datos fragmentados en información unificada que impulsa mejoras cuantificables en la resiliencia de la organización. Al romper los silos tradicionales entre los equipos de seguridad, operaciones de TI y continuidad del negocio, ResOps ofrece una visión global del estado de la resiliencia.
Fuente de datos unificada
ResOps consolida las métricas de sistemas dispares en una única fuente de información fiable. Esta integración aborda el reto que, según el 77 % de las organizaciones, supone la falta de integración de herramientas, lo que dificulta la detección de amenazas. Al extraer datos de sistemas de copia de seguridad, gestión de identidades, herramientas de seguridad y plataformas de coordinación de la recuperación, ResOps proporciona una visibilidad completa del estado de Readiness en materia de resiliencia.
Garantía automatizada
Las pruebas automatizadas continuas a través de capacidades como Commvault Cleanroom proporcionan datos MTCR verificados que resisten el escrutinio normativo. Esta automatización transforma las pruebas de ejercicios periódicos en una validación continua, y algunas organizaciones ya pueden realizar pruebas de recuperación mensualmente si así lo desean.
La automatización también simplifica los datos técnicos complejos y los convierte en información útil para los directivos. En lugar de presentar registros de Recovery sin procesar, las plataformas ResOps generan informes claros que muestran si cada CBS puede recuperarse dentro de su tolerancia definida, respaldados por pruebas con marca de tiempo procedentes de pruebas reales.
Estrategias para la elaboración de informes sobre resiliencia
La elaboración de informes de resiliencia eficaces requiere adaptar el contenido y la presentación a cada público, manteniendo al mismo tiempo la coherencia en los datos subyacentes. Los paneles de control para directivos deben equilibrar una cobertura exhaustiva con la claridad, proporcionando información útil sin abrumar con detalles excesivos.
Las distintas partes interesadas necesitan perspectivas diferentes sobre los datos de resiliencia. Los altos directivos necesitan análisis de tendencias y resúmenes de exposición al riesgo; los auditores requieren pruebas detalladas y mapas de cumplimiento; las unidades de negocio quieren conocer las capacidades de recuperación específicas de cada servicio y sus dependencias.
Una comunicación coherente fomenta la responsabilidad en toda la organización. Los ciclos de información periódicos, las métricas estandarizadas y la asignación clara de responsabilidades crean una cultura en la que la resiliencia se convierte en responsabilidad de todos, y no solo del departamento de TI.
Estructura del panel de control ejecutivo
El siguiente esquema describe los componentes esenciales de un panel de control ejecutivo completo con frecuencias de actualización adecuadas:
| Categoría de datos | Métricas clave | Formato visual | Frecuencia de actualización |
| Estado de CBS |
• Servicios dentro de los límites de tolerancia • Estado de las dependencias críticas • Puntuaciones de riesgo de terceros |
Mapa de calor con estado RAG | En tiempo real |
| Preparación para la recuperación |
• MTCR por nivel de servicio • Índices de éxito de las pruebas • Tiempo transcurrido desde la última validación |
Gráficos de tendencias | Semanal |
| Panorama de amenazas |
• Amenazas activas detectadas • Rendimiento del TTD • Exposición a vulnerabilidades |
Diagrama de radar de riesgos | Diario |
| Estado de cumplimiento |
• Requisitos normativos cumplidos • Cierre de los informes de auditoría • Actualidad de las pruebas |
Cuadro de mando de cumplimiento | Mensual |
| Impacto de la inversión |
• Gasto en resiliencia frente al presupuesto • Rentabilidad de la inversión en automatización • Indicadores de ahorro de costes |
Cuadro de mando financiero | Trimestral |
Estrategias para mejorar la resiliencia operativa
Desarrollar la resiliencia requiere enfoques sistemáticos que combinen una planificación proactiva, una validación periódica y una mejora continua basada en las lecciones aprendidas en la práctica.
Los ejercicios de simulación siguen siendo fundamentales para poner a prueba los procedimientos de respuesta sin interrumpir las operaciones. Estas simulaciones deben reflejar la información actual sobre amenazas, con escenarios basados en incidentes reales que hayan afectado a organizaciones similares. Es importante incluir a terceros en los ejercicios, ya que dos tercios de las interrupciones del servicio de las que se informa públicamente se deben a fallos de proveedores externos.
Las revisiones posteriores a los incidentes transforman los fallos en oportunidades de aprendizaje. Las organizaciones deben ir más allá de la búsqueda de culpables para comprender los problemas sistémicos; el 85 % de las interrupciones graves debidas a errores humanos se deben a que el personal no sigue los procedimientos o a fallos en los procesos.
Guía de implementación para la mejora de la resiliencia
Esta guía de implementación ofrece un enfoque estructurado para desarrollar y mantener capacidades de resiliencia con una responsabilidad clara y criterios de éxito definidos.
| Estrategia | Actividades | Calendario | Responsabilidad | Indicadores de éxito |
| Simulaciones de mesa |
• Escenarios trimestrales centrados en el CBS• Simulación anual a nivel de toda la empresa• Participación de terceros |
1.º trimestre: Planificación ; 2.º–4.º trimestre: Ejecución |
Dirigido por el CISO/CRO; participan los responsables de negocio |
• Todos los CBS se someten a pruebas anualmente • Mejora del tiempo de respuesta • Índice de subsanación de deficiencias |
| Evaluaciones de proveedores |
• Puntuación de riesgo de todos los proveedores críticos • Revisión de las pruebas de resiliencia • Establecimiento de acuerdos de nivel de servicio (SLA) de rendimiento |
Ciclos continuos | Adquisiciones + Gestión de riesgos |
• Visibilidad del riesgo de los proveedores • Índices de cumplimiento de los SLA • Readiness de proveedores alternativos |
| Simulaciones de amenazas |
• Ejercicios de «equipo rojo»• Simulacros de ataques de ransomware• Validación de Recovery |
Mensual | Operaciones de seguridad |
• Precisión en la detección• Rapidez en la contención• Verificación de la Recovery |
| Mejora continua |
• Revisiones posteriores a los incidentes• Análisis de tendencias de métricas• Optimización de procesos |
A las pocas horas de producirse los incidentes | Equipo de resiliencia |
• Reducción de la repetición de incidentes• Mejora del MTCR• Adopción de la automatización |
Cuando el ransomware atacó: la historia de la Recovery de una empresa líder en logística
Una empresa de logística global con presencia en más de 200 ubicaciones descubrió que la resiliencia operativa no es algo teórico cuando el ransomware cifró sus datos de producción y su infraestructura de copias de seguridad. El ataque dejó los camiones parados y a los clientes a la espera, pero las decisiones estratégicas tomadas meses antes permitieron una recuperación al menos dos semanas más rápida de lo que habría sido posible de otro modo.
El ingeniero de sistemas sénior de la empresa reflexiona sobre la experiencia: «Hay que contar con que se produzca una brecha de seguridad. No es cuestión de “si”, sino de “cuándo”».
El reto: la protección fragmentada se enfrenta a un ataque real
Las frecuentes adquisiciones habían obligado al equipo de TI a gestionar múltiples soluciones de protección de datos en toda su infraestructura de nube híbrida, que incluía Microsoft 365, SQL, Oracle, Sybase, OneDrive, SharePoint, Active Directory, servidores de archivos y máquinas virtuales. La empresa había comenzado a consolidarse a nivel mundial con Commvault Cloud, una solución que ayuda a simplificar la gestión y Recovery.
Cuando se produjo el ataque de ransomware, este cifró todos los datos de producción y dejó fuera de servicio CommServe y MediaAgents. Los atacantes habían comprometido tanto los sistemas principales como las copias de seguridad. Sin embargo, una decisión clave resultó vital: la empresa había almacenado una copia de seguridad para la recuperación ante desastres de su CommServe en Commvault Cloud, separada de su infraestructura local, lo que contribuyó a respaldar el esfuerzo de recuperación.
La respuesta: Recovery de los sistemas críticos en 72 horas
El equipo de TI se puso inmediatamente en contacto con el servicio de asistencia de Commvault y con el equipo de Servicios de Respuesta a Incidentes, disponible las 24 horas del día, los 7 días de la semana. En primer lugar, el servicio de asistencia restauró la base de datos de CommServe desde la nube, lo que permitió al equipo reconstruir su servidor local y los tres MediaAgents. A continuación, el equipo de Respuesta a Incidentes tomó el relevo, trabajando con una lista de aplicaciones clasificadas según su impacto en el negocio.
«Contamos con un equipo de ingenieros de Commvault que apoyó a nuestro equipo día y noche en la recuperación de nuestros sistemas», afirmó el ingeniero de sistemas sénior. «Tuvieron en cuenta nuestras prioridades y nos asesoraron sobre las mejores prácticas para restaurar los sistemas lo más rápidamente posible. Fue una auténtica colaboración».
Los sistemas más críticos volvieron a estar operativos en un plazo de 72 horas desde la intervención del equipo de Respuesta a Incidentes. El resto de los sistemas de producción se recuperaron en el plazo de una semana, lo que permitió reanudar las entregas y contribuyó a minimizar las molestias para los clientes minoristas y los clientes finales.
El impacto: valor cuantificado de Recovery
El director de Infraestructura y Operaciones de TI estima que, sin la intervención de Commvault, el tiempo de inactividad se habría prolongado al menos dos semanas. La empresa evitó tener que pagar el rescate del ransomware y mantuvo sus operaciones, protegiendo tanto los ingresos como las relaciones con los clientes.
Este incidente real corrobora las métricas de resiliencia mencionadas anteriormente. El MTCR de la empresa para los sistemas críticos se situó en 72 horas, un resultado significativamente mejor que el habitual en los ataques de ransomware.
Lecciones aplicadas: refuerzo de la resiliencia futura
Tras el incidente, la empresa implementó varias mejoras basadas en las lecciones aprendidas. Documentó un plan de Recovery exhaustivo, amplió las copias de seguridad a la nube y a diversos soportes, y verificó la finalización de las copias de seguridad mediante pruebas exhaustivas.
Desde entonces, la empresa de logística ha estandarizado el uso de Commvault a nivel mundial, incorporando Commvault Grid para obtener Backup and Recovery de alto rendimiento, una protección mejorada contra el ransomware y una mayor escalabilidad. También incorporó los Servicios de Gestión Remota para la supervisión 24/7, la resolución de incidencias y el análisis anual del estado y la seguridad.
«Commvault Cloud es ahora nuestra solución de ciberresiliencia a nivel mundial», afirmó el director de Infraestructura y Operaciones de TI. «Cuando se produjo la brecha de seguridad, Commvault salió airosa y se ganó mi confianza. Son un verdadero socio, no un simple proveedor».
Soluciones de Commvault para la resiliencia operativa
La plataforma de protección de datos de Commvault ayuda a abordar los retos de medición, generación de informes y mejora a los que se enfrentan las organizaciones a la hora de desarrollar la resiliencia operativa. La arquitectura unificada de la plataforma puede ayudar a reducir la fragmentación que dificulta los esfuerzos de resiliencia, lo que contribuye a proporcionar visibilidad y control en entornos híbridos.
Las funciones de copia de seguridad automatizadas ayudan a reducir los errores humanos, al tiempo que mantienen la coherencia en infraestructuras diversas. Gracias a las funciones integradas de validación y pruebas, las organizaciones adquieren la confianza de que la Recovery se llevará a cabo con éxito cuando sea necesario. La capacidad de la plataforma para automatizar entre 50 y más de 100 pasos en recuperaciones complejas, como la restauración de un bosque de Active Directory, ayuda a transformar procesos manuales de varios días en recuperaciones coordinadas que duran unas pocas horas.
Las características de portabilidad en la nube permiten a las organizaciones mantener la resiliencia en entornos de infraestructura cambiantes. Ya sea para proteger aplicaciones SaaS, cargas de trabajo nativas de la nube o sistemas tradicionales locales, Commvault está diseñado para proporcionar capacidades consistentes de protección y Recovery que se adaptan a las necesidades empresariales.
Cuadro de mando de rendimiento de Commvault
Este cuadro de mando describe los objetivos clave de rendimiento y los métodos de validación de las capacidades fundamentales de resiliencia de Commvault.
| Capacidad | Objetivo de rendimiento | Impacto empresarial | Método de validación |
| Copia de seguridad automatizada |
• Alta tasa de éxito • Operaciones sin intervención humana • Protección basada en políticas |
Ayuda a reducir los fallos en las copias de seguridad. Ayuda a reducir los errores manuales. Ayuda a escalar sin necesidad de personal adicional |
Métricas del panel de control Registros de auditoría Informes de cumplimiento normativo |
| Pruebas de recuperación |
• Posibilidad de validación mensual • Orquestación automatizada • Verificación de una Recovery impecable |
Ayuda a demostrar la Readiness para la Recovery Ayuda a cumplir los requisitos normativos Ayuda a identificar deficiencias de forma proactiva |
Informes de pruebas Certificados de Recovery Evidencia con marca de tiempo |
| Portabilidad en la nube |
• Compatibilidad con múltiples nubes• Recovery multiplataforma• Movilidad de las cargas de trabajo |
Ayuda a evitar la dependencia de un único proveedor. Ayuda a garantizar la flexibilidad en la recuperación ante desastres. Ayuda a respaldar la transformación |
Éxito de la migración. Escenarios de Recovery. Optimización de costes |
La medición y la elaboración de informes sobre la resiliencia operativa transforman conceptos abstractos en información útil que los consejos de administración, los organismos reguladores y los equipos operativos pueden utilizar para tomar decisiones fundamentadas. Las organizaciones que prosperan ante las perturbaciones son aquellas que tratan la resiliencia como una disciplina continua, no como un proyecto puntual.
Términos relacionados
Continuidad del negocio y recuperación ante desastres
Un enfoque integral que combina la planificación de la continuidad del negocio con capacidades de Recovery ante desastres para mantener las operaciones críticas durante y después de las interrupciones.
Recuperación ante desastres
El proceso de restablecer la infraestructura y las operaciones de TI de una organización tras una interrupción grave, con el fin de minimizar el impacto y restablecer rápidamente las operaciones normales.
RTO (objetivo de tiempo de recuperación) y RPO (objetivo de punto de recuperación)
Métricas fundamentales que definen el tiempo máximo aceptable para la recuperación y la pérdida máxima aceptable de datos en la planificación de la recuperación ante desastres.
Preguntas frecuentes
¿Qué es la resiliencia operativa y en qué se diferencia de la continuidad del negocio?
La resiliencia operativa es la capacidad de prevenir, adaptarse, responder y recuperarse ante interrupciones, al tiempo que se siguen prestando los servicios empresariales críticos. A diferencia de la continuidad del negocio tradicional, que a menudo se centra en escenarios específicos, la resiliencia operativa adopta una visión más amplia y de extremo a extremo de los servicios, las dependencias y los niveles de tolerancia al impacto.
¿Cuáles son los cinco pilares de la resiliencia operativa?
Los cinco pilares son: la taxonomía de servicios y los umbrales de tolerancia al impacto, el mapeo de dependencias, las pruebas de escenarios, la respuesta y Recovery, y la gobernanza con mejora continua.
¿Cuál es la diferencia entre las métricas de resiliencia y los KPI?
Las métricas son datos brutos, como el tiempo de detección o el tiempo medio de Recovery completa, que miden actividades operativas específicas. Los KPI son indicadores seleccionados estratégicamente a partir de esas métricas que se alinean directamente con los objetivos empresariales y las expectativas normativas.
¿Por qué es tan importante la presentación de informes sobre la tolerancia al impacto para los consejos de administración y los organismos reguladores?
Los consejos de administración y los organismos reguladores se centran en si una organización puede mantenerse dentro de los límites de impacto definidos durante las interrupciones. Una presentación de informes eficaz puede ayudar a proporcionar pruebas claras —a través de cuadros de mando, resultados de pruebas y planes de corrección— de que los servicios empresariales críticos pueden seguir funcionando dentro de límites aceptables.
¿Qué papel desempeña ResOps en la mejora de la medición y la presentación de informes?
ResOps unifica los datos procedentes de la seguridad, las operaciones de TI, los sistemas de copia de seguridad y las herramientas de recuperación en una única fuente de información fiable. Esta integración permite la verificación automatizada, las pruebas continuas y la elaboración de informes listos para la alta dirección, lo que refuerza la toma de decisiones y la rendición de cuentas.
¿Cómo pueden las organizaciones mejorar de forma práctica su resiliencia operativa con el tiempo?
Las organizaciones pueden llevar a cabo ejercicios de simulación periódicos, realizar evaluaciones de riesgos de los proveedores, ejecutar simulaciones de amenazas e implementar revisiones estructuradas tras los incidentes. En combinación con el seguimiento continuo de las métricas y la automatización, estas acciones contribuyen a lograr mejoras cuantificables en la velocidad de recuperación, el éxito de las pruebas y la madurez general de la resiliencia.
Recursos relacionados
Construir la IA sobre una base de resiliencia
ResOps: el futuro de los negocios resilientes en la era de la IA