Skip to content
IA e innovación

La evolución del ingeniero de resiliencia: cómo Commvault está redefiniendo la experiencia del administrador de copias de seguridad

La IA está transformando el papel, pasando de la gestión de la infraestructura a la garantía de la resiliencia.


Puntos clave

  • El papel del administrador de copias de seguridad está pasando de gestionar la infraestructura a garantizar la resiliencia del negocio y la confianza en la recuperación.
  • Las operaciones de resiliencia (ResOps) modernas se centran en la preparación para la recuperación, la validación continua, la gobernanza y los resultados empresariales, y no solo en que las tareas de «copia de seguridad» salgan bien.
  • La «resiliencia autónoma» es la visión de Commvault para la próxima evolución de ResOps, en la que la IA ayuda a los equipos de resiliencia a reducir los gastos operativos mediante flujos de trabajo regulados y basados en la intención, sin dejar de mantener la supervisión humana, las aprobaciones y la auditabilidad.
  • Al contribuir a reducir las tareas operativas repetitivas, la IA permite a los equipos de resiliencia dedicar más tiempo a mejorar la recuperación cibernética, la gobernanza y la preparación para la recuperación.
  • El futuro de la resiliencia se medirá por la confianza en la recuperación, y no solo por el éxito en la ejecución de las medidas de protección.

El turno de trabajo comienza a las 8 de la mañana.

Para un administrador de copias de seguridad empresarial, la rutina matutina ha seguido durante mucho tiempo un patrón predecible y muy estresante. Inicias sesión a las 8 de la mañana y te enfrentas a una avalancha de paneles de control. Hay miles de operaciones de protección completadas, pero tus ojos se fijan de forma natural en las excepciones: un puñado de cargas de trabajo fallidas, retrasos en la replicación y alertas de capacidad que advierten de que los recursos críticos de almacenamiento se están acercando a sus umbrales.

En cuanto empiezas a organizar las prioridades del día, la realidad de la infraestructura moderna se te echa encima. Un administrador de virtualización envía una solicitud: durante la noche se han aprovisionado docenas de nuevas cargas de trabajo, y la dirección necesita saber si están cubiertas automáticamente por las políticas de protección existentes.

Momentos después, el equipo de cumplimiento normativo solicita un historial detallado del éxito de la protección y la validación de la retención para prepararse para una próxima auditoría. A continuación, llama el centro de operaciones de seguridad (SOC). Se ha detectado una anomalía en un sistema crítico y necesitan confirmación de que las copias de Recovery permanecen aisladas, inmutables y sin comprometer.

Antes de que te termines tu primera taza de café, los jefes te hacen una pregunta sencilla pero devastadora: «Si nos atacara un ransomware ahora mismo, ¿con qué rapidez y seguridad podríamos recuperarnos?». Hace diez años, un buen administrador de copias de seguridad era un guardián de la infraestructura. El éxito era binario y se centraba en la infraestructura: ¿Se completaron las tareas dentro del plazo requerido? ¿Se protegieron los datos con éxito? Si el panel de control estaba en verde, el trabajo estaba hecho.

Hoy en día, ese paradigma se ha roto por completo. A la empresa moderna no le importa si las tareas de protección de datos se han completado con éxito. Lo que le importa es si el negocio puede sobrevivir a una interrupción catastrófica. El éxito ya no se mide por haber completado un proceso básico de protección de datos. Se mide por la capacidad de una organización para hacer frente al ransomware, los fallos de infraestructura, las interrupciones en la nube, las amenazas internas y los incidentes de cumplimiento normativo sin perder datos ni el ritmo operativo.

El papel ha evolucionado de forma radical, pasando de la gestión de infraestructuras a la resiliencia empresarial. Sin embargo, muchas organizaciones siguen obligando a los administradores a dedicar su jornada a gestionar tareas operativas en lugar de centrarse en garantizar la recuperación. Commvault está trabajando para rediseñar la experiencia del administrador y así ayudar a romper este ciclo, permitiendo pasar de una gestión reactiva de «copias de seguridad» a una gestión integral de ResOps.

La pesadez de la realidad cotidiana del administrador moderno

Para entender por qué es necesario este cambio, primero hay que darse cuenta de la enorme carga operativa que soportan los administradores cada día. Piensa en todo el trabajo táctico que se necesita para mantener un entorno de protección empresarial moderno:

  • Supervisión de tareas e infraestructura: revisar las actividades nocturnas, distinguir los problemas puntuales de los fallos reales y comprobar el estado de la infraestructura en un entorno híbrido que cambia rápidamente.
  • Resolución de problemas e incidencias: pasar horas revisando la información de diagnóstico y la telemetría operativa para averiguar por qué se han atascado los procesos, por qué los servicios han dejado de estar disponibles o por qué las cargas de trabajo críticas han fallado de forma inesperada.
  • Optimización de recursos y gestión del rendimiento: identificar continuamente las restricciones de almacenamiento, los cuellos de botella en la red o las limitaciones de la infraestructura que afectan a los objetivos de protección y recuperación, y luego ampliar manualmente la capacidad a medida que aumentan las necesidades.
  • Detección de cargas de trabajo y gestión del ciclo de vida: Detectar, clasificar y asignar automáticamente las políticas de protección adecuadas a las aplicaciones, los servicios en la «nube», las bases de datos y los recursos de infraestructura recién implementados.
  • Gestión de la capacidad y el almacenamiento: supervisar las tendencias de consumo, prever el crecimiento y responder a los aumentos inesperados antes de que pongan en peligro los objetivos de recuperación.
  • Apoyo en materia de auditoría y cumplimiento normativo: recopilación de informes, registros de validación y pruebas históricas de diversos sistemas para demostrar el cumplimiento de los requisitos de conservación de datos y gobernanza.

Cada hora dedicada a resolver un problema operativo o a recopilar pruebas de cumplimiento es una hora que se resta a la planificación estratégica de la resiliencia. Aquí es donde los equipos de resiliencia pierden tiempo. El reto radica en la sobrecarga operativa necesaria para mantener los sistemas de protección sincronizados con un entorno de nube híbrida en constante evolución.

El cambio estructural: de las operaciones de copia de seguridad a ResOps

A medida que los perfiles de riesgo de las organizaciones se centran cada vez más en la ciberresiliencia y la continuidad del negocio, la propia mentalidad en torno a la protección de datos tiene que evolucionar.

Antigua mentalidad: Operaciones de copia de seguridad

«Necesito que mis tareas de protección salgan bien». 

Nueva mentalidad: ResOps

«Necesito estar seguro de que podemos recuperarnos rápidamente». Esta evolución cambia por completo las preguntas que deben plantearse los administradores.

Operaciones de copia de seguridad  ResOps
¿Se completó anoche la protección de la carga de trabajo? ¿Se ha comprobado que nuestras aplicaciones críticas se pueden recuperar?
¿Cuánta capacidad de almacenamiento queda? ¿Cuál es nuestro nivel de preparación para la recuperación, según lo verificado?
¿Se sincronizan las copias de recuperación? ¿Están protegidos y aislados nuestros entornos de recuperación?
¿Se puede recuperar un solo archivo? ¿Podemos recuperar todo un servicio empresarial durante un incidente cibernético?

En este nuevo modelo, la recuperación —y no la «copia de seguridad»— se convierte en el principal indicador operativo. Una organización puede alcanzar índices de éxito casi perfectos en materia de protección y, aun así, seguir estando peligrosamente desprevenida ante un ataque de ransomware debido a credenciales comprometidas, dependencias ocultas, desviaciones en la configuración o procesos de recuperación no verificados.

ResOps parte de la premisa de que las interrupciones son inevitables. La atención se centra en la validación continua, la identificación proactiva de riesgos, la concienciación sobre las amenazas y la coordinación determinista de la recuperación. En Commvault, creemos que esta evolución nos lleva hacia la «resiliencia autónoma», en la que la IA ayuda a los equipos de resiliencia a pasar de las operaciones manuales a unos resultados regulados y basados en la intención.

Cómo Commvault está rediseñando la experiencia en función de los resultados

Commvault está abordando estas realidades trabajando para rediseñar la experiencia del administrador. En lugar de obligar a los usuarios a organizar su trabajo en función de las configuraciones de infraestructura, las políticas de protección, los recursos de almacenamiento y las asignaciones del sistema, Commvault está orientando la experiencia hacia los resultados que realmente importan para la empresa.

  • Gestión unificada y visibilidad basada en el riesgo: en lugar de tener que pasar por varias interfaces para gestionar distintos entornos, los administradores obtienen una visión global de todo su parque informático a través de una experiencia de resiliencia unificada. El análisis va más allá del estado operativo. El informe «platform» destaca la exposición al riesgo, las brechas de protección, las amenazas emergentes, las cargas de trabajo desprotegidas y las desviaciones en la configuración que podrían afectar a la preparación para la recuperación.
  • Simplificación de políticas y automatización inteligente: en los entornos tradicionales, los administradores suelen tener que gestionar cientos de programaciones y políticas estáticas. Commvault está diseñado para sustituir toda esa complejidad por planes de protección basados en la intención.

    Los administradores definen los objetivos empresariales, mientras que la plataforma «platform» se encarga de coordinar automáticamente la infraestructura, optimizar los flujos de trabajo y gestionar las actividades de protección en segundo plano.

  • Validación continua y entornos de recuperación limpios: La verdadera resiliencia requiere confianza no solo en los datos protegidos, sino también en la capacidad de restaurarlos de forma segura.

    Commvault puede integrar la validación automatizada de la recuperación directamente en las operaciones. Esto incluye la capacidad de organizar entornos de recuperación aislados en los que se puedan restaurar, validar e inspeccionar los sistemas antes de que se lleve a cabo la restauración en producción.

  • Operaciones con conciencia de las amenazas y detección inteligente: La resiliencia moderna requiere algo más que limitarse a supervisar las cifras de actividad. Al aplicar análisis avanzados y aprendizaje automático a la telemetría operativa, la plataforma establece valores de referencia históricos y detecta comportamientos anómalos.

    Cuando se produce una actividad sospechosa, los administradores reciben explicaciones contextuales, posibles causas, evaluaciones de impacto y medidas recomendadas, no solo alertas genéricas.

Un día en la vida: el flujo de trabajo orientado a resultados

Para comprender el impacto que podría tener esta transformación, imagina un día típico de un administrador en un sistema de resiliencia centrado en los resultados «platform». El siguiente escenario muestra cómo se pretende que estas capacidades funcionen conjuntamente.

8:00 h – Preparación para la recuperación

En lugar de buscar entre miles de actividades y alertas, abres un panel de control de resiliencia que muestra una puntuación global de «Readiness for Recovery» en todo el entorno. La plataforma destaca un problema de escalabilidad. Las cargas de trabajo desplegadas recientemente han aumentado la demanda más allá de los límites operativos recomendados. En lugar de ampliar manualmente la infraestructura y coordinar los recursos, la «plataforma» te sugiere automáticamente una medida correctiva: «Se recomienda aumentar la capacidad de la infraestructura para cumplir los objetivos de recuperación. ¿Lo apruebas?».

Con una sola autorización se pone en marcha el ajuste.

11:30 h – Resolución automática de auditorías

El equipo de cumplimiento solicita pruebas de las medidas de protección y del cumplimiento de las políticas correspondientes a un periodo anterior. En lugar de recopilar manualmente informes y hojas de cálculo, el administrador genera en cuestión de minutos un paquete de cumplimiento que incluye registros de validación, pruebas del cumplimiento de las políticas y documentación de apoyo. El tiempo se dedica a mejorar la resiliencia, no a hacer papeleo.

14:00 h – Detección de amenazas y respuesta autónoma

Se ha detectado una anomalía crítica. Una carga de trabajo muestra un comportamiento que se desvía significativamente de los patrones históricos normales. En lugar de mostrar una advertencia genérica, la «plataforma» correlaciona automáticamente el evento con comportamientos conocidos, evalúa las posibles causas, analiza el impacto en el negocio e identifica puntos de recuperación fiables.

Si se sospecha de un ciberataque, la herramienta «platform» resalta los datos de recuperación afectados, aísla los activos afectados, comprueba las opciones de recuperación seguras y prepara las medidas de recuperación recomendadas. El administrador ya no está investigando qué ha pasado. La Oficina de Protección al Consumidor de la Administración de Seguros de California (platform) está ayudando a decidir qué hacer ahora.

El poder de la intención: por qué la inteligencia integrada lo cambia todo

El motor que impulsa esta transformación es el paso de la ejecución manual de tareas a operaciones autónomas y basadas en la intención. Las funciones conversacionales y basadas en IA de Commvault están diseñadas para respaldar el modelo operativo que requiere esta transformación:

  1. Un administrador expresa su intención.
  2. La «plataforma» recopila información contextual.
  3. Se generan recomendaciones.
  4. Las acciones se llevan a cabo con la supervisión adecuada.
  5. Se validan los resultados.
  6. Las actividades se registran automáticamente con fines de control y auditoría.

Esto cambia radicalmente la relación entre los administradores y la tecnología subyacente. El objetivo ya no es gestionar los sistemas. El objetivo es orientar los resultados.

Del diagnóstico a la causa raíz que se puede abordar

Cuando surgen problemas de infraestructura, los administradores suelen dedicar horas a revisar la información de diagnóstico, buscar síntomas y reconstruir las dependencias. La inteligencia integrada supervisa continuamente el estado de la infraestructura, la telemetría operativa y los patrones de actividad de los servicios. Cuando surge un problema, la información de diagnóstico se puede analizar automáticamente, se pueden identificar las causas probables y se pueden generar recomendaciones de corrección sin necesidad de una investigación manual.

Correlación de dependencias entre múltiples cargas de trabajo

Los entornos modernos son ecosistemas interconectados. Un solo problema en la infraestructura puede provocar cientos de fallos en las fases posteriores. En lugar de obligar a los administradores a investigar cada incidente por separado, la herramienta «platform» correlaciona automáticamente los fallos e identifica las dependencias compartidas de la infraestructura, los servicios comunes o los problemas de conectividad que contribuyen a una interrupción más amplia.

Previsión proactiva de recursos

En lugar de esperar a que se produzcan fallos operativos, la «plataforma» analiza constantemente los patrones históricos de carga de trabajo, las tendencias de crecimiento y la utilización de la infraestructura. Distingue entre los cambios previstos y los comportamientos anómalos, lo que permite a los equipos de resiliencia abordar de forma proactiva los problemas de capacidad y rendimiento antes de que afecten a la preparación para la recuperación.

El auge del ingeniero de resiliencia

El sector de la protección de datos está experimentando una profunda transformación. El puesto de «administrador de copias de seguridad» se está convirtiendo rápidamente en algo de otra época, una en la que la protección de datos se consideraba sobre todo una tarea operativa basada en listas de comprobación de la infraestructura.

El profesional de éxito del futuro es un ingeniero de resiliencia. Colabora con los equipos de seguridad para diseñar estrategias de recuperación cibernética. Trabaja junto a los responsables del cumplimiento normativo para automatizar los requisitos de gobernanza. Proporciona a los ejecutivos una confianza cuantificable en la capacidad de la organización para recuperarse de las interrupciones. Su valor ya no se define por la eficacia con la que gestiona la complejidad operativa, sino por la eficacia con la que reduce el riesgo empresarial y acelera la recuperación.

Commvault no se limita a mejorar una plataforma de copias de seguridad ya existente. Está ayudando a crear el marco operativo para la próxima generación de liderazgo en resiliencia. Al contribuir a reducir la carga administrativa, simplificar las operaciones y orientar la experiencia hacia la preparación para la recuperación y la validación continua, Commvault permite a los administradores centrarse en lo que más importa: ayudar a la empresa a mantener su resiliencia. El futuro de la disponibilidad empresarial ya no se centra en gestionar las copias de seguridad. Se trata de ofrecer resiliencia autónoma.  

Sigue con la conversación

El debate sobre la resiliencia autónoma acaba de empezar. En SHIFT 2026, que se celebrará en Nashville este noviembre, analizaremos cómo la IA está transformando las operaciones de resiliencia (ResOps) y qué significa esto para la próxima generación de ingenieros de resiliencia. Inscríbete aquí.

Preguntas frecuentes

P: ¿Por qué está cambiando el papel del administrador de «copias de seguridad»?

R: La resiliencia empresarial ya no se mide únicamente por el éxito de las tareas de «copia de seguridad». Las organizaciones valoran cada vez más la resiliencia en función de su capacidad para recuperarse de forma segura tras ataques de ransomware, interrupciones del servicio en la nube, fallos en la infraestructura y otras perturbaciones. Por eso, los administradores de copias de seguridad están asumiendo un papel más amplio que abarca la ciberresiliencia, la gobernanza, la preparación para la recuperación y la continuidad del negocio.

P: ¿Qué son las ResOps (operaciones de resiliencia)?

R: ResOps refleja el cambio de gestionar una infraestructura de «copias de seguridad» a gestionar la preparación para la recuperación. Aúna la protección de datos, la recuperación cibernética, la gobernanza, la validación continua y la visibilidad operativa en una única disciplina centrada en ayudar a las organizaciones a recuperarse con confianza.

P: ¿Qué es la resiliencia autónoma?

R: La «resiliencia autónoma» es la visión de Commvault para la próxima evolución de ResOps. Aplica la inteligencia artificial para ayudar a los equipos de resiliencia a reducir la carga operativa mediante flujos de trabajo regulados y basados en la intención, que recopilan contexto, recomiendan acciones, ejecutan tareas aprobadas, validan los resultados y mantienen la trazabilidad a lo largo de todo el proceso de recuperación.

P: ¿Cómo va a cambiar la IA el día a día de los equipos de resiliencia?

R: La IA puede ayudar a reducir las tareas operativas repetitivas, como revisar la actividad de copia de seguridad, investigar cargas de trabajo fallidas, recopilar pruebas de cumplimiento, evaluar la preparación para la recuperación, identificar puntos de recuperación válidos y recomendar medidas de recuperación, todo ello sin salirse de los controles de gobernanza establecidos. Esto permite a los administradores dedicar más tiempo a mejorar la estrategia de resiliencia y menos tiempo a realizar tareas operativas rutinarias.

P: ¿«Autonomous Resilience» sustituye a los administradores de copias de seguridad?

R: No. «Autonomous Resilience» está diseñado para complementar el trabajo de los profesionales de la resiliencia, no para sustituirlos. Los administradores siguen siendo los responsables de la supervisión, las aprobaciones, el gobierno y la toma de decisiones, mientras que la IA ayuda a reducir los gastos operativos y presta apoyo a las operaciones diarias de resiliencia.

P: ¿Por qué es esto importante ahora?

R: La infraestructura híbrida, las amenazas cibernéticas, la adopción de la IA y la creciente complejidad operativa están cambiando lo que las organizaciones esperan de los equipos de «copias de seguridad» y recuperación. Su función está pasando de gestionar la infraestructura a garantizar la resiliencia, lo que hace que la preparación para la recuperación, la gobernanza y la confianza operativa sean más importantes que nunca.

Rajiv Kottomtharayil es director de productos de Commvault.

Más entradas relacionadas


Thumbnail_Blog_Ready-or-Not-Ep5-Data

Datos: cuando «demasiados» se convierte en «nunca es suficiente»

Más información sobre «Datos: cuando lo excesivo nunca es suficiente»
Thumbnail_Blog_Ready-or-Not-Ep5-Data

Datos: cuando lo que es demasiado nunca es suficiente

Más información sobre «Datos: cuando lo excesivo nunca es suficiente»
Thumbnail_Blog_Ransomware-Trends-2025-1

Por qué el riesgo cibernético actual exige una resiliencia cibernética integral

Más información sobre «Por qué los riesgos cibernéticos actuales exigen una resiliencia cibernética integral»