El Niño también puede apagar los negocios: empresas enfrentan riesgo de fallas tecnológicas simultáneas, ¿cómo evitarlo?

Costos invisibles. Las caídas pueden perfectamente estropear las transacciones en la banca, ventas en el comercio y líneas de producción en la manufactura

tecnología
Las empresas calculan los costos de las interrupciones operativas en lapsos de cuatro, ocho y 24 horas.
Guardar

Una interrupción eléctrica, la pérdida de conectividad y la inaccesibilidad de una sede pueden ocurrir al mismo tiempo durante un eventual fenómeno de El Niño.

Ese escenario puede comprometer aplicaciones, bases de datos, ventas digitales y procesos operativos de las empresas, según advirtió Diego Ossa, CEO de SOLA (Sur de Latam) de Stefanini Group.

PUBLICIDAD

Una caída tecnológica puede paralizar operaciones en varios sectores

Los efectos de una emergencia climática suelen asociarse con daños en carreteras, instalaciones, transporte y redes eléctricas. Para las compañías que dependen de sistemas digitales, las consecuencias también alcanzan a los servicios tecnológicos que sostienen su operación diaria.

En banca, una caída de sistemas puede impedir el procesamiento de transacciones. En retail, puede frenar ventas presenciales o por internet. En manufactura, una interrupción puede detener líneas de producción; y en logística, dificultar el despacho o el rastreo de mercancías.

MTC - carreteras - obras - El Niño - construcción
La dependencia de un solo proveedor o centro de datos crea un punto único de falla en las organizaciones.

El impacto depende del proceso afectado y del tiempo que dure la interrupción. Por esa razón, Ossa señaló que las empresas deben definir cuánto tiempo pueden mantener detenida una operación crítica y qué efectos tendría una caída de cuatro, ocho o 24 horas.

PUBLICIDAD

“Antes de preguntarnos cuánto cuesta implementar resiliencia, deberíamos preguntarnos cuánto tiempo puede permitirse el negocio estar detenido y qué impacto tendría esa interrupción”, sostuvo el ejecutivo.

Los puntos únicos de falla elevan el riesgo ante una emergencia

El principal riesgo aparece cuando una función crítica depende de un único elemento. Puede ser un centro de datos, un proveedor de telecomunicaciones, una sede física, una aplicación o una fuente de energía.

Si ese recurso queda fuera de servicio y no existe una alternativa, la organización puede perder la capacidad de atender clientes, procesar pagos, acceder a información o coordinar sus actividades. La situación se agrava cuando la contingencia afecta también a proveedores externos.

Billetes de dólar y un trozo de papel manuscrito con el texto Auxilio Económico sobre el teclado de una computadora portátil.
La migración a la nube requiere una arquitectura que distribuya cargas de trabajo entre distintos entornos.

“Estos fenómenos deben abordarse como un riesgo de continuidad del negocio, no únicamente como una contingencia física o tecnológica”, explicó Ossa.

“Una empresa puede estar preparada para un corte eléctrico, pero ¿qué sucede si al mismo tiempo pierde conectividad, una sede queda inaccesible y uno de sus proveedores críticos también se ve afectado?”, agregó.

La nube no garantiza continuidad si la arquitectura carece de redundancias

La discusión tecnológica suele plantearse como una elección entre infraestructura propia, conocida como on-premise, y servicios en la nube. Sin embargo, la continuidad depende del diseño general de los sistemas y de la capacidad para distribuir datos, cargas de trabajo y aplicaciones entre distintos entornos.

“La nube puede ser una herramienta importante para aumentar la resiliencia, pero migrar a cloud por sí solo no garantiza la continuidad. Lo determinante es cómo está diseñada y gestionada la arquitectura completa”, afirmó el directivo.

La infraestructura híbrida combina capacidades instaladas en las empresas, servicios en la nube y recursos ubicados cerca de los puntos de operación, también llamados edge. El objetivo es reducir la dependencia de un único entorno tecnológico y mantener funciones prioritarias ante una interrupción.

La respuesta ante emergencias combina prevención, recuperación, automatización, gobernanza y simulaciones.
La respuesta ante emergencias combina prevención, recuperación, automatización, gobernanza y simulaciones.

Prevención, recuperación, automatización y gobernanza

Ossa identifica cuatro frentes para reforzar la resiliencia tecnológica. El primero es la prevención, que requiere identificar los procesos críticos y las dependencias que pueden convertirse en puntos únicos de falla.

El segundo es la recuperación, con redundancias en energía, conectividad, infraestructura y datos, de acuerdo con la criticidad de cada operación. El tercero se vincula con la automatización de respuestas, que puede reducir el tiempo necesario para restablecer servicios. El cuarto es la gobernanza, que define responsables, prioridades y protocolos de actuación.

Las simulaciones también forman parte de esa preparación. “Un plan de continuidad que nunca ha sido sometido a una simulación sigue siendo, en gran medida, una hipótesis”, advirtió Ossa.

La inteligencia artificial permite detectar señales tempranas de incidentes

Las herramientas de observabilidad y AIOps permiten correlacionar registros, métricas y eventos tecnológicos para identificar comportamientos anómalos antes de que deriven en una falla mayor.

El objetivo no es evitar por completo las interrupciones, sino mejorar la detección temprana y acortar los tiempos de respuesta. La recomendación es mapear los procesos que deben mantenerse operativos, junto con los sistemas, datos, personas, proveedores e infraestructura de los que dependen.

A partir de esa revisión, cada empresa puede definir cuánto tiempo puede permanecer inactivo un proceso, cuánta información puede perder y qué mecanismos necesita para recuperar sus operaciones.

PUBLICIDAD

PUBLICIDAD