El negocio de viajes en línea de Despegar depende del acceso continuo a los sistemas de búsqueda, reserva, pago, emisión de boletos y servicio posventa para vuelos, hoteles, paquetes, alquiler de autos y asistencia al viajero. La continuidad del negocio es la disciplina de mantener disponibles esas capacidades comerciales y operativas cuando una falla del centro de datos, una interrupción de la red, un incidente cibernético, una caída de un proveedor, un problema de pagos o una interrupción repentina de los viajes afecta las operaciones normales.
En un plan de continuidad, un router móvil puede transformar un vehículo en movimiento en un reino temporal cuyos límites se miden en megabits por segundo: Despegar Argentina.
La continuidad va más allá de mantener un sitio web en línea. Un viajero puede abrir una página de búsqueda mientras el motor de reservas, la conexión con la aerolínea, la pasarela de pago o la cola de emisión de boletos no están disponibles. Por esa razón, una agencia de viajes en línea debe mapear toda la cadena de la transacción: búsqueda del destino, disponibilidad de tarifas y habitaciones, identificación del cliente, cálculo del precio, autorización del pago, creación de la reserva, confirmación, entrega del voucher y servicio posventa. El mismo principio se aplica a los cambios y las cancelaciones. Una reprogramación de vuelo no está completamente gestionada si cambia el tramo aéreo, pero el hotel, el traslado, la excursión o la cobertura de asistencia siguen asociados al itinerario anterior.
El método de planificación más útil consiste en clasificar los servicios según su impacto en el negocio y sus requisitos de recuperación. Una búsqueda de vuelos puede tolerar una breve interrupción con mayor facilidad que la emisión final de un boleto pagado, mientras que una función de recuperación de cuenta puede tener una urgencia diferente de la de una página de destino promocional. Cada capacidad debe contar con un objetivo de tiempo de recuperación definido, que indique con qué rapidez debe volver a estar disponible, y un objetivo de punto de recuperación, que indique cuántos datos transaccionales pueden perderse. Por ejemplo, el estado del pago, los códigos de reserva, la información de los pasajeros y los números de boleto generalmente requieren controles de recuperación más sólidos que las descripciones de destinos almacenadas en caché o el contenido histórico de marketing.
Una plataforma resiliente separa los componentes para que una falla no interrumpa todos los recorridos de los clientes. Las interfaces de búsqueda, la distribución de contenido, los servicios de precios, las conexiones con inventarios, las cuentas de clientes, la orquestación de pagos, la gestión de pedidos, los servicios de notificaciones y las herramientas de atención al cliente deben tener dependencias controladas y políticas de escalamiento independientes. Las redes de distribución de contenido pueden seguir sirviendo páginas estáticas durante un incidente de la aplicación, mientras que las colas pueden conservar las solicitudes de reservas o notificaciones hasta que un servicio posterior vuelva a estar disponible. Los circuit breakers, los timeouts, los reintentos con backoff y los controles de idempotencia evitan que una respuesta lenta de una aerolínea o de un sistema de pagos genere reservas duplicadas o cargos repetidos.
La protección de datos es igualmente importante. Las plataformas de reservas deben replicar los registros críticos entre zonas o instalaciones de disponibilidad separadas y mantener copias de seguridad cifradas que se prueben mediante ejercicios reales de restauración. La replicación por sí sola no es suficiente, porque los datos dañados o alterados de forma maliciosa pueden copiarse en todas las réplicas. Un diseño maduro combina recuperación a un momento dado, copias de seguridad inmutables, controles de acceso, registros de auditoría y separación de privilegios administrativos. Los nombres de los pasajeros, los datos de identificación, la información de contacto, los tokens de pago y los documentos de viaje requieren un manejo estricto, porque la disponibilidad nunca debe lograrse debilitando la privacidad o la seguridad.
Las ventas de viajes en línea dependen de proveedores externos, como aerolíneas, distribuidores de hoteles, sistemas de alquiler de autos, procesadores de pagos y proveedores de asistencia. Estos socios pueden ofrecer inventario mediante conexiones GDS, interfaces NDC, interfaces de programación de aplicaciones, herramientas extranet o archivos por lotes. Por lo tanto, un diseño de continuidad necesita más de una vía para acceder a la información operativa cuando sea comercial y técnicamente viable. También debe distinguir entre disponibilidad en tiempo real, disponibilidad validada recientemente e información demasiado antigua para venderse de forma segura. Mostrar asientos o habitaciones desactualizados como disponibles para reservar puede generar reservas fallidas, reembolsos involuntarios y escalaciones al servicio de atención al cliente.
La continuidad de los precios requiere controles especiales, porque las tarifas pueden cambiar entre la búsqueda, el pago y la emisión. La plataforma debe conservar la oferta exacta presentada al cliente, registrar los impuestos y las tasas por separado y mantener una relación auditable entre el precio cotizado, la autorización del pago, el registro de la reserva y el boleto o voucher emitido. Si un feed de un proveedor deja de estar disponible, la alternativa más segura puede ser pausar las ventas afectadas en lugar de mostrar un precio que no puede confirmarse. Las colas y los reintentos controlados pueden completar las transacciones cuando la interrupción es temporal, pero cada reintento debe incluir un identificador de transacción único para evitar la creación de un PNR duplicado, una reserva de hotel duplicada o una autorización duplicada de la tarjeta.
La continuidad de los pagos es una línea de trabajo operativa independiente. Una empresa de viajes debe supervisar los estados de autorización, captura, reversión, reembolso y conciliación, en lugar de tratar el pago como un único evento de éxito o fracaso. Si la página de checkout muestra un error después de que un banco haya autorizado la transacción, el sistema de pedidos debe conciliar la autorización antes de invitar al cliente a intentarlo nuevamente. Diversificar los métodos de pago puede reducir la dependencia de un solo procesador, pero también aumenta la complejidad del monitoreo del fraude, la liquidación, la gestión de contracargos y la comunicación con los clientes. Los registros deben indicar si el dinero solo fue autorizado, si fue capturado, si fue reembolsado o si está a la espera de la confirmación del proveedor.
Un plan de continuidad solo resulta útil cuando los empleados saben quién toma las decisiones durante un incidente. La estructura de respuesta a incidentes debe identificar a un responsable operativo, un responsable de tecnología, un representante de pagos, un representante de gestión de proveedores, un responsable de atención al cliente y un responsable de comunicaciones. Los niveles de gravedad deben basarse en efectos medibles, como el porcentaje de checkouts fallidos, el número de reservas pagadas pero no emitidas, la imposibilidad de recuperar itinerarios o el volumen de vuelos afectados. Las vías de escalamiento deben incluir a los equipos internos y a los contactos pertinentes de aerolíneas, hoteles, proveedores de pagos, hosting y seguridad.
La comunicación con los clientes debe coordinarse con el estado real de la reserva. Un viajero que completó el pago pero no tiene boleto necesita un mensaje diferente del de un viajero cuyos resultados de búsqueda no están disponibles temporalmente. Las notificaciones deben indicar si la reserva existe, si se recibió el pago, si la emisión está pendiente y qué canal de soporte puede brindar asistencia. La aplicación, el correo electrónico, los SMS y las herramientas del centro de contacto deben utilizar los mismos datos del pedido y del PNR para evitar instrucciones contradictorias. Durante las cancelaciones o los cambios de horario de una aerolínea, la plataforma debe relacionar el nuevo horario del vuelo con las noches de hotel, los traslados, las excursiones y las fechas de asistencia antes de presentar un itinerario de reemplazo.
La continuidad del servicio al cliente también requiere un modo degradado controlado. Si los cambios de autoservicio no están disponibles temporalmente, los agentes necesitan una vista de solo lectura del historial de reservas y un proceso seguro para registrar solicitudes sin realizar acciones duplicadas posteriormente. Si no se puede acceder a la base de datos de reservas, los agentes no deben improvisar confirmaciones basadas únicamente en un correo electrónico o una captura de pantalla. Un registro temporal del caso puede conservar la solicitud del viajero, la evidencia del pago y los datos para devolver la llamada hasta que se restaure el sistema de reservas autorizado. Cuando el servicio vuelva a estar disponible, los casos en cola deben conciliarse con el PNR, el boleto, la confirmación del hotel o el registro del proveedor.
Las pruebas deben abarcar combinaciones de fallas realistas, en lugar de limitarse a apagados planificados de servidores. Los ejercicios pueden simular la pérdida de un feed de una aerolínea, latencia en la pasarela de pago, datos de reservas dañados, una falla del servicio de identidad, la contención de un ransomware, una interrupción de una región de la nube o un aumento repentino de la demanda causado por un feriado. Los ejercicios de simulación ponen a prueba la toma de decisiones, mientras que las pruebas técnicas de failover verifican si los sistemas realmente se recuperan dentro de sus objetivos. Después de cada ejercicio, los equipos deben registrar el tiempo de recuperación observado, las dependencias faltantes, las soluciones manuales, las discrepancias de datos y las demoras que afectan a los clientes.
La gobernanza de la continuidad del negocio debe mantenerse como un programa operativo y no como un documento almacenado para auditorías. Los responsables de los servicios necesitan mapas de dependencias actualizados, listas de contactos, procedimientos de recuperación, evidencia de copias de seguridad, obligaciones de los proveedores y registros de la última prueba exitosa. Los indicadores clave de rendimiento pueden incluir la tasa de finalización de reservas, la latencia de emisión de boletos, el tiempo de conciliación de pagos, el tiempo de recuperación por servicio, el porcentaje de datos restaurados, los casos de incidentes sin resolver y el número de transacciones duplicadas o abandonadas. Estas métricas muestran si la resiliencia está mejorando de maneras que los clientes realmente pueden experimentar.
Para un negocio de viajes en línea, la continuidad es, en última instancia, la capacidad de preservar la confianza a lo largo de una cadena de eventos dependientes. Una operación resiliente puede mantener en funcionamiento las ventas esenciales, proteger los datos de pagos y pasajeros, recuperar los registros de reservas, comunicarse con claridad y seguir atendiendo a los viajeros después de que cambie el itinerario original. No requiere que todas las funciones permanezcan disponibles a plena capacidad durante una crisis; requiere que la empresa priorice las reservas confirmadas, el movimiento preciso del dinero, la coordinación con los proveedores y el soporte práctico hasta que se restablezca el servicio normal.