View a markdown version of this page

Cómo elegir la estrategia de recuperación ante desastres para las cargas de trabajo de Amazon DynamoDB - Amazon DynamoDB

Cómo elegir la estrategia de recuperación ante desastres para las cargas de trabajo de Amazon DynamoDB

Antes de seleccionar una estrategia de DR de DynamoDB, debe definir los requisitos de recuperación empresarial. Este análisis inicial evita un costoso exceso de ingeniería y, al mismo tiempo, ayuda a garantizar que se satisfagan las necesidades críticas de continuidad empresarial. El enfoque óptimo equilibra cuatro factores clave: la velocidad de recuperación, la tolerancia a la pérdida de datos, la complejidad de la implementación y los costos operativos.

Conozcamos dos métricas de claves que dan forma a su estrategia de DR:

  • Objetivo de tiempo de recuperación (RTO): es el retraso máximo aceptable entre la interrupción del servicio y su restauración. RTO responde a la pregunta: ¿cuánto tiempo podemos permitirnos estar inactivos? Esto puede oscilar entre cero (lo que requiere disponibilidad continua) y varias horas, según los requisitos empresariales.

  • Objetivo de punto de recuperación (RPO): representa el tiempo máximo aceptable desde el último punto de recuperación de datos. RPO responde a la pregunta: ¿cuántos datos podemos permitirnos perder? Por ejemplo, si el RPO es de 1 hora, la solución de DR debe asegurarse de que puede recuperar los datos hasta un punto no superior a 1 hora antes de que comience un incidente.

Objetivos de recuperación

La elección de la estrategia de DR de DynamoDB se debe basar en los siguientes factores:

  • Análisis del impacto empresarial de la interrupción del servicio

  • Evaluación del riesgo de diferentes escenarios de desastre

  • Costo de implementar cada opción de DR

  • Requisitos reglamentarios para la protección y disponibilidad de los datos

Puntos de decisión para seleccionar un enfoque de DR de DynamoDB

Al seleccionar el enfoque de DR de DynamoDB adecuado, debe evaluar los requisitos empresariales específicos, la tolerancia al riesgo, los requisitos normativos y las restricciones presupuestarias.

Para cumplir con los requisitos de cero tiempo de inactividad, en los que la pérdida de ingresos durante las interrupciones supera con creces los costos operativos adicionales, las arquitecturas de tablas globales, incluidas las tablas de coherencia alta multirregional (MRSC), ofrecen capacidades de recuperación instantánea. Aunque estas soluciones conllevan costos operativos más altos, ofrecen una conmutación por error inmediata y una disponibilidad continua, lo que las hace esenciales para las aplicaciones de misión crítica en las que el tiempo de inactividad afecta directamente a los flujos de ingresos.

Las organizaciones que se preocupan por su presupuesto y que tienen requisitos de recuperación flexibles pueden utilizar soluciones más rentables cuando las aplicaciones pueden tolerar horas de tiempo de inactividad durante los escenarios de recuperación. Las estrategias de copia de seguridad bajo demanda, AWS Backup o de exportación de Amazon Simple Storage Service ofrecen costos operativos significativamente más bajos y aceptan plazos de recuperación más largos. Estos enfoques funcionan bien para aplicaciones en las que la continuidad empresarial es importante, pero la recuperación inmediata no está justificada desde el punto de vista financiero, por lo que ofrecen la opción de equilibrar la protección con la optimización de los costos.

Los requisitos de conformidad normativa requieren soluciones automatizadas que garanticen la preparación para las auditorías y las políticas de retención de datos adecuadas. AWS Backup con la replicación entre regiones proporciona una automatización integral de la conformidad y, al mismo tiempo, mantiene estructuras de costos más elevadas. Este enfoque proporciona la documentación, las políticas de retención y la distribución geográfica que requieren los marcos normativos, al tiempo que reduce los gastos de conformidad manual y ayuda a garantizar procedimientos de copia de seguridad coherentes en toda la organización.

Para los escenarios de protección frente a errores humanos, como las eliminaciones accidentales o la corrupción de datos, la recuperación en un momento dado (PITR) combinada con la protección contra eliminación ofrece protección continua en una sola región. Aunque esta solución proporciona una excelente protección contra los errores operativos y mantiene unos costos razonables, hay que aceptar la limitación de una sola región y planificar estrategias adicionales para los verdaderos escenarios de DR que impliquen interrupciones regionales o errores de infraestructura.

Opciones de recuperación de desastres

DynamoDB ofrece opciones para realizar copias de seguridad y restaurar los datos de las tablas, lo que proporciona resiliencia ante varios escenarios de error. Hay cuatro soluciones principales de DR que satisfacen diferentes necesidades:

  • Recuperación en un momento dado (PITR) para una protección de datos continua

  • Copia de seguridad y restauración bajo demanda para una protección flexible

  • Copia de seguridad y restauración programadas para una protección periódica automatizada

  • Tablas globales para la recuperación instantánea de cargas de trabajo de misión crítica

Tipo de copia de seguridad Opción de copia de seguridad Característica RPO RTO Disponibilidad de copia de seguridad Costo mensual de copia de seguridad Costo de restauración único

Protección de datos continua

PITR

Las copias de seguridad continuas se retienen durante un máximo de 35 días, lo que permite realizar la PITR en cuestión de segundos en cualquier momento en la ventana de copia de seguridad configurada

Segundos

Minutos

Solo en una región de AWS

0,20 USD por GB al mes

0,15 USD por GB

Protección bajo demanda

Backup y restauración en diferido

Proceso bajo demanda

Horas

Minutos

Región de AWS única

0,10 USD por GB al mes

0,15 USD por GB

Copia de seguridad y restauración programadas

AWS Backup

Opciones de programación flexibles (por hora o por mes)

Horas

Minutos

Se admiten copias de seguridad entre regiones

0,10 USD por GB al mes

0,15 USD por GB

Exportación e importación de Amazon S3 (con PITR habilitado)

Exportación de datos completos o incrementales dentro de las ventanas de PITR a un bucket

Minutos

Horas

Es posible realizar copias de seguridad entre regiones a un bucket

0,10 USD por GB

0,15 USD por GB

Recuperación instantánea de cargas de trabajo de misión crítica

Tablas globales

Solución totalmente administrada, tablas multirregionales y multiactivas

Segundos

Zero

Propagación automática de los cambios de datos de la región principal a la secundaria en milisegundos

0,625 USD por millón de unidades de solicitud de escritura replicadas

0

Tablas de MRSC

Solución totalmente administrada, tablas multirregionales y multiactivas con coherencia alta

Zero

Zero

Propagación automática de los cambios de datos de la región principal a la secundaria en tiempo real

0,625 USD por millón de unidades de solicitud de escritura replicadas

0

nota

Los costos que se muestran en la tabla anterior se basan en los precios de la región Norte de Virginia de Precios de DynamoDB para la capacidad bajo demanda.

Protección de datos continua mediante PITR

Imagine un minorista de comercio electrónico que utiliza DynamoDB para la administración del inventario, los catálogos de productos y el procesamiento de pedidos. Mientras se prepara para un evento del Black Friday, el equipo de desarrollo elimina accidentalmente su catálogo de productos. Con PITR, pueden restaurar miles de registros al momento exacto anterior al incidente en 30 minutos, lo que evita una posible pérdida de ingresos millonaria.

Una vez habilitado PITR, DynamoDB realiza copias de seguridad automáticamente de los datos de la tabla con precisión por segundo. Puede restaurar la tabla en cualquier segundo dentro del periodo de recuperación configurado, que va de 1 a 35 días. En particular, reducir el periodo de retención no reduce los costos, por lo que los periodos de retención prolongados son neutros en términos de costos. La característica de PITR proporciona capacidades de recuperación detalladas con un RPO mínimo (segundos) y un RTO razonable (de minutos a horas), lo que la hace adecuada para varios requisitos de DR. Los escenarios del mundo real demuestran cómo el RPO mínimo y el RTO razonable del PITR transforman los posibles desastres empresariales en operaciones de recuperación administrables, ya sea para proteger contra errores humanos, errores en las aplicaciones o para cumplir con los estrictos requisitos normativos.

Para obtener más información, consulte Habilitar la recuperación a un momento dado en DynamoDB, que proporciona instrucciones detalladas sobre cómo configurar el PITR y restaurar tablas mediante CloudFormation, AWS CLI y la API de DynamoDB.

Protección flexible mediante copia de seguridad y restauración bajo demanda

Considere la posibilidad de que un proveedor de atención médica esté planificando una migración importante del sistema de historias médicas electrónicas (EHR). El uso de copias de seguridad de hitos durante todo el proceso de migración permitiría cumplir con los estrictos requisitos de HIPAA y, al mismo tiempo, proporcionaría a los equipos legales pruebas de auditoría inmutables. Si surgieran problemas de conformidad durante la migración, podrían demostrar los procedimientos exactos de gestión de datos y restaurar a cualquier punto de control conforme, lo que garantizaría así la protección de los datos de los pacientes y la conformidad normativa.

Con la característica de copia de seguridad bajo demanda de DynamoDB, puede crear copias de seguridad y restaurar tablas según sea necesario. Las copias de seguridad bajo demanda funcionan de forma asíncrona y capturan todos los cambios hasta el momento en que se realiza la solicitud de copia de seguridad. Las capacidades de copia de seguridad bajo demanda brindan un control preciso sobre su estrategia de protección de datos y, al mismo tiempo, admiten diversos requisitos operativos y de conformidad.

La copia de seguridad y la restauración bajo demanda ofrecen capacidades flexibles de restauración de tablas en escenarios de la misma región y entre regiones, lo que proporciona opciones de recuperación versátiles. Para mejorar la continuidad empresarial, DynamoDB ofrece la finalización instantánea de la copia de seguridad independientemente del tamaño de la tabla, mientras que las restauraciones en la misma región proporcionan un rendimiento óptimo para minimizar el tiempo de recuperación y maximizar la disponibilidad operativa.

Al implementar una estrategia de copia de seguridad diaria, puede lograr un RPO fiable de 24 horas, complementado con un RTO predecible de minutos a horas. Al utilizar este enfoque estructurado de protección de datos, puede planificar y ejecutar sus estrategias de copia de seguridad y recuperación de manera eficaz y, al mismo tiempo, mantener las operaciones empresariales.

Para obtener más información sobre las operaciones de copia de seguridad y restauración de DynamoDB, consulte Realización de copias de seguridad de una tabla de DynamoDB y Restauración de una tabla de DynamoDB a partir de una copia de seguridad.

Protección periódica automatizada mediante copia de seguridad y restauración programadas

DynamoDB proporciona varios mecanismos de protección que se pueden automatizar mediante flujos de trabajo programados, como AWS Backup con planes de copia de seguridad personalizables para la recuperación operativa y las capacidades de exportación de Amazon S3 para el archivado a largo plazo, la migración de datos entre regiones y las operaciones continuas. Al implementar estos programas de protección periódica automatizados, puede garantizar una protección de datos uniforme sin intervención manual y, al mismo tiempo, equilibrar los objetivos de recuperación con los costos de almacenamiento.

Copia de seguridad y restauración mediante AWS Backup y planes de copia de seguridad

Tenga en cuenta un banco multinacional con operaciones en 15 países que necesitaba agregar una protección empresarial a su sistema de detección de fraudes basado en Amazon DynamoDB; una protección que pudiera adaptarse a los diversos requisitos normativos de todas las jurisdicciones y, al mismo tiempo, garantizar una disponibilidad continua.

Con las capacidades de replicación multirregional y multicuenta de AWS Backup, el banco implementó una arquitectura de protección que replicaba automáticamente los datos críticos de las transacciones en todas las regiones y, al mismo tiempo, mantenía estrictos controles de acceso para las diferentes unidades de negocio. Cuando los reguladores de tres países solicitaron simultáneamente datos de transacciones históricos para realizar auditorías de conformidad, las políticas de copia de seguridad estandarizadas del banco y los registros de auditoría detallados permitieron proporcionar la documentación completa en cuestión de horas en lugar de semanas.

Con AWS Backup, puede realizar copias de seguridad periódicas de los datos en una cuenta de AWS específica. Con planes de copia de seguridad, puede realizar estas copias de seguridad en diferentes regiones bajo demanda o de forma automática, como parte de un plan de copia de seguridad programado. Los planes de copia de seguridad ofrecen opciones de programación flexibles, de modo que puede elegir una frecuencia que se ajuste a sus necesidades: cada hora, cada 12 horas, diaria, semanal o mensual. Las copias de seguridad de DynamoDB se copiarán en todas las regiones según la frecuencia seleccionada.

Bloqueo de almacenes de AWS Backup aplica copias de seguridad de escritura única y lectura múltiple (WORM) para ayudar a proteger las copias de seguridad (puntos de recuperación) de los almacenes de copias de seguridad frente a acciones inadvertidas o malintencionadas y proporciona protección contra los ataques de ransomware. Puede lograr un RPO de 1 hora y un RTO de entre varios minutos a varias horas, en función del tamaño de la tabla.

Para entender cómo AWS Backup se integra con DynamoDB y obtener información sobre las características de copia de seguridad y las prácticas recomendadas, consulte Uso de AWS Backup con DynamoDB.

Exportación e importación de Amazon Simple Storage Service (Amazon S3)

Imagine una empresa de servicios financieros globales que necesita cumplir con los requisitos normativos para los datos de transacciones en varias jurisdicciones y, al mismo tiempo, mantener una disponibilidad del 99,99 %. Podrían desarrollar su estrategia de datos empresariales en torno a las capacidades de exportación e importación de Amazon S3, implementar la replicación de datos entre regiones para cumplir con las leyes de soberanía de datos en 12 países y establecer mecanismos de conmutación por error regionales. Si se produjera una interrupción en Europa, estos sistemas ejecutarían automáticamente los procedimientos de conmutación por error, lo que ayudaría a garantizar la ausencia de interrupciones en las operaciones comerciales y la continuidad de las operaciones.

La empresa utilizó la característica de exportación o importación a Amazon S3 para crear copias de seguridad completas diarias y exportaciones incrementales cada hora a buckets de Amazon S3 específicos de cada jurisdicción en las 12 regiones, lo que ayudó a garantizar la conformidad de los requisitos de residencia de datos locales. Cada tabla regional exportaba automáticamente los datos de las transacciones a buckets cifrados de la misma jurisdicción, mientras que la replicación entre regiones ofrecía una redundancia adicional para los conjuntos de datos fundamentales. Las exportaciones no consumen unidades de capacidad de lectura (RCU) y no tienen ningún impacto en el rendimiento o la disponibilidad de la tabla. Si se produce un deterioro en una de las regiones en las que opera la empresa, los procedimientos de recuperación automatizados permiten restablecer la exportación más reciente a una región alternativa, lo que permite reanudar todas las operaciones comerciales. Esta estrategia de exportación o importación garantiza la conformidad con la normativa mediante registros de auditoría inmutables y sólidas capacidades de DR, lo que permite a la empresa mantener operaciones continuas y, al mismo tiempo, conservar historiales de transacciones completos que se pueden restaurar en tablas nuevas en cualquier región disponible, lo que ayuda a garantizar una pérdida de datos y un tiempo de inactividad mínimos durante los errores de la infraestructura regional.

Con la exportación de DynamoDB a Amazon S3, puede exportar datos de una tabla de DynamoDB en un punto de la ventana de PITR. Puede lograr un RPO de unos pocos minutos y un RTO de entre varios minutos a varias horas, en función del tamaño de la tabla.

Para obtener una guía de implementación detallada sobre la configuración de las exportaciones, consulte Solicitud de una exportación de tabla en DynamoDB. Para obtener información sobre las operaciones de restauración y la importación de datos, consulte Solicitud de una importación de tabla en DynamoDB.

Recuperación instantánea de cargas de trabajo de misión crítica mediante tablas globales

Las tablas globales de DynamoDB proporcionan sólidas capacidades de conmutación por error durante la interrupción de la región principal; las aplicaciones pueden redirigir inmediatamente el tráfico a las regiones en buen estado y continuar con las operaciones. Las tablas globales tienen dos opciones: coherencia final multirregional (MREC) y coherencia alta multirregional (MRSC).

Coherencia final multirregional

Imagine un servicio de comercio electrónico multinacional que atiende a millones de clientes en América del Norte, Europa y Asia-Pacífico y que podría enfrentarse a importantes desafíos operativos sin una infraestructura global adecuada. La empresa podría tener problemas con los tiempos de pago lentos de los clientes internacionales, los complejos requisitos de conformidad en varias jurisdicciones y las frecuentes interrupciones durante las interrupciones regionales. Al implementar las tablas globales de DynamoDB, podrían transformar sus operaciones: los clientes de Tokio experimentarían los mismos tiempos de pago ultrarrápidos que los de Nueva York gracias al acceso a los datos locales de latencia ultrabaja. En caso de que un evento meteorológico grave interrumpiese la región principal, la aplicación podría realizar una conmutación por error sin problemas a otra región sin que los clientes se diesen cuenta, lo que mantendría una alta disponibilidad, mejoraría la latencia global de lectura y escritura, respaldaría la conformidad normativa en las regiones en las que operan y se ganaría la confianza necesaria para expandirse a nuevos mercados sabiendo que la infraestructura puede escalar de manera fiable en todo el mundo y, al mismo tiempo, cumplir con los requisitos locales.

Las tablas globales de DynamoDB ofrecen una solución de base de datos totalmente administrada, multirregional y multiactiva diseñada para proporcionar un rendimiento de lectura y escritura rápido y localizado para aplicaciones globales escaladas masivamente. Para fines de DR, puede especificar la región principal y la región de DR en las que desea que estén disponibles las tablas. DynamoDB propaga automáticamente los cambios de datos en curso desde la región principal a la réplica de DR. Con la configuración de MREC, puede lograr un RPO de unos segundos y un RTO de cero.

Para obtener instrucciones sobre la creación y administración de tablas globales de DynamoDB, consulte Tablas globales: replicación multirregional para DynamoDB.

Consistencia alta de varias regiones

Imagínese una plataforma de banca digital líder que procesa millones de transacciones a diario en tres continentes y que podría sufrir una interrupción regional importante durante las horas pico de comercio. En lugar de tener que recurrir a procedimientos manuales de DR y enfrentarse a posibles pérdidas millonarias, su arquitectura activaría la DR en cuestión de segundos y redirigiría el tráfico a las regiones en buen estado sin que los clientes notaran ninguna interrupción. La aplicación móvil del banco podría seguir procesando las solicitudes de préstamos en tiempo real, su plataforma de comercio mantendría tiempos de respuesta en milisegundos para las transacciones de alta frecuencia y los saldos de las cuentas de los clientes permanecerían perfectamente sincronizados en todas las regiones.

Con tablas globales de alta coherencia multirregionales, puede crear aplicaciones con RPO cero. Un RPO de cero significa que las aplicaciones pueden leer la última versión de los datos de DynamoDB, aunque una interrupción de la aplicación haga cambiar el tráfico a una región diferente.

nota

Para fines de DR, puede utilizar dos réplicas y una región testigo.

Para obtener más información sobre la creación de tablas globales de MRSC, consulte Cómo funcionan las tablas globales.