View a markdown version of this page

Convalida della coerenza dei dati durante una migrazione online - Amazon Keyspaces (per Apache Cassandra)

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Convalida della coerenza dei dati durante una migrazione online

La fase successiva del processo di migrazione online è la convalida dei dati. La doppia scrittura consiste nell'aggiungere nuovi dati al database Amazon Keyspaces e hai completato la migrazione dei dati storici utilizzando il caricamento in blocco o la scadenza dei dati con TTL.

Ora puoi utilizzare la fase di convalida per confermare che entrambi gli archivi di dati contengano effettivamente gli stessi dati e restituiscano gli stessi risultati di lettura. È possibile scegliere una delle due opzioni seguenti per verificare che entrambi i database contengano dati identici.

  • Letture doppie: per verificare che sia il database di origine che quello di destinazione contengano lo stesso set di dati storici e appena scritti, è possibile implementare la doppia lettura. A tale scopo, è possibile leggere sia dal database principale Cassandra che dal database Amazon Keyspaces secondario in modo analogo al metodo dual write e confrontare i risultati in modo asincrono.

    I risultati del database primario vengono restituiti al client e i risultati del database secondario vengono utilizzati per la convalida rispetto al set di risultati primario. Le differenze rilevate possono essere registrate o inviate a una coda di lettere morte (DLQ) per una successiva riconciliazione.

    Nel diagramma seguente, l'applicazione esegue una lettura sincrona da Cassandra, che è l'archivio dati principale) e una lettura asincrona da Amazon Keyspaces, che è il data store secondario.

    Utilizzo di doppie letture per convalidare la coerenza dei dati durante una migrazione online da Apache Cassandra ad Amazon Keyspaces.
  • Letture di esempio: una soluzione alternativa che non richiede modifiche al codice dell'applicazione consiste nell'utilizzare AWS Lambda funzioni per campionare periodicamente e in modo casuale i dati sia dal cluster Cassandra di origine che dal database Amazon Keyspaces di destinazione.

    Queste funzioni Lambda possono essere configurate per essere eseguite a intervalli regolari. La funzione Lambda recupera un sottoinsieme casuale di dati dal sistema di origine e di destinazione, quindi esegue un confronto tra i dati campionati. Eventuali discrepanze o discrepanze tra i due set di dati possono essere registrate e inviate a una coda di lettere morte (DLQ) dedicata per una successiva riconciliazione.

    Questo processo è illustrato nello schema seguente.

    Utilizzo di letture di esempio per convalidare la coerenza dei dati durante la migrazione online da Apache Cassandra ad Amazon Keyspaces.