

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

# consegna dei dati per le tabelle di streaming ad Apache Iceberg
<a name="msk-data-delivery-iceberg"></a>

Con Amazon MSK Data Delivery, puoi materializzare continuamente gli argomenti di Apache Kafka come tabelle Apache Iceberg su Amazon S3 Tables. La compattazione intelligente in linea elimina l'impatto sulle prestazioni dei file di piccole dimensioni e mantiene prevedibili le prestazioni delle query senza sacrificare la freschezza dei dati. Built-in il coordinamento risolve i conflitti di scrittura simultanei tra utenti ad alto rendimento. Amazon S3 Tables gestisce automaticamente la manutenzione continua delle tabelle, inclusa la compattazione, la scadenza delle istantanee e la pulizia dei file senza riferimenti.

**Topics**
+ [Integrazioni](#msk-data-delivery-iceberg-integrations)
+ [Casi di utilizzo comune](#msk-data-delivery-iceberg-use-cases)
+ [Flusso di dati](#msk-data-delivery-iceberg-data-flow)
+ [Vantaggi](#msk-data-delivery-iceberg-benefits)
+ [Come funziona](#msk-data-delivery-iceberg-how-it-works)
+ [Concetti chiave](msk-data-delivery-iceberg-concepts.md)
+ [Requisiti e configurazioni supportate](#msk-data-delivery-iceberg-requirements)
+ [Nozioni di base](msk-data-delivery-iceberg-getting-started.md)
+ [autorizzazioni IAM](msk-data-delivery-iceberg-iam.md)
+ [Gestisci i canali](msk-data-delivery-iceberg-manage.md)
+ [Comportamenti delle tabelle Iceberg](msk-data-delivery-iceberg-behaviors.md)
+ [Sicurezza](msk-data-delivery-iceberg-security.md)
+ [Monitoraggio](msk-data-delivery-iceberg-monitoring.md)
+ [Registrazione dei log](msk-data-delivery-iceberg-logging.md)
+ [Best practice](msk-data-delivery-iceberg-bestpractices.md)
+ [Risoluzione dei problemi](msk-data-delivery-iceberg-troubleshooting.md)

## Integrazioni
<a name="msk-data-delivery-iceberg-integrations"></a>
+ **Broker Amazon MSK Express**: la fonte dei dati.
+ **Amazon S3 Tables**: destinazione Iceberg gestita.
+ **AWS Glue Schema Registry**: fonte di verità per gli schemi di record.
+ **Amazon CloudWatch**: metriche e registri operativi.
+ **AWS CloudTrail**— Registrazione degli audit delle API.
+ **AWS KMS**— crittografia opzionale gestita dal cliente a riposo.

## Casi di utilizzo comune
<a name="msk-data-delivery-iceberg-use-cases"></a>
+ Inserisci continuamente i dati in streaming di Kafka in tabelle Iceberg interrogabili per l'analisi (Athena, Spark e altri motori).
+ Crea un lago di streaming su S3 Tables senza dover gestire la compattazione o un servizio di distribuzione.
+ Distribuisci un singolo argomento su più destinazioni senza aumentare il carico del broker.

Per le specifiche dell'API, consulta `CreateChannel``DescribeChannel`,`UpdateChannel`,`DeleteChannel`, e `ListChannels` nell'*Amazon MSK API Reference*.

## Flusso di dati
<a name="msk-data-delivery-iceberg-data-flow"></a>

Il diagramma seguente mostra il flusso di record da un argomento relativo a un broker Amazon MSK Express attraverso un canale di distribuzione dei dati verso la tua destinazione, con i record non elaborabili indirizzati a una coda di lettere morte.

![Flusso di dati da un argomento del broker Amazon MSK Express attraverso un canale di data delivery a una tabella Apache Iceberg in Amazon S3 Tables, con record non elaborabili indirizzati a una coda di lettere morte.](http://docs.aws.amazon.com/it_it/msk/latest/developerguide/images/msk-data-channel-dataflow.png)


## Vantaggi
<a name="msk-data-delivery-iceberg-benefits"></a>
+ **Nessuna infrastruttura da gestire: nessun connettore o cluster di calcolo. ** Si configura un canale e il servizio gestisce la distribuzione, la scalabilità e la tolleranza ai guasti.
+ **Nessun impatto sui broker**: un canale legge l'argomento senza consumare il throughput del broker o influire sui carichi di lavoro di produttori e consumatori.
+ **Scalabilità in base ai dati**: supporta una velocità di trasmissione dei dati fino a 10 GBps senza necessità di scalabilità manuale.
+ **Aggiornamento dei dati in pochi minuti**: i dati forniti sono disponibili per l'interrogazione o l'elaborazione entro 5-15 minuti dalla presentazione dell'argomento.
+ **Built-in gestione degli errori**: i record non elaborabili vengono indirizzati a una coda di lettere morte con un contesto di errore, in modo che la consegna prosegua senza interruzioni.

## Come funziona
<a name="msk-data-delivery-iceberg-how-it-works"></a>

Per stabilire una tabella su Iceberg, crei un canale. ** ** Crei un canale su un cluster Amazon MSK Provisioned che utilizza broker Express. Il canale legge i record da un argomento di Kafka e li consegna alla destinazione configurata.

Per ** lo streaming di tabelle per Apache Iceberg**, il canale converte i record JSON utilizzando uno schema nel AWS Glue Schema Registry, li scrive come file di dati Apache Parquet e li registra in una nuova tabella Iceberg memorizzata in un bucket S3 Table.

I record che non possono essere elaborati vengono indirizzati a un bucket S3 obbligatorio con coda di lettere morte (DLQ).

**Nota**  
Un canale ** non ** riempie i dati prodotti in precedenza, ma solo i dati prodotti dopo l'attivazione. Per le tabelle di streaming per Apache Iceberg, un canale crea una ** nuova tabella ** Iceberg per ogni configurazione; la distribuzione alle tabelle Iceberg esistenti non è supportata.

## Requisiti e configurazioni supportate
<a name="msk-data-delivery-iceberg-requirements"></a>
+ Un cluster Amazon MSK Provisioned con ** broker Express. ** I broker standard e Amazon MSK Serverless non sono supportati. ** **
+ Almeno un argomento di Kafka.
+ Un bucket Amazon S3 per la coda delle lettere morte (DLQ). ****Questo è obbligatorio.
+ Un ruolo di servizio IAM che il Canale assume per fornire i dati.
+ Aggiornamento dei dati configurato tra 5 e 15 minuti.
+ Dati dell'argomento in ** JSON ** (JSON semplice, con uno schema GSR ARN) o ** JSON\_SCHEMA\_GSR (JSON ** con un ID schema incorporato). GSR-serialized 
+ Uno schema registrato nel Glue Schema Registry che corrisponde ai dati dell'argomento. AWS 
+ Un bucket Amazon S3 Table nello Regione AWS stesso del cluster Amazon MSK.
+ Per un aggiornamento minimo dei dati di 5 minuti, l'argomento dovrebbe produrre almeno 2,4 MBps di dati non compressi. Per argomenti con una produttività inferiore, utilizza un valore di aggiornamento dei dati più elevato (fino a 15 minuti).