

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

# Optimieren der Abfrageleistung mithilfe von Spaltenstatistiken
<a name="column-statistics"></a>

Sie können Statistiken auf Spaltenebene für AWS Glue Data Catalog Tabellen in Datenformaten wie Parquet, ORC, JSON, ION, CSV und XML berechnen, ohne zusätzliche Datenpipelines einrichten zu müssen. Spaltenstatistiken helfen Ihnen dabei, Datenprofile zu verstehen, indem sie Einblicke in die Werte innerhalb einer Spalte gewinnen. 

Data Catalog unterstützt die Generierung von Statistiken für Spaltenwerte wie Minimalwert, Maximalwert, Gesamtzahl der Nullwerte, Gesamtzahl der einzelnen Werte, durchschnittliche Länge von Werten und Gesamtzahl des Auftretens wahrer Werte. AWS Analysedienste wie Amazon Redshift und Amazon Athena können diese Spaltenstatistiken verwenden, um Abfrageausführungspläne zu erstellen und den optimalen Plan auszuwählen, der die Abfrageleistung verbessert.

Es gibt drei Szenarien für die Generierung von Spaltenstatistiken: 

 **Automatisch **   
AWS Glue unterstützt die automatische Generierung von Spaltenstatistiken auf Katalogebene, sodass automatisch Statistiken für neue Tabellen in der generiert werden können. AWS Glue Data Catalog

**Geplant**  
AWS Glue unterstützt die zeitgesteuerte Generierung von Spaltenstatistiken, sodass sie automatisch nach einem wiederkehrenden Zeitplan ausgeführt werden kann.   
Bei der planmäßigen Statistikberechnung aktualisiert die Spaltenstatistikaufgabe die Gesamtstatistiken auf Tabellenebene, wie z. B. Minimum, Maximum und Durchschnitt, mit den neuen Statistiken und liefert den Abfrage-Engines genaue und aktuelle Statistiken zur Optimierung der Abfrageausführung. 

**On-demand**  
Verwenden Sie diese Option, um bei Bedarf Spaltenstatistiken zu generieren. Dies ist nützlich für Ad-hoc-Analysen oder wenn Statistiken sofort berechnet werden müssen. 

Sie können so konfigurieren, dass die Aufgabe zur Generierung von Spaltenstatistiken mithilfe von AWS Glue Konsolen AWS CLI- und AWS Glue API-Vorgängen ausgeführt wird. Wenn Sie den Prozess starten, AWS Glue startet im Hintergrund ein Spark-Job und aktualisiert die AWS Glue Tabellenmetadaten im Datenkatalog. Sie können Spaltenstatistiken mithilfe der AWS Glue Konsole AWS CLI oder durch Aufrufen der [ GetColumnStatisticsForTable ](https://docs.aws.amazon.com/glue/latest/webapi/API_GetColumnStatisticsForTable.html) API-Operation anzeigen.

**Anmerkung**  
Wenn Sie Lake-Formation-Berechtigungen verwenden, um den Zugriff auf die Tabelle zu steuern, erfordert die von der Aufgabe für Spaltenstatistiken übernommene Rolle vollständigen Tabellenzugriff, um Statistiken zu generieren.

**Anmerkung**  
Spaltenstatistiken unterstützen keine Iceberg v3-Datentypen, einschließlich VARIANT, UNKNOWN, Geography und Geometry. Spalten mit diesen Datentypen werden bei der Statistikgenerierung übersprungen.

 Das folgende Video veranschaulicht, wie Sie die Abfrageleistung mithilfe von Spaltenstatistiken verbessern. 

[![AWS Videos](http://img.youtube.com/vi/zUHEXJdHUxs?si=HjyhpoALR6RXJz2i/0.jpg)](http://www.youtube.com/watch?v=zUHEXJdHUxs?si=HjyhpoALR6RXJz2i)


**Topics**
+ [Voraussetzungen für die Generierung von Spaltenstatistiken](column-stats-prereqs.md)
+ [Automatisches Generieren von Spaltenstatistiken](auto-column-stats-generation.md)
+ [Planmäßige Generierung von Spaltenstatistiken](generate-column-stats.md)
+ [On-Demand-Generierung von Spaltenstatistiken](column-stats-on-demand.md)
+ [Anzeigen von Spaltenstatistiken](view-column-stats.md)
+ [Anzeigen von Spaltenstatistik-Aufgabenläufen](view-stats-run.md)
+ [Beenden des Spaltenstatistik-Aufgabenlaufs](stop-stats-run.md)
+ [Löschen von Spaltenstatistiken](delete-column-stats.md)
+ [Überlegungen und Einschränkungen](column-stats-notes.md)