

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

# Überwachung AWS Glue anhand von CloudWatch Amazon-Metriken
<a name="monitoring-awsglue-with-cloudwatch-metrics"></a>

Sie können AWS Glue-Operationen mit dem AWS Glue-Auftrags-Profiler profilieren und überwachen. Es sammelt und verarbeitet Rohdaten von AWS Glue Jobs zu lesbaren, nahezu in Echtzeit gespeicherten Metriken, die in Amazon gespeichert sind CloudWatch. Diese Statistiken werden gespeichert und aggregiert, CloudWatch sodass Sie auf historische Informationen zugreifen können, um einen besseren Überblick über die Leistung Ihrer Anwendung zu erhalten.

**Anmerkung**  
 Es können zusätzliche Gebühren anfallen, wenn Sie Job-Metriken aktivieren und CloudWatch benutzerdefinierte Metriken erstellt werden. Weitere Informationen finden Sie unter [ CloudWatch Amazon-Preise](https://aws.amazon.com/cloudwatch/pricing/). 

## AWS Glue-Metriken – Übersicht
<a name="metrics-overview"></a>

Wenn Sie mit interagierenAWS Glue, sendet es Metriken an CloudWatch. Sie können diese Metriken über die AWS Glue Konsole (die bevorzugte Methode), das CloudWatch Konsolen-Dashboard oder die AWS Command Line Interface (AWS CLI) anzeigen. 

**Anzeige von Metriken über das Dashboard der AWS Glue-Konsole**

Sie können zusammenfassende oder detaillierte Diagramme von Metriken für einen Auftrag oder detaillierte Diagramme für eine Auftragsausführung anzeigen. 

1. Melden Sie sich bei der an AWS-Managementkonsole und öffnen Sie die AWS Glue Konsole unter [https://console.aws.amazon.com/glue/](https://console.aws.amazon.com/glue/).

1. Wählen Sie im Navigationsbereich **Überwachung der Auftragsausführung** aus.

1. Wählen Sie unter **Auftragsausführungen** die Option **Aktionen**, um einen gerade ausgeführten Auftrag anzuhalten, einen Auftrag anzuzeigen oder ein Auftragslesezeichen zurückzuspulen.

1. Wählen Sie einen Auftrag aus und wählen Sie dann **Details zur Ausführung anzeigen**, um zusätzliche Informationen zur Auftragsausführung anzuzeigen.

**Um Metriken über das CloudWatch Konsolen-Dashboard anzuzeigen**

Metriken werden zunächst nach dem Service-Namespace und anschließend nach den verschiedenen Dimensionskombinationen in den einzelnen Namespaces gruppiert.

1. Öffnen Sie die CloudWatch Konsole unter [https://console.aws.amazon.com/cloudwatch/](https://console.aws.amazon.com/cloudwatch/).

1. Wählen Sie im Navigationsbereich **Metriken** aus.

1. Wählen Sie den Namespace **Glue** aus.

**Um Metriken mit dem anzuzeigen AWS CLI**
+ Geben Sie als Eingabeaufforderung den folgenden Befehl ein.

  ```
  1. aws cloudwatch list-metrics --namespace Glue
  ```

AWS Gluemeldet Metriken CloudWatch alle 30 Sekunden, und die CloudWatch Metrik-Dashboards sind so konfiguriert, dass sie jede Minute angezeigt werden. Die AWS Glue-Metriken stellen Deltawerte gegenüber den zuvor gemeldeten Werten dar. Gegebenenfalls aggregieren (summieren) die Metrik-Dashboards die 30-Sekunden-Wertezu einem Wert für die gesamte vergangene Minute.

### AWS Glue Verhalten von Metriken für Spark-Jobs
<a name="metrics-overview-spark"></a>

 AWS Glue-Metriken werden bei der Initialisierung eines `GlueContext` in einem Skript aktiviert und in der Regel nur am Ende einer Apache-Spark-Aufgabe aktualisiert. Sie stellen die aggregierten Werte in allen abgeschlossenen Spark-Aufgaben dar.

Bei den Spark-Metriken, die AWS Glue an weitergegeben CloudWatch werden, handelt es sich jedoch im Allgemeinen um absolute Werte, die den aktuellen Status zum Zeitpunkt der Meldung darstellen. AWS Gluemeldet sie CloudWatch alle 30 Sekunden, und die Metrik-Dashboards zeigen in der Regel den Durchschnitt der in der letzten Minute empfangenen Datenpunkte an.

Allen AWS Glue-Metriknamen wird eines der folgenden Präfixe vorangestellt:
+ `glue.driver.` – Metriken, deren Namen mit diesem Präfix beginnen, stellen entweder AWS Glue-Metriken dar, die von allen Executors beim Spark-Treiber aggregiert werden, oder Spark-Metriken, die dem Spark-Treiber entsprechen.
+ `glue.`*executorId*`.` – Die *executorId* ist die Nummer eines bestimmten Spark-Executor. Der Wert entspricht den Executors, die in den Protokollen aufgeführt sind.
+ `glue.ALL.` - Metriken, deren Namen mit diesem Präfix beginnen, aggregierte Werte aus allen Spark Executors.

## AWS Glue Metriken
<a name="awsglue-metrics"></a>

AWS Glue erstellt und sendet CloudWatch alle 30 Sekunden die folgenden Metriken, und das AWS Glue Metrics-Dashboard meldet sie einmal pro Minute:


| Metrik | Description | 
| --- | --- | 
| `glue.driver.aggregate.bytesRead` | Die Anzahl der Bytes, die von allen abgeschlossenen Spark-Aufgaben von allen Datenquellen gelesen und in allen Executors ausgeführt werden.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet. <br />Einheit: Byte<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Gelesene Bytes.<br />+ Fortschritt des Auftrags.<br />+ JDBC-Datenquellen.<br />+ Probleme mit Lesezeichen.<br />+ Abweichung über Auftragsausführungen hinweg.<br />Diese Metrik kann genauso verwendet werden wie die `glue.ALL.s3.filesystem.read_bytes`-Metrik mit dem Unterschied, dass diese Metrik am Ende einer Spark-Aufgabe aktualisiert wird und auch Nicht-S3-Datenquellen erfasst. | 
| `glue.driver.aggregate.elapsedTime` | Die ETL verstrichene Zeit in Millisekunden (schließt die Bootstrap-Zeiten des Auftrags nicht ein).<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Millisekunden<br />Kann verwendet werden, um zu ermitteln, wie lange eine Auftragsausführung im Durchschnitt dauert.<br />Einige Möglichkeiten, die Daten zu verwenden:+ Stellen Sie Alarme für Straggler ein.<br />+ Messen Sie die Abweichung über Auftragsausführungen hinweg. | 
| `glue.driver.aggregate.numCompletedStages` | Die Anzahl der abgeschlossenen Phasen im Auftrag.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Fortschritt des Auftrags.<br />+ Zeitachse pro Stufe der Auftragsausführung, wenn mit anderen Metriken korreliert.<br />Einige Möglichkeiten, die Daten zu verwenden:+ Identifizieren Sie anspruchsvolle Phasen bei der Ausführung eines Auftrags.<br />+ Stellen Sie Alarme für korrelierte Spikes (anspruchsvolle Phasen) über Auftragsausführungen hinweg ein. | 
| `glue.driver.aggregate.numCompletedTasks` | Die Anzahl der abgeschlossenen Aufgaben im Auftrag.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Fortschritt des Auftrags.<br />+ Parallelität innerhalb einer Phase. | 
| `glue.driver.aggregate.numFailedTasks` | Die Anzahl der fehlgeschlagenen Aufgaben.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Datenanomalien, die zum Scheitern von Aufträgen führen.<br />+ Clusteranomalien, die zum Scheitern von Aufträgen führen.<br />+ Skriptanomalien, die zum Scheitern von Aufträgen führen.<br />Die Daten können verwendet werden, um Alarme für erhöhte Ausfälle einzustellen, die Anomalien in Daten, Clustern oder Skripten andeuten könnten. | 
| `glue.driver.aggregate.numKilledTasks` | Anzahl der abgeschlossenen Aufgaben.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Unregelmäßigkeiten bei der Datenverzerrung, die zu Ausnahmen (OOMs) führen, die Aufgaben zum Erliegen bringen.<br />+ Abnormalitäten im Skript, die zu Ausnahmen (OOMs) führen, die Aufgaben beenden.<br />Einige Möglichkeiten, die Daten zu verwenden:+ Stellen Sie Alarme für erhöhte Ausfälle ein, die Datenanomalien anzeigen.<br />+ Stellen Sie Alarme für erhöhte Ausfälle ein, die Clusteranomalien anzeigen.<br />+ Stellen Sie Alarme für erhöhte Ausfälle ein, die Skriptanomalien anzeigen. | 
| `glue.driver.aggregate.recordsRead` | Die Anzahl der Datensätze, die von allen abgeschlossenen Spark-Aufgaben von allen Datenquellen gelesen und in allen Executors ausgeführt werden.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Gelesene Datensätze.<br />+ Fortschritt des Auftrags.<br />+ JDBC-Datenquellen.<br />+ Probleme mit Lesezeichen.<br />+ Verzerrung in Auftragsausführungen über mehrere Tage.<br />Diese Metrik kann genauso verwendet werden wie die `glue.ALL.s3.filesystem.read_bytes`-Metrik mit dem Unterschied, dass diese Metrik am Ende einer Spark-Aufgabe aktualisiert wird. | 
| `glue.driver.aggregate.shuffleBytesWritten` | Die Anzahl der Byte, die seit dem letzten Bericht von allen Executoren geschrieben wurden, um Daten zwischen ihnen zu mischen (aggregiert vom AWS Glue Metrics Dashboard als die Anzahl der Bytes, die zu diesem Zweck in der letzten Minute geschrieben wurden).<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Byte<br />Kann verwendet werden, um Folgendes zu überwachen: Datenmischung in Aufträgen (große Joins, GroupBy, Repartition, Coalesce).<br />Einige Möglichkeiten, die Daten zu verwenden:+ Repartitionieren oder Dekomprimieren Sie große Eingabedateien vor der weiteren Verarbeitung.<br />+ Repartitionieren Sie Daten einheitlicher, um Hotkeys zu vermeiden.<br />+ Vorfiltern von Daten vor Joins oder GroupBy-Operationen. | 
| `glue.driver.aggregate.shuffleLocalBytesRead` | Die Anzahl der Byte, die seit dem letzten Bericht von allen Executoren gelesen wurden, um Daten zwischen ihnen zu mischen (vom AWS Glue Metrics Dashboard als die Anzahl der zu diesem Zweck in der letzten Minute gelesenen Byte aggregiert).<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet.<br />Einheit: Byte<br />Kann verwendet werden, um Folgendes zu überwachen: Datenmischung in Aufträgen (große Joins, GroupBy, Repartition, Coalesce).<br />Einige Möglichkeiten, die Daten zu verwenden:+ Repartitionieren oder Dekomprimieren Sie große Eingabedateien vor der weiteren Verarbeitung.<br />+ Repartitionieren Sie Daten einheitlicher mit Hotkeys.<br />+ Vorfiltern von Daten vor Joins oder GroupBy-Operationen. | 
| `glue.driver.BlockManager.disk.diskSpaceUsed_MB` | Die Anzahl der Megabyte an Speicherplatz, die für alle Executoren verwendet werden.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Gauge).<br />Gültige Statistiken: Durchschnitt. Dies ist eine Spark-Metrik, die als absoluter Wert gemeldet wird.<br />Einheit: Megabyte<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Festplattenspeicher, der für Blöcke verwendet wird, die zwischengespeicherte RDD-Partitionen darstellen.<br />+ Festplattenspeicher, der für Blöcke verwendet wird, die Zwischenausgaben für Shuffle darstellen.<br />+ Festplattenspeicher, der für Blöcke verwendet wird, die Broadcasts darstellen.<br />Einige Möglichkeiten, die Daten zu verwenden:+ Identifizieren von Auftragsfehlern aufgrund erhöhter Festplattenauslastung.<br />+ Identifizieren Sie große Partitionen, die zum Fluten oder Mischen führen.<br />+ Erhöhen Sie die bereitgestellte DPU-Kapazität, um diese Probleme zu beheben. | 
| `glue.driver.ExecutorAllocationManager.executors.numberAllExecutors` | Die Anzahl der aktiven Auftrags-Executors.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Gauge).<br />Gültige Statistiken: Durchschnitt. Dies ist eine Spark-Metrik, die als absoluter Wert gemeldet wird.<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Auftragsaktivität.<br />+ Straggling-Executors (die nur mit ein paar Executors laufen)<br />+ Aktuelle Parallelität auf Executor-Ebene.<br />Einige Möglichkeiten, die Daten zu verwenden:+ Repartitionieren oder Dekomprimieren großer Eingabedateien im Voraus, wenn Cluster nicht ausgelastet ist.<br />+ Identifizieren Sie Verzögerungen bei der Ausführung von Phasen oder Aufträgen aufgrund von Straggler-Szenarien.<br />+ • Vergleichen Sie mit numberMaxNeeded Executors, um mehr über den Backlog bei der Bereitstellung zu erfahren. DPUs | 
| `glue.driver.ExecutorAllocationManager.executors.numberMaxNeededExecutors` | Die Anzahl der maximalen (aktiv ausgeführten und ausstehenden) Auftrags-Executors, die benötigt werden, um die aktuelle Last zu erfüllen.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Gauge).<br />Gültige Statistiken: Maximum. Dies ist eine Spark-Metrik, die als absoluter Wert gemeldet wird.<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Auftragsaktivität.<br />+ Aktuelle Parallelität auf Executor-Ebene und Rückstand bei ausstehenden Aufgaben, die noch nicht geplant sind, weil Executoren aufgrund der DPU-Kapazität oder der Executoren nicht verfügbar sind. killed/failed <br />Einige Möglichkeiten, die Daten zu verwenden:+  pending/backlog Identifizieren Sie die Warteschlange für die Terminplanung.<br />+ Identifizieren Sie Verzögerungen bei der Ausführung von Phasen oder Aufträgen aufgrund von Straggler-Szenarien.<br />+ Vergleichen Sie mit numberAllExecutors , um mehr über den Backlog bei der Bereitstellung zu erfahren. DPUs<br />+ Erhöhen Sie die bereitgestellte DPU-Kapazität, um den ausstehenden Executor-Backlog zu korrigieren. | 
| `glue.driver.jvm.heap.usage`<br />`glue.`*executorId*`.jvm.heap.usage`<br />`glue.ALL.jvm.heap.usage` | Den vom JVM-Heap für diesen Treiber (Skalierung: 0-1) verwendeten Speicheranteil – vom Treiber, einem durch executorId identifizierten Executor oder ALLE Executors.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Gauge).<br />Gültige Statistiken: Durchschnitt. Dies ist eine Spark-Metrik, die als absoluter Wert gemeldet wird.<br />Einheit: Prozentsatz<br />Kann für die Überwachung folgender Aspekte verwendet werden:+  out-of-memoryTreiberbedingungen (OOM) verwenden`glue.driver.jvm.heap.usage`.<br />+  out-of-memoryExecutor-Bedingungen (OOM) verwenden. `glue.ALL.jvm.heap.usage`<br />Einige Möglichkeiten, die Daten zu verwenden:+ Identifizieren Sie speicheraufwändige Executor-IDs und -Phasen.<br />+ Identifizieren Sie Straggling-Executor-IDs und -Phasen.<br />+ Identifizieren Sie einen out-of-memory Treiberzustand (OOM). <br />+ Identifizieren Sie eine out-of-memory Executor-Bedingung (OOM) und rufen Sie die entsprechende Executor-ID ab, um einen Stack-Trace aus dem Executor-Log abrufen zu können.<br />+ Identifizieren Sie Dateien oder Partitionen, die Datenverzerrungen aufweisen können, die zu Nachzüglern oder Bedingungen führen können (). out-of-memory OOMs | 
| `glue.driver.jvm.heap.used`<br />`glue.`*executorId*`.jvm.heap.used`<br />`glue.ALL.jvm.heap.used` | Die Anzahl der vom JVM-Heap verwendeten Speicherbytes für den Treiber, der durch *executorId* oder ALLE Executors identifiziert wurde.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Job), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Gauge).<br />Gültige Statistiken: Durchschnitt. Dies ist eine Spark-Metrik, die als absoluter Wert gemeldet wird.<br />Einheit: Byte<br />Kann für die Überwachung folgender Aspekte verwendet werden:+  out-of-memoryFahrerbedingungen (OOM).<br />+  out-of-memoryBedingungen für den Executor (OOM).<br />Einige Möglichkeiten, die Daten zu verwenden:+ Identifizieren Sie speicheraufwändige Executor-IDs und -Phasen.<br />+ Identifizieren Sie Straggling-Executor-IDs und -Phasen.<br />+ Identifizieren Sie einen out-of-memory Treiberzustand (OOM). <br />+ Identifizieren Sie eine out-of-memory Executor-Bedingung (OOM) und rufen Sie die entsprechende Executor-ID ab, um einen Stack-Trace aus dem Executor-Log abrufen zu können.<br />+ Identifizieren Sie Dateien oder Partitionen, die Datenverzerrungen aufweisen können, die zu Nachzüglern oder Bedingungen führen können (). out-of-memory OOMs | 
| `glue.driver.s3.filesystem.read_bytes`<br />`glue.`*executorId*`.s3.filesystem.read_bytes`<br />`glue.ALL.s3.filesystem.read_bytes` | Die Anzahl der Byte, die der Treiber, ein durch die *ExecutorID identifizierter Executor oder ALLE Executoren* seit dem letzten Bericht aus Amazon S3 gelesen haben (aggregiert vom AWS Glue Metrics Dashboard als Anzahl der in der letzten Minute gelesenen Byte).<br />Gültige Dimensionen: `JobName`, `JobRunId` und `Type` (Messung).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet. Der Bereich unter der Kurve im AWS Glue Metrics Dashboard kann verwendet werden, um die von zwei verschiedenen Jobläufen gelesenen Bytes visuell zu vergleichen.<br />Einheit: Byte.<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ ETL-Datenbewegung.<br />+ Fortschritt des Auftrags.<br />+ Probleme mit Auftragslesezeichen (verarbeitete, wiederverarbeitete und übersprungene Daten).<br />+ Vergleich der Lesevorgänge mit der Erfassungsrate aus externen Datenquellen.<br />+ Abweichung über Auftragsausführungen hinweg.<br />Die resultierenden Daten können verwendet werden für:+ DPU-Kapazitätsplanung.<br />+ Einstellen von Alarmen für große Daten-Spikes oder Einbrüche, die für Auftragsausführungen und Auftragsphasen gelesen werden. | 
| `glue.driver.s3.filesystem.write_bytes`<br />`glue.`*executorId*`.s3.filesystem.write_bytes`<br />`glue.ALL.s3.filesystem.write_bytes` | Die Anzahl der Byte, die der Treiber, ein durch die *ExecutorID identifizierter Executor oder ALLE Executoren* seit dem letzten Bericht in Amazon S3 geschrieben haben (aggregiert vom AWS Glue Metrics Dashboard als Anzahl der in der letzten Minute geschriebenen Byte).<br />Gültige Dimensionen: `JobName`, `JobRunId` und `Type` (Messung).<br />Gültige Statistiken: Summe Bei dieser Metrik handelt es sich um einen Deltawert gegenüber dem zuletzt gemeldeten Wert. Daher wird im AWS Glue Metrik-Dashboard eine SUM-Statistik für die Aggregation verwendet. Der Bereich unter der Kurve im AWS Glue Metrik-Dashboard kann verwendet werden, um die in zwei verschiedenen Jobläufen geschriebenen Bytes visuell zu vergleichen.<br />Einheit: Byte<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ ETL-Datenbewegung.<br />+ Fortschritt des Auftrags.<br />+ Probleme mit Auftragslesezeichen (verarbeitete, wiederverarbeitete und übersprungene Daten).<br />+ Vergleich der Lesevorgänge mit der Erfassungsrate aus externen Datenquellen.<br />+ Abweichung über Auftragsausführungen hinweg.<br />Einige Möglichkeiten, die Daten zu verwenden:+ DPU-Kapazitätsplanung.<br />+ Einstellen von Alarmen für große Daten-Spikes oder Einbrüche, die für Auftragsausführungen und Auftragsphasen gelesen werden. | 
| `glue.driver.streaming.numRecords` | Die Anzahl der Datensätze, die in einem Mikrobatch empfangen werden. Diese Metrik ist nur für AWS Glue Streaming-Jobs mit AWS Glue Version 2.0 und höher verfügbar.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Jobs), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe, Maximum, Minimum, Durchschnitt, Prozent<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Gelesene Datensätze.<br />+ Fortschritt des Auftrags. | 
| `glue.driver.streaming.batchProcessingTimeInMs` | Die Zeit, die für die Verarbeitung der Batches in Millisekunden benötigt wird. Diese Metrik ist nur für AWS Glue Streaming-Jobs mit AWS Glue Version 2.0 und höher verfügbar.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Jobs), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Anzahl).<br />Gültige Statistiken: Summe, Maximum, Minimum, Durchschnitt, Prozent<br />Einheit: Anzahl<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ Fortschritt des Auftrags.<br />+ Skript-Leistung. | 
| `glue.driver.system.cpuSystemLoad`<br />`glue.`*executorId*`.system.cpuSystemLoad`<br />`glue.ALL.system.cpuSystemLoad` | Der vom Treiber verwendete Anteil der CPU-Systemauslastung (Skalierung: 0-1) – ein durch *executorId* identifizierter Executor oder ALLE Executors.<br />Gültige Dimensionen: `JobName` (der Name des AWS Glue Jobs), `JobRunId` (die JobRun ID. oder`ALL`) und `Type` (Gauge).<br />Gültige Statistiken: Durchschnitt. Diese Metrik wird als absoluter Wert gemeldet.<br />Einheit: Prozentsatz<br />Kann für die Überwachung folgender Aspekte verwendet werden:+ CPU-Auslastung des Treibers.<br />+ CPU-Auslastung des Executors.<br />+ Erkennen von CPU-gebundenen oder E/A-gebundenen Executors oder Phasen in einem Auftrag.<br />Einige Möglichkeiten, die Daten zu verwenden:+ DPU-Kapazitätsplanung zusammen mit I/O-Metriken ( Read/Shuffle Byte-Bytes, Task-Parallelität) und Metrik zur Anzahl der maximal benötigten Executors.<br />+ Identifizieren Sie das CPU/E/A-gebundene Verhältnis. Dies ermöglicht eine Neupartitionierung und Erhöhung der bereitgestellten Kapazität für Aufträge mit langer Laufzeit mit aufteilbaren Datensätzen mit einer geringeren CPU-Auslastung.  | 

## AWS Glue Dimensionen für Metriken
<a name="awsglue-metricdimensions"></a>

AWS Glue Metriken verwenden den AWS Glue Namespace und stellen Metriken für die folgenden Dimensionen bereit:


| Dimension | Description | 
| --- | --- | 
| `JobName` | Diese Dimension filtert nach Metriken aller Jobausführungen eines bestimmten AWS Glue Jobs. | 
| `JobRunId` | Diese Dimension filtert nach Metriken eines bestimmten AWS Glue Jobs, der von einer JobRun ID ausgeführt wird, oder`ALL`. | 
| `Type` | Diese Dimension filtert nach Metriken entweder nach `count` (eine aggregierte Zahl) oder `gauge` (ein Wert zu einem bestimmten Zeitpunkt). | 

Weitere Informationen finden Sie im [ CloudWatch Amazon-Benutzerhandbuch](https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/).