View a markdown version of this page

CloudWatch Metriken verwenden mit AWS Batch - AWS Batch

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

CloudWatch Metriken verwenden mit AWS Batch

AWS Batch veröffentlicht Jobkennzahlen an Amazon CloudWatch , um Zustandsübergänge und die Dauer von Jobs im Laufe ihres Lebenszyklus zu überwachen. AWS Batch veröffentlicht diese Metriken unter dem AWS/Batch Namespace ohne zusätzliche Kosten.

Metriken werden ausgegeben, wenn Jobs zwischen verschiedenen Bundesstaaten wechseln und wenn die Jobversuche abgeschlossen sind. Metriken für den Übergang von Bundesstaaten verfolgen, wie viele Jobs in einen bestimmten Bundesstaat eingetreten sind, und Kennzahlen für die Dauer verfolgen, wie lange Jobs oder Jobversuche damit verbracht wurden, zwischen Bundesstaaten zu wechseln. Verwenden Sie diese Metriken, um CloudWatch Dashboards zu erstellen, CloudWatch Alarme einzustellen und Leistungsbasislinien für Ihre Workloads festzulegen. Weitere Informationen finden Sie unter Verwenden von CloudWatch Metriken und Verwenden von CloudWatch Alarmen im Amazon-Benutzerhandbuch. CloudWatch

Das Berichtsverhalten für Aufträge anordnen Einzelknotenaufträge Multi-node parallele Jobs unterscheidet sich von diesen. In der Spalte „Berichtsverhalten“ in der folgenden Tabelle werden diese Fälle aufgeführt und das Array- und MNP-Verhalten detailliert Metriken für Array-Jobs und parallele Jobs mit mehreren Knoten beschrieben.

Anmerkung

AWS Batch gibt diese Metriken für Jobs aus, die an eine Auftragswarteschlange gesendet wurden. Alle Metriken werden mit der JobQueueName Dimension veröffentlicht. Sie können diese Dimension verwenden, um Metrikdaten nach der Job-Queue zu gruppieren und zu filtern, an die ein Job weitergeleitet wurde.

Wichtig

Diese Metriken werden nach bestem Bemühen bereitgestellt und dienen eher der Überwachung und Beobachtbarkeit als der Abrechnung, Prüfung oder Abstimmung. Da der Übergang zum Status einer Stelle ereignisgesteuert ist, kann es gelegentlich vorkommen, dass eine Kennzahl übersehen wird. Wenn beispielsweise ein Job zu laufen beginnt und dann fast sofort erfolgreich ist oder fehlschlägt, wird der Übergang in den RUNNING Status möglicherweise nicht beobachtet, bevor der Job seinen Endzustand erreicht. In diesem Fall werden die Metriken, die mit dem RUNNING Übergang für diesen Job verknüpft sind, AWS Batch nicht ausgegeben. Entwerfen Sie Alarme oder Dashboards so, dass gelegentliche Lücken toleriert werden, und verlassen Sie sich nicht auf genaue Zählungen, die aus diesen Metriken abgeleitet werden.

AWS Batch CloudWatch Metriken

AWS Batch sendet die folgenden Job-Metriken an CloudWatch. Metriken für Zustandsübergänge verwenden die Count Einheit und für Dauermetriken verwenden die Milliseconds Einheit.

Die folgenden Metriken gelten für AWS Batch Jobs, unabhängig vom Typ.

Metrik

Description

Einheiten

Verhalten melden

JobsSubmitted

Die Anzahl der Jobs, die an die Auftragswarteschlange gesendet wurden.

Anzahl

Wird ausgegeben, wenn ein Job zum ersten Mal eingereicht wird (wechselt in den SUBMITTED Status). Bei einem Array-Job entspricht der Wert der Größe des Arrays.

JobsMovedToPending

Die Anzahl der Jobs, die in den PENDING Bundesstaat verschoben wurden.

Anzahl

Wird ausgegeben, wenn ein Job nach verschoben wirdPENDING. Ein Job wird normalerweise so lange PENDING ausgeführt, bis er auf eine Jobabhängigkeit wartet.

JobsMovedToRunnable

Die Anzahl der Arbeitsplätze, die in den RUNNABLE Bundesstaat verlagert wurden.

Anzahl

Wird ausgegeben, wenn ein Job in den Status wechseltRUNNABLE, entweder beim ersten Mal oder als Ergebnis eines erneuten Versuchs.

JobsMovedToStarting

Die Anzahl der Jobs, die in den STARTING Bundesstaat verschoben wurden.

Anzahl

Wird ausgegeben, wenn ein Job nach verschoben wirdSTARTING.

JobsMovedToRunning

Die Anzahl der Jobs, die in den RUNNING Bundesstaat verlagert wurden.

Anzahl

Wird ausgegeben, wenn ein Job nach verschoben wirdRUNNING.

JobsMovedToSucceeded

Die Anzahl der Jobs, die erfolgreich abgeschlossen wurden.

Anzahl

Wird ausgegeben, wenn ein Job nach verschoben wirdSUCCEEDED.

JobsMovedToFailed

Die Anzahl der Jobs, die in den FAILED Bundesstaat verlagert wurden.

Anzahl

Wird ausgegeben, wenn ein Job den FAILED Bundesstaat betritt. Schließt Jobs ein, die storniert oder beendet wurden.

JobsCancelled

Die Anzahl der Jobs, die storniert wurden.

Anzahl

Wird ausgegeben, wenn ein Job aufgrund einer Stornierungsanforderung in den FAILED Status wechselt (bevor der Job gestartet wurde).

JobsTerminated

Die Anzahl der Jobs, die beendet wurden.

Anzahl

Wird ausgegeben, wenn ein Job aufgrund einer Kündigungsanforderung in den FAILED Status wechselt.

JobsRetried

Die Anzahl der Auftragsversuche, die erneut versucht wurden.

Anzahl

Wird ausgegeben, wenn ein Auftragsversuch fehlschlägt und der Auftrag erneut RUNNABLE versucht werden soll.

JobSubmittedToRunnableDuration

Die Zeit, die ein Job benötigt hat, um von SUBMITTED bis zu zu übergehen. RUNNABLE

Millisekunden

Wird ausgegeben, wenn der Job eingegeben wirdRUNNABLE. Bei einem untergeordneten Array-Job misst dies die Zeit zwischen der Übermittlung des übergeordneten Jobs und dem Zeitpunkt, zu dem der untergeordnete Job wurdeRUNNABLE.

JobAttemptStartingToRunningDuration

Die Zeit, die ein Jobversuch aufgewendet hat, STARTING bevor er ausgeführt wurde.

Millisekunden

Wird pro Versuch ausgegeben, wenn der Job eingegeben wirdRUNNING. Bei einem Auftrag, der erneut versucht wird, wird pro erreichtem Versuch ein Datenpunkt ausgegeben. RUNNING

JobAttemptExecutionDuration

Die Zeit, die ein Jobversuch mit der Ausführung verbracht hat, gemessen vom Beginn des Versuchs bis zum Ende des Versuchs.

Millisekunden

Wird ausgegeben, wenn ein Auftragsversuch abgeschlossen ist, gemessen vom Beginn des Versuchs bis zum Ende des Versuchs.

JobAttemptDuration

Die Gesamtzeit, die ein Jobversuch gedauert hat, gemessen vom Beginn des Versuchs STARTING bis zum Ende des Versuchs.

Millisekunden

Wird ausgegeben, wenn ein Versuch endet. Der Versuch endet entweder, wenn der Job einen Endzustand (SUCCEEDEDoderFAILED) erreicht oder wenn er erneut RUNNABLE versucht werden muss.

Die folgenden Metriken gelten nur für AWS Batch Rechenaufträge.

Metrik

Description

Einheiten

Verhalten melden

JobSubmittedToFirstStartingDuration

Die Zeit, die es gedauert hat, SUBMITTED bis ein Job zum ersten Mal eingegangen istSTARTING.

Millisekunden

Wird beim ersten Versuch ausgegeben, wenn der Job zum ersten Mal eingegeben wirdSTARTING.

JobAttemptRunnableToStartingDuration

Die Zeit, die ein Jobversuch aufgewendet hat, RUNNABLE bevor er gestartet wurde.

Millisekunden

Wird ausgegeben, wenn der Job eingegeben wirdSTARTING.

Die folgenden Metriken gelten nur fürServiceaufträge in AWS Batch.

Metrik

Description

Einheiten

Verhalten melden

JobsMovedToScheduled

Die Anzahl der Jobs, die in den SCHEDULED Bundesstaat verlagert wurden.

Anzahl

Wird für Serviceaufträge ausgegeben, wenn der Job zum ersten Mal in den Job wechseltSCHEDULED, und jedes Mal, wenn der Auftrag SCHEDULED nach einer Unterbrechung in den Status wechselt.

JobSubmittedToFirstScheduledDuration

Die Zeit, die es gedauert hat, bis ein Servicejob SUBMITTED zum ersten Mal eingegangen ist. SCHEDULED

Millisekunden

Wird für Serviceaufträge ausgegeben, wenn der Auftrag zum ersten Mal dorthin verschoben wirdSCHEDULED.

JobAttemptRunnableToScheduledDuration

Die Zeit, die ein Jobversuch aufgewendet hat, RUNNABLE bevor er verschoben wurdeSCHEDULED.

Millisekunden

Wird pro Versuch ausgegeben, wenn ein Serviceauftrag zu einem Serviceauftrag wechseltSCHEDULED, SCHEDULED und zwar sowohl beim ersten Wechsel des Auftrags zu als auch bei jedem Wechsel SCHEDULED nach einer Sperrung.

JobAttemptScheduledToStartingDuration

Die Zeit, die ein Versuch eines Serviceauftrags zwischen dem ersten Wechsel zu SCHEDULED und dem Wechsel zu ihm verging. STARTING

Millisekunden

Wird für Serviceaufträge ausgegeben, wenn der Auftrag von SCHEDULED nach verschoben wirdSTARTING.

JobsPreempted

Die Anzahl der Jobs, die verhindert wurden.

Anzahl

Wird für Aufträge zur Kontingentverwaltung jedes Mal ausgegeben, wenn der Auftrag unterbrochen wird.

Metriken für Array-Jobs und parallele Jobs mit mehreren Knoten

AWS Batch steht für Aufträge anordnen und Multi-node parallele Jobs als übergeordneten Job, der eine oder mehrere untergeordnete Jobs verfolgt. Damit ein einzelner logischer Job nicht zweimal gezählt wird, AWS Batch werden je nach Jobtyp nur Kennzahlen aus einem dieser beiden Datensätze ausgegeben.

Aufträge anordnen

Der übergeordnete Array-Job gibt keine Metriken aus, mit Ausnahme vonJobsSubmitted. Stattdessen gibt jeder untergeordnete Array-Job diese Metriken im Laufe des Job-Lebenszyklus unabhängig voneinander aus, sodass die Anzahl der Metriken die Anzahl der untergeordneten Jobs und nicht die Anzahl der übermittelten Array-Jobs widerspiegelt.

Die JobsSubmitted Metrik wird bei der Übermittlung einmal für den übergeordneten Array-Job ausgegeben, und ihr Wert entspricht der Größe des Arrays (der Anzahl der untergeordneten Jobs). Wenn Sie beispielsweise einen Array-Job mit 1.000 untergeordneten Objekten senden, wird ein einzelner JobsSubmitted Datenpunkt mit dem Wert von veröffentlicht1000.

Dauermesswerte, die die Zeit seit der Übermittlung messen — wie z. B. JobSubmittedToRunnableDuration — werden pro untergeordnetem Array-Job ausgegeben. Sie messen den Zeitraum, an dem das übergeordnete Array-Objekt gesendet wurde, bis zu dem Zeitpunkt, an dem das untergeordnete Element den betreffenden Status erreicht hat.

Multi-node parallele (MNP) Jobs

MNP-Metriken werden vom übergeordneten MNP-Job ausgegeben, der den Auftrag als Ganzes darstellt. Die einzelnen untergeordneten MNP-Jobs (Knotenjobs) geben diese Metriken nicht aus. Daher wird ein MNP-Job einmal gezählt, unabhängig davon, wie viele Knoten er verwendet.

Dimensionen für AWS Batch CloudWatch Metriken

AWS Batch verwendete Job-Metriken in CloudWatch einer einzigen Dimension:JobQueueName. Alle Metrikdaten werden nach dem Namen der Job-Warteschlange gruppiert und gefiltert, an die ein Job weitergeleitet wurde.

Anzeigen AWS Batch CloudWatch Metriken

Sie können AWS Batch Job-Metriken in der AWS Batch Konsole oder in der CloudWatch Konsole unter dem AWS/Batch Namespace anzeigen.

Wichtig

Für die Anzeige von Metriken in der Konsole fallen CloudWatch Standardgebühren an. Sie können die Anzeige von Metriken jederzeit deaktivieren, um die Gebühren zu beenden. Weitere Informationen finden Sie unter CloudWatch Amazon-Preise.

Um Metriken im Batch-Metriken-Dashboard anzuzeigen

  1. Öffnen Sie die AWS Batch -Konsole.

  2. Wählen Sie im Navigationsbereich Dashboard und anschließend den Tab Batch-Metriken aus.

  3. Aktiviere „ CloudWatch Metriken anzeigen“.

  4. Wählen Sie unter Metriken filtern bis zu fünf Auftragswarteschlangen und die Metriken aus, die Sie grafisch darstellen möchten.

  5. Wählen Sie Filter anwenden aus. Die Konsole zeigt ein Diagramm pro Metrik mit einer Zeile pro Job-Warteschlange.

  6. Um von vorne zu beginnen, wählen Sie Filter löschen, um Ihre Auswahl zu entfernen, oder Filter zurücksetzen, um die Standardeinstellungen wiederherzustellen.

  7. (Optional) Um eine Kombination aus Auftragswarteschlangen und Messwerten wiederzuverwenden, arbeiten Sie mit einem gespeicherten Filtersatz. Filtersätze werden in Ihren AWS Benutzereinstellungen gespeichert, sodass sie über alle Sitzungen hinweg bestehen bleiben. Sie können bis zu fünf davon speichern. Verwalte sie über das Drop-down-Menü Gespeicherte Filtersätze und das Pfeilmenü auf der Schaltfläche Filter löschen und wähle dann eine der folgenden Optionen aus:

    • Speichern — Wählen Sie Ihre Auftragswarteschlangen und Kennzahlen aus und wählen Sie dann Als neuen Filtersatz speichern aus. Geben Sie einen eindeutigen Namen ein und markieren Sie ihn optional als Standard.

    • Anwenden — Wählen Sie ein Set aus der Dropdownliste Gespeicherte Filtersätze aus und wählen Sie dann Filter anwenden aus.

    • Aktualisieren — Wenn Sie ein Set ausgewählt haben, ändern Sie Ihre Auswahl und wählen Sie Aktuellen Filtersatz aktualisieren.

    • Als Standard festlegen — Wenn Sie ein Set ausgewählt haben, wählen Sie „Einstellungen“ und dann „Als Standard festlegen“. Das Standardset wird automatisch geladen, wenn Sie den Tab öffnen.

    • Löschen — Wenn ein Satz ausgewählt ist, wählen Sie Aktuellen Filtersatz löschen.

So zeigen Sie Kennzahlen für eine einzelne Job-Warteschlange an

  1. Wählen Sie im Navigationsbereich Job-Warteschlangen und dann eine Job-Warteschlange aus.

  2. Wählen Sie die Registerkarte Überwachung.

  3. Aktivieren Sie „ CloudWatch Metriken anzeigen“.

  4. Verwenden Sie in den Abschnitten Metriken für Statusübergänge , Metriken für Lebenszyklusereignisse und Kennzahlen für Dauer die einzelnen Metriken, um auszuwählen, welche Metriken grafisch dargestellt werden sollen.

Die angezeigten Metriken beziehen sich auf diese Job-Warteschlange. Ihre Auswahl wird pro Auftragswarteschlange gespeichert und bleibt sitzungsübergreifend bestehen.

Um direkt mit diesen Metriken zu arbeiten, CloudWatch z. B. um Dashboards zu erstellen oder Alarme einzustellen, öffnen Sie die CloudWatch Konsole und wählen Sie den Namespace aus. AWS/Batch