View a markdown version of this page

Schritt 4: Überprüfen und Fehler beheben - AWS Batch

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

Schritt 4: Überprüfen und Fehler beheben

Nachdem Sie einen Job eingereicht haben, der das Skalieren der Instanz auslöst, stellen Sie sicher, dass die Protokolldateien im Amazon S3 S3-Bucket angezeigt werden.

Tipp

Um die Protokollerfassung vor einem vollständigen Rollout minvCpus zu testen, legen Sie in Ihrer Rechenumgebung einen Wert ungleich Null fest. Dadurch AWS Batch muss mindestens eine Instanz hochskaliert werden, ohne auf die Einreichung eines Jobs warten zu müssen. Setzen Sie den Wert nach dem Testen minvCpus wieder auf Null zurück, um unnötige Kosten zu vermeiden.

AWS Console
  1. Öffnen Sie die Amazon S3 S3-Konsole unter https://console.aws.amazon.com/s3/.

  2. Öffnen Sie Ihren Bucket und navigieren Sie zum ecs-logs/ Präfix.

  3. Vergewissern Sie sich, dass Ordner mit Instanz-IDs angezeigt werden. Jeder Ordner enthält Unterverzeichnisse für jede Protokollquelle.

AWS CLI

Führen Sie den folgenden Befehl aus, um die hochgeladenen Protokollobjekte aufzulisten:

aws s3 ls s3://host-level-logs-bucket/ecs-logs/ --recursive

Wenn der Befehl Objekte zurückgibt, die nach Instanz-ID, Datum und Quelltag sortiert sind, funktioniert die Protokollerfassung ordnungsgemäß.

Wenn keine Protokolle angezeigt werden, stellen Sie mithilfe von SSH oder SSM Session Manager eine Verbindung zur Instanz her, um den Agenten zu debuggen. Fluent Bit Überprüfen Sie den Dienststatus mit. systemctl status fluent-bit Überprüfen /var/log/cloud-init-output.log Sie, ob das user-data Skript erfolgreich ausgeführt wurde.

Überlegungen zu Spot-Instances und kurzlebigen Instances

Wenn Sie Spot-Instances oder kurzlebige Rechenumgebungen verwenden, die häufig auf Null skalieren, sollten Sie die folgenden Anpassungen in Betracht ziehen, um den Verlust von Protokolldaten zu vermeiden:

  • Risiko der Spot-Rückgewinnung — Senken Sie die total_file_size Werte upload_timeout undfluent-bit.conf, um Protokolldaten häufiger zu löschen. Dadurch wird das Zeitfenster reduziert, in dem Daten verloren gehen können, wenn eine Instance zurückgefordert wird.

  • Short-lived Instanzen — Wenn die AWS Batch Skalierung zwischen Aufträgen auf Null erfolgt, verringern Sie das Flush Intervall, upload_timeout sodass die gesammelten Daten hochgeladen werden, bevor die Instanz beendet wird.

  • Amazon S3 S3-Lebenszyklusregeln — Wir empfehlen, eine Amazon S3 S3-Lebenszyklusregel so zu konfigurieren, dass sie abläuft oder alte Protokollobjekte in eine kostengünstigere Speicherklasse überführt. Dadurch wird ein unbegrenztes Speicherwachstum verhindert.