View a markdown version of this page

Fase 4: Verifica e risoluzione dei problemi - AWS Batch

Le traduzioni sono generate tramite traduzione automatica. In caso di conflitto tra il contenuto di una traduzione e la versione originale in Inglese, quest'ultima prevarrà.

Fase 4: Verifica e risoluzione dei problemi

Dopo aver inviato un processo che attiva la scalabilità verticale dell'istanza, verifica che i file di log vengano visualizzati nel bucket Amazon S3.

Suggerimento

Per testare la raccolta di log prima di un'implementazione completa, imposta un valore diverso da zero nel tuo minvCpus ambiente di calcolo. Ciò impone AWS Batch la scalabilità di almeno un'istanza senza attendere l'invio di un lavoro. minvCpusRitorna a zero dopo il test per evitare costi inutili.

AWS Console
  1. Apri la console Amazon S3 all'indirizzo. https://console.aws.amazon.com/s3/

  2. Apri il bucket e vai al prefisso. ecs-logs/

  3. Verifica che vengano visualizzate le cartelle denominate con ID di istanza. Ogni cartella contiene sottodirectory per ogni origine di registro.

AWS CLI

Esegui il comando seguente per elencare gli oggetti di registro caricati:

aws s3 ls s3://host-level-logs-bucket/ecs-logs/ --recursive

Se il comando restituisce oggetti organizzati per ID di istanza, data e tag di origine, la raccolta dei log funziona correttamente.

Se i log non vengono visualizzati, connettiti all'istanza utilizzando SSH o SSM Session Manager per eseguire il debug dell'agente. Fluent Bit Verifica lo stato del servizio con. systemctl status fluent-bit Controlla /var/log/cloud-init-output.log per confermare che lo user-data script è stato eseguito correttamente.

Considerazioni relative a Spot e alle istanze di breve durata

Quando utilizzi spesso istanze Spot o ambienti di calcolo di breve durata con scalabilità fino a zero, prendi in considerazione le seguenti modifiche per evitare la perdita dei dati di registro:

  • Spot Reclaim Risk: riduci total_file_size i valori upload_timeout AND per cancellare i dati fluent-bit.conf di registro più frequentemente. In questo modo si riduce la finestra di dati che potrebbe andare persa se un'istanza viene recuperata.

  • Short-lived istanze: se si passa AWS Batch a zero tra un processo e l'altro, riduci l'Flushintervallo in upload_timeout modo che i dati raccolti vengano caricati prima che l'istanza termini.

  • Regole del ciclo di vita di Amazon S3: consigliamo di configurare una regola del ciclo di vita di Amazon S3 per far scadere o trasferire i vecchi oggetti di log in una classe di storage a basso costo. Ciò impedisce una crescita illimitata dello storage.