View a markdown version of this page

Langkah 4: Verifikasi dan pecahkan masalah - AWS Batch

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

Langkah 4: Verifikasi dan pecahkan masalah

Setelah mengirimkan pekerjaan yang memicu peningkatan skala instans, verifikasi bahwa file log muncul di bucket Amazon S3.

Tip

Untuk menguji pengumpulan log sebelum peluncuran penuh, setel minvCpus ke nilai bukan nol di lingkungan komputasi Anda. Ini memaksa AWS Batch untuk meningkatkan setidaknya satu contoh tanpa menunggu pengajuan pekerjaan. Atur minvCpus kembali ke nol setelah pengujian untuk menghindari biaya yang tidak perlu.

AWS Console
  1. Buka konsol Amazon S3 di. https://console.aws.amazon.com/s3/

  2. Buka ember Anda dan arahkan ke ecs-logs/ awalan.

  3. Konfirmasikan bahwa folder bernama dengan ID instance muncul. Setiap folder berisi subdirektori untuk setiap sumber log.

AWS CLI

Jalankan perintah berikut untuk daftar objek log yang diunggah:

aws s3 ls s3://host-level-logs-bucket/ecs-logs/ --recursive

Jika perintah mengembalikan objek yang diatur oleh ID instance, tanggal, dan tag sumber, pengumpulan log berfungsi dengan benar.

Jika log tidak muncul, sambungkan ke instance dengan menggunakan SSH atau SSM Session Manager untuk men-debug agen. Fluent Bit Periksa status layanan dengansystemctl status fluent-bit. Tinjau /var/log/cloud-init-output.log untuk mengonfirmasi bahwa user-data skrip berhasil dijalankan.

Pertimbangan untuk instans Spot dan berumur pendek

Bila Anda menggunakan instans Spot atau lingkungan komputasi berumur pendek yang sering menskalakan ke nol, pertimbangkan penyesuaian berikut untuk menghindari kehilangan data log:

  • Risiko reklaim spot — Turunkan nilai upload_timeout dan total_file_size nilai fluent-bit.conf untuk menyiram data log lebih sering. Ini mengurangi jendela data yang mungkin hilang jika sebuah instance direklamasi.

  • Short-lived instance — Ketika AWS Batch skala ke nol di antara pekerjaan, turunkan Flush interval dan upload_timeout agar data yang dikumpulkan diunggah sebelum instance berakhir.

  • Aturan siklus hidup Amazon S3 — Sebaiknya konfigurasi aturan siklus hidup Amazon S3 agar kedaluwarsa atau mentransisikan objek log lama ke kelas penyimpanan berbiaya lebih rendah. Ini mencegah pertumbuhan penyimpanan tak terbatas.