View a markdown version of this page

Paso 4: Verificar y solucionar problemas - AWS Batch

Las traducciones son generadas a través de traducción automática. En caso de conflicto entre la traducción y la version original de inglés, prevalecerá la version en inglés.

Paso 4: Verificar y solucionar problemas

Después de enviar un trabajo que active el escalado de la instancia, compruebe que los archivos de registro aparecen en el bucket de Amazon S3.

sugerencia

Para probar la recopilación de registros antes de una implementación completa, minvCpus establézcala en un valor distinto de cero en tu entorno informático. Esto obliga AWS Batch a ampliar al menos una instancia sin esperar a que se envíe un trabajo. minvCpusVuelva a cero después de las pruebas para evitar costes innecesarios.

AWS Console
  1. Abra la consola de Amazon S3 en https://console.aws.amazon.com/s3/.

  2. Abre el depósito y navega hasta el ecs-logs/ prefijo.

  3. Confirma que aparezcan las carpetas nombradas con los ID de instancia. Cada carpeta contiene subdirectorios para cada fuente de registro.

AWS CLI

Ejecute el siguiente comando para ver una lista de los objetos de registro cargados:

aws s3 ls s3://host-level-logs-bucket/ecs-logs/ --recursive

Si el comando devuelve los objetos organizados por ID de instancia, fecha y etiqueta de origen, la recopilación de registros funciona correctamente.

Si los registros no aparecen, conéctese a la instancia mediante SSH o el administrador de sesiones SSM para depurar el agente. Fluent Bit Compruebe el estado del servicio con. systemctl status fluent-bit Revise /var/log/cloud-init-output.log para confirmar que el user-data script se ejecutó correctamente.

Consideraciones sobre las instancias puntuales y de corta duración

Cuando utilice instancias puntuales o entornos de cómputo de corta duración que se escalen a cero con frecuencia, tenga en cuenta los siguientes ajustes para evitar la pérdida de datos de registro:

  • Riesgo de recuperación puntual: reduzca los total_file_size valores upload_timeout y fluent-bit.conf para vaciar los datos de registro con mayor frecuencia. Esto reduce la cantidad de datos que podría perderse si se recupera una instancia.

  • Short-lived instancias: cuando se AWS Batch escale a cero entre trabajos, reduzca el Flush intervalo upload_timeout para que los datos recopilados se carguen antes de que finalice la instancia.

  • Reglas del ciclo de vida de Amazon S3: recomendamos configurar una regla del ciclo de vida de Amazon S3 para que caduque o haga la transición de los objetos de registro antiguos a una clase de almacenamiento de menor coste. Esto evita un crecimiento ilimitado del almacenamiento.