View a markdown version of this page

Etapa 4: Verificar e solucionar problemas - AWS Batch

As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.

Etapa 4: Verificar e solucionar problemas

Depois de enviar um trabalho que aciona o aumento de escala da instância, verifique se os arquivos de log aparecem no bucket do Amazon S3.

dica

Para testar a coleta de registros antes de uma implantação completa, minvCpus defina como um valor diferente de zero em seu ambiente computacional. Isso força AWS Batch a escalabilidade de pelo menos uma instância sem esperar pelo envio de um trabalho. minvCpusVolte para zero após o teste para evitar custos desnecessários.

AWS Console
  1. Abra o console do Amazon S3 em https://console.aws.amazon.com/s3/.

  2. Abra seu bucket e navegue até o ecs-logs/ prefixo.

  3. Confirme se as pastas nomeadas com IDs de instância aparecem. Cada pasta contém subdiretórios para cada fonte de log.

AWS CLI

Execute o comando a seguir para listar os objetos de log carregados:

aws s3 ls s3://host-level-logs-bucket/ecs-logs/ --recursive

Se o comando retornar objetos organizados por ID de instância, data e tag de origem, a coleta de registros está funcionando corretamente.

Se os registros não estiverem aparecendo, conecte-se à instância usando SSH ou SSM Session Manager para depurar o agente. Fluent Bit Verifique o status do serviço comsystemctl status fluent-bit. /var/log/cloud-init-output.logRevise para confirmar se o user-data script foi executado com êxito.

Considerações sobre instâncias spot e de curta duração

Ao usar instâncias spot ou ambientes de computação de curta duração que escalam para zero com frequência, considere os seguintes ajustes para evitar a perda de dados de registro:

  • Risco de recuperação pontual — Reduza os total_file_size valores de upload_timeout e fluent-bit.conf para liberar os dados de registro com mais frequência. Isso reduz a janela de dados que podem ser perdidos se uma instância for recuperada.

  • Short-lived instâncias — Ao AWS Batch escalar para zero entre os trabalhos, diminua o Flush intervalo upload_timeout para que os dados coletados sejam carregados antes que a instância seja encerrada.

  • Regras do ciclo de vida do Amazon S3 — Recomendamos configurar uma regra de ciclo de vida do Amazon S3 para expirar ou fazer a transição de objetos de log antigos para uma classe de armazenamento de menor custo. Isso evita o crescimento ilimitado do armazenamento.