As traduções são geradas por tradução automática. Em caso de conflito entre o conteúdo da tradução e da versão original em inglês, a versão em inglês prevalecerá.
Etapa 4: Verificar e solucionar problemas
Depois de enviar um trabalho que aciona o aumento de escala da instância, verifique se os arquivos de log aparecem no bucket do Amazon S3.
dica
Para testar a coleta de registros antes de uma implantação completa, minvCpus defina como um valor diferente de zero em seu ambiente computacional. Isso força AWS Batch a escalabilidade de pelo menos uma instância sem esperar pelo envio de um trabalho. minvCpusVolte para zero após o teste para evitar custos desnecessários.
Se os registros não estiverem aparecendo, conecte-se à instância usando SSH ou SSM Session Manager para depurar o agente. Fluent Bit Verifique o status do serviço comsystemctl status fluent-bit. /var/log/cloud-init-output.logRevise para confirmar se o user-data script foi executado com êxito.
Considerações sobre instâncias spot e de curta duração
Ao usar instâncias spot ou ambientes de computação de curta duração que escalam para zero com frequência, considere os seguintes ajustes para evitar a perda de dados de registro:
Risco de recuperação pontual — Reduza os
total_file_sizevalores deupload_timeoutefluent-bit.confpara liberar os dados de registro com mais frequência. Isso reduz a janela de dados que podem ser perdidos se uma instância for recuperada.Short-lived instâncias — Ao AWS Batch escalar para zero entre os trabalhos, diminua o
Flushintervaloupload_timeoutpara que os dados coletados sejam carregados antes que a instância seja encerrada.Regras do ciclo de vida do Amazon S3 — Recomendamos configurar uma regra de ciclo de vida do Amazon S3 para expirar ou fazer a transição de objetos de log antigos para uma classe de armazenamento de menor custo. Isso evita o crescimento ilimitado do armazenamento.