Cotas Lambda
Importante
Novas Contas da AWS reduziram as cotas de simultaneidade e de memória para as funções do Lambda e para Lambda MicroVMs. A AWS aumenta essas cotas automaticamente com base na utilização.
AWS LambdaO foi projetado para escalar rapidamente para atender à demanda, permitindo que suas funções aumentem a escala verticalmente para atender ao tráfego em sua aplicação. O Lambda foi projetado para tarefas computacionais de curta duração que não retêm nem dependem do estado entre invocações. O código pode ser executado por até 15 minutos em uma única invocação, e uma única função pode usar até 10.240 MB de memória.
É importante entender as barreiras de proteção que são implementadas para proteger sua conta e workloads de outros clientes. O Service Quotas está disponível em todos os serviços da AWS e consistem em limites rígidos, que você não pode alterar, e limites flexíveis, para os quais você pode solicitar aumentos. Por padrão, todas as novas contas recebem um perfil de cota que permite a exploração dos serviços da AWS.
Para ver as cotas que se aplicam à sua conta, navegue até o painel do Service Quotas
As seções abaixo listam cotas e limites padrão no Lambda por categoria.
Tópicos
Computação e armazenamento
O Lambda define cotas para a quantidade de recursos computacionais e de armazenamento que você pode usar para executar e armazenar funções. As cotas para execuções simultâneas e armazenamento são aplicadas por Região da AWS. As cotas de interface de rede elástica (ENI) se aplicam por nuvem privada virtual (VPC), qualquer que seja a região. As cotas a seguir podem ser aumentadas dos valores padrão. Para obter mais informações, consulte Solicitar um aumento de cota no Guia do usuário do Service Quotas..
| Recurso | Cota padrão | Pode ser aumentado até |
|---|---|---|
|
Execuções simultâneas |
1.000 |
Dezenas de milhares |
|
Armazenamento para funções carregadas (arquivos .zip) e camadas que usam o armazenamento gerenciado pelo Lambda. Cada versão da função e versão da camada consome armazenamento. Para evitar os limites de armazenamento, você pode configurar suas funções e camadas para usar o armazenamento de código do S3 autogerenciado. Para práticas recomendadas para o gerenciamento do armazenamento do seu código, consulte Monitoring Lambda code storage |
300 GB (descompactado) |
Não pode ser aumentado. Use o armazenamento de código do S3 autogerenciado para armazenamento além desse limite. |
|
Armazenamento para funções definidas como imagens de contêiner Essas imagens são armazenadas no Amazon ECR. |
Consulte Cotas de serviço do Amazon ECR. |
|
|
Interfaces de rede elásticas por Virtual Private Cloud (VPC) notaEsta cota é compartilhada com outros serviços, como o Amazon Elastic File System (Amazon EFS). Consulte Cotas da Amazon VPC. |
500 |
Milhares |
Para obter detalhes sobre a simultaneidade e sobre como o Lambda dimensiona a simultaneidade da função em resposta ao tráfego, consulte Como entender a escalabilidade da função do Lambda.
Configuração, implantação e execução de funções
As cotas a seguir se aplicam à configuração de funções, às implantações e à execução. Exceto quando indicado, elas não podem ser alteradas.
nota
A documentação do Lambda, as mensagens de log e o console usam a abreviatura MB (em vez de MiB) para se referir a 1.024 KB.
| Recurso | Quota |
|---|---|
|
Alocação de memória da função |
128 MB a 10.240 MB, em incrementos de 1 MB. Observação: o Lambda aloca capacidade da CPU na proporção da quantidade de memória configurada. É possível aumentar ou diminuir a memória e a potência da CPU alocada para a função usando a configuração Memória (MB). Com 1.769 MB, uma função tem o equivalente a uma vCPU. |
|
Tempo limite da função |
900 segundos (15 minutos) |
|
Variáveis de ambiente da função |
4 KB, para todas as variáveis de ambiente associadas à função, em agregado |
|
Política baseada em recursos da função |
20 KB |
|
Função camadas |
5 camadas |
|
Limite de escalabilidade de simultaneidade de funções |
Para cada função, mil ambientes de execução a cada dez segundos |
|
Carga da invocação (solicitação e resposta) |
6 MB cada para solicitação e resposta (síncrona) 200 MB para cada resposta enviada por streaming (síncrona) 1 MB (assíncrona) 1 MB para o tamanho total combinado dos valores de linha e de cabeçalho da solicitação |
|
Largura de banda para respostas enviadas por streamig |
Ilimitada para os primeiros 6 MB da resposta da função Para respostas maiores que 6 MB, 2 MBps para o restante da resposta |
|
Largura de banda da rede por ambiente de execução |
625 Mbps. Para funções não vinculadas a uma VPC, é possível solicitar um aumento por meio do console do Service Quotas |
|
Tamanho dopacote de implantação (arquivo .zip) |
50 MB (compactado, quando carregado por meio dos SDKs ou da API do Lambda). Carregue arquivos maiores com o Amazon S3. 50 MB (quando carregado pelo console do Lambda) 250 MB O tamanho máximo do conteúdo de um pacote de implantação, inclusive camadas e runtimes personalizados (descompactado). |
|
Tamanho das configurações de imagem de contêiner |
16 KB |
|
Tamanho do pacote do código da imagem do contêiner |
10 GB (tamanho máximo de imagem descompactada, incluindo todas as camadas) |
|
Eventos de teste (editor de console) |
10 |
|
|
Entre 512 MB e 10.240 MB, em incrementos de 1 MB |
|
Descrições do arquivo |
1,024 notaAs instâncias gerenciadas do Lambda utilizam um limite mais alto de descritores de arquivo, de 4.096. Para obter mais informações, consulte Noções básicas sobre o ambiente de execução das instâncias gerenciadas do Lambda. |
|
Processos de execução/threads |
1,024 notaAs instâncias gerenciadas do Lambda usam o processo padrão e os limites de threads do Bottlerocket |
Solicitações da API do Lambda
As cotas a seguir estão associadas a solicitações de API do Lambda.
| Recurso | Quota |
|---|---|
|
Solicitações de invocação por função por região (síncronas) |
Cada instância do ambiente de execução pode atender até dez solicitações por segundo. Em outras palavras, o limite total de invocação corresponde a dez vezes o limite de simultaneidade. Consulte Como entender a escalabilidade da função do Lambda. |
|
Solicitações de invocação por função por região (assíncronas) |
Cada instância do ambiente de execução pode atender a um número ilimitado de solicitações. Em outras palavras, o limite total de invocação é baseado somente na simultaneidade disponível para a função. Consulte Como entender a escalabilidade da função do Lambda. |
|
Solicitações de invocação por alias ou versão de função (solicitações por segundo) |
10 x simultaneidade provisionada alocada notaEssa cota se aplica somente às funções que usam simultaneidade provisionada. |
|
Solicitações da API GetFunction |
100 solicitações por segundo. Não pode ser aumentado. |
|
Solicitações de API GetPolicy |
15 solicitações por segundo. Não pode ser aumentado. |
|
Restante das solicitações da API do ambiente de gerenciamento (exclui solicitações de invocação, GetFunction e GetPolicy) |
15 solicitações por segundo em todas as APIs (não 15 solicitações por segundo por API). Não pode ser aumentado. |
Funções duráveis
As cotas a seguir se aplicam às funções duráveis. As cotas são aplicáveis por Região da AWS. Padrões mais altos se aplicam nas regiões Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e Europa (Irlanda), conforme indicado na tabela. Exceto conforme indicado, essas cotas podem ser aumentadas. Para obter mais informações, consulte Solicitar um aumento de cota no Guia do usuário do Service Quotas..
| Recurso | Cota padrão |
|---|---|
|
Execuções duráveis de execução máxima |
5.000.000 por região. 10.000.000 no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e na Europa (Irlanda). Esse é um limite flexível que pode ser aumentado. |
|
Número máximo de operações duráveis por execução durável |
3.000 Não pode ser aumentado. Para mais informações, consulte Operações duráveis disponíveis. |
|
Armazenamento de execução durável escrito em megabytes |
100 MB Não pode ser aumentado. O tamanho cumulativo da carga útil persistiu por funções duráveis por execução. Para mais informações, consulte dados persistentes por operação durável. |
|
Taxa de invocação da função para iniciar execuções duráveis |
300 solicitações por segundo. |
|
Solicitações da API CheckpointDurableExecution |
10.000 solicitações por segundo. 20.000 solicitações por segundo no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e na Europa (Irlanda). |
|
Solicitações da API GetDurableExecution |
30 solicitações por segundo. |
|
Solicitações da API GetDurableExecutionHistory |
15 solicitações por segundo. |
|
Solicitações da API GetDurableExecutionState |
10.000 solicitações por segundo. 20.000 solicitações por segundo no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e na Europa (Irlanda). |
|
Solicitações da API ListDurableExecutionsByFunction |
15 solicitações por segundo. |
|
Solicitações da API SendDurableExecutionCallbackFailure |
3.000 solicitações por segundo. 6.000 solicitações por segundo no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e na Europa (Irlanda). |
|
Solicitações da API SendDurableExecutionCallbackHeartbeat |
3.000 solicitações por segundo. 6.000 solicitações por segundo no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e na Europa (Irlanda). |
|
Solicitações da API SendDurableExecutionCallbackSuccess |
3.000 solicitações por segundo. 6.000 solicitações por segundo no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e na Europa (Irlanda). |
|
Solicitações da API StopDurableExecution |
300 solicitações por segundo. 600 solicitações por segundo no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon) e na Europa (Irlanda). |
Lambda MicroVMs
O Lambda MicroVMs define cotas para solicitações de computação, armazenamento e API. As cotas marcadas como ajustáveis podem ser aumentadas por meio do console do Service Quotas.
nota
O Lambda MicroVMs oferece suporte à arquitetura ARM64 (AWS Graviton)
Computação e armazenamento
| Recurso | Cota padrão | Ajustável |
|---|---|---|
| Memória alocada em todas as microVMs (por conta, por região) |
400 GB (ou seja, 200 MicroVMs com 2 GB de memória configurada cada ou 400 MicroVMs com 1 GB de memória configurada cada). 1.024 GB no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon), Leste dos EUA (Ohio) e Ásia-Pacífico (Tóquio) (ou seja, 512 MicroVMs com 2 GB de memória configurada cada ou 1.024 MicroVMs com 1 GB de memória configurada cada). Expansível até quatro vezes essa cota. |
Sim |
| Duração máxima da execução por microVM | 8 horas (28.800 segundos) | Não |
Imagens e versões
| Recurso | Cota padrão | Ajustável |
|---|---|---|
| Imagens de microVM por conta, por região | 100 | Sim |
| Versões por imagem de microVM | 50 | Sim |
| Criações simultâneas de imagens (por conta, por região) |
5 10 no Leste dos EUA (Norte da Virgínia), Oeste dos EUA (Oregon), Leste dos EUA (Ohio) e Ásia-Pacífico (Tóquio) |
Sim |
Throughput por microVM
| Recurso | Limite | Ajustável |
|---|---|---|
| Conexões simultâneas por microVM | 8 (1 vCPU), 16 (2 vCPU), 32 (4 vCPU), 64 (8 vCPU), 128 (16 vCPU) | Não |
| Solicitações por segundo por microVM | 40 (4 vCPU/8 GB), 160 (16 vCPU/32 GB) | Não |
Limites das taxas de API
| Operação de API | Taxa (TPS) | Intermitência | Ajustável |
|---|---|---|---|
RunMicrovm |
5 | 5 | Sim |
ResumeMicrovm |
5 | 5 | Sim |
SuspendMicrovm |
2 | 2 | Sim |
TerminateMicrovm |
10 | 10 | Sim |
GetMicrovm |
100 | 100 | Sim |
CreateMicrovmAuthToken |
50 | 50 | Sim |
CreateMicrovmShellAuthToken |
5 | 5 | Sim |
nota
TPS = transações por segundo. Esses limites de taxa são por conta, por região. Tente novamente as solicitações com controle de utilização usando o recuo exponencial com instabilidade.
Outros serviços
Cotas para outros serviços, como o AWS Identity and Access Management (IAM), Amazon CloudFront (Lambda @Edge) e Amazon Virtual Private Cloud (Amazon VPC) podem afetar as funções do Lambda. Para obter mais informações, consulte AWS service (Serviço da AWS) quotas, na Referência geral da Amazon Web Services, e Invocando o Lambda com eventos de outros serviços da AWS.
Muitas aplicações que envolvem o Lambda usam vários serviços da AWS. Como serviços diferentes apresentam cotas diferentes para vários recursos, pode ser desafiador gerenciar essas cotas em toda a aplicação. Por exemplo, o API Gateway tem um limite padrão de controle de utilização de 10.000 solicitações por segundo, enquanto o Lambda tem um limite padrão de simultaneidade de 1.000. Por causa dessa incompatibilidade, é possível ter mais solicitações recebidas do API Gateway do que o Lambda é capaz de processar. É possível resolver isso solicitando um aumento do limite de concorrência do Lambda para corresponder ao nível esperado de tráfego.
O teste de carga da aplicação ajuda a monitorar a performance da aplicação de ponta a ponta antes de implantá-la na produção. Durante um teste de carga, você pode identificar quaisquer cotas que talvez atuem como um fator limitante para os níveis de tráfego esperados e tomar as medidas necessárias.