Adicione o orçamento de memória simultânea
Comece com processos que se sobrepõem, não com suas médias silenciosas. Uma planilha ilustrativa de 4 GB poderia reservar 700 MiB para ferramentas do host, 900 MiB para processos da API, 1,200 MiB para um banco de dados, 500 MiB para um worker e 700 MiB para incerteza: 4,000 MiB no total. Isso quase consome o perfil nominal e deixa pouca confiança para uma sobreposição de versões maior.
Estime a demanda de CPU a partir do trabalho medido
Meça o tempo de CPU para uma requisição ou job representativo e depois multiplique pela taxa de conclusão de pico. Por exemplo, 25 ms de tempo de CPU × 20 requisições por segundo = 500 ms de CPU a cada segundo, ou 0.5 núcleo em média. Repita com um worker realista ativo e inspecione os picos; as médias escondem picos, escalonamento e esperas de banco de dados.
Separe os sinais de restrição
| Sinal observado | Próxima verificação provável |
|---|---|
| CPU alta com trabalho executável | Faça o profiling do caminho crítico e depois compare mais CPU. |
| Pressão de memória ou encerramento de processo | Reduza a sobreposição ou adicione RAM medida. |
| CPU baixa com requisições lentas | Inspecione esperas de banco de dados, pool e externas. |
| A idade da fila aumenta conforme os workers aumentam | Reduza a concorrência e inspecione a dependência compartilhada. |
Tome a decisão de recursos
Escolha mais CPU somente quando o profiling mostrar contenção de computação sustentada. Escolha mais RAM quando o conjunto de trabalho simultâneo não tiver reserva. Reduza a concorrência quando o trabalho paralelo prejudicar a latência da API ou a taxa de conclusão útil. Registre a medição que acionou a mudança e depois repita a mesma carga de trabalho após alterar uma variável.