Additionnez le budget mémoire simultané
Commencez par les processus qui se chevauchent, pas par leurs moyennes au repos. Une feuille de calcul illustrative de 4 GB pourrait réserver 700 MiB pour l'outillage de l'hôte, 900 MiB pour les processus API, 1,200 MiB pour une base de données, 500 MiB pour un worker et 700 MiB pour l'incertitude : 4,000 MiB au total. Cela consomme presque le profil nominal et laisse peu de marge pour un chevauchement de versions plus important.
Estimez la demande CPU à partir du travail mesuré
Mesurez le temps CPU d'une requête ou d'une tâche représentative, puis multipliez par le taux d'achèvement en pointe. Par exemple, 25 ms de temps CPU × 20 requêtes par seconde = 500 ms de CPU chaque seconde, soit 0.5 cœur en moyenne. Répétez avec un worker réaliste actif et inspectez les pointes ; les moyennes masquent les pics, l'ordonnancement et les attentes de base de données.
Séparez les signaux de contrainte
| Signal observé | Prochaine vérification probable |
|---|---|
| CPU élevé avec travail exécutable | Profilez le chemin critique, puis comparez davantage de CPU. |
| Pression mémoire ou arrêt de processus | Réduisez le chevauchement ou ajoutez de la RAM mesurée. |
| CPU faible avec requêtes lentes | Inspectez la base de données, le pool et les attentes externes. |
| L'âge de la file augmente à mesure que les workers augmentent | Réduisez la concurrence et inspectez la dépendance partagée. |
Prenez la décision sur les ressources
Choisissez plus de CPU uniquement lorsque le profilage montre une contention de calcul soutenue. Choisissez plus de RAM lorsque l'ensemble de travail simultané manque de réserve. Réduisez la concurrence lorsque le travail parallèle nuit à la latence de l'API ou au taux d'achèvement utile. Consignez la mesure déclenchante, puis répétez la même charge de travail après avoir modifié une seule variable.