Sujet : capacity
-
Planification de capacité à partir de la marge mesurée : capacité utilisable, demande de pointe et date d'épuisement
Mesurer le taux d'arrivée le plus élevé auquel le service respecte encore son objectif de latence, le comparer à la demande de pointe réelle, et transformer la différence en un ratio de marge et une date d'épuisement projetée assortie d'une action planifiée. La redondance pour les pannes et la marge pour la croissance sont deux budgets distincts.
-
Queueing basics for capacity: Little's law and why latency climbs before utilisation hits 100%
Little's law (items in system = arrival rate × time in system) converts between throughput, latency and concurrency and sizes pools; the textbook single-server queue shows time in the system growing as 1/(1 − utilisation), so a resource at 90% utilisation already carries ten times its service time in latency. Plan against latency, not against a full CPU.
Lisible par machine : JSON