De eerste schaalregel is niets optimaliseren zonder bewijs. We instrumenteren het echte systeem en meten responstijden per endpoint, dure queries, verzadigde verbindingen en wachtrijen.

Bij veel systemen komt het grootste deel van het probleem uit drie knelpunten. Caching vangt herhaalde leesvragen op, enkele indexen of herschreven queries ontlasten de database en zware taken zoals e-mail of mediaverwerking verdwijnen uit het gebruikersverzoek.

Pas daarna voegen we capaciteit toe met read replicas, verticale of horizontale scaling en een CDN voor statische bestanden. Op basis van intuïtie zijn deze beslissingen duur; met metingen worden ze helder.

Vóór de verwachte piek testen we op twee keer de doelbelasting en bekijken we wat eerst faalt. Een gecontroleerde omgeving op dinsdag breken is beter dan de productielimiet op maandagochtend ontdekken.

Het gebruikelijke resultaat is veel meer verkeer op dezelfde softwarearchitectuur, zonder dat de serverkosten dezelfde curve volgen.