La première règle de la montée en charge : ne rien optimiser sans mesure. Nous commençons toujours par instrumenter le système réel, jamais par une intuition.
Mesurer avant de renforcer. Temps de réponse par endpoint, requêtes les plus coûteuses, saturation des connexions, files d’attente. En général, 80 % du problème tient dans trois goulets d’étranglement identifiés en une semaine.
Les trois leviers habituels. Le cache (pages, fragments, réponses API) absorbe la majorité du trafic de lecture. Les index et la réécriture de quelques requêtes lentes débloquent la base. Les tâches lourdes passent en asynchrone : e-mails, exports, traitements médias n’ont rien à faire dans la requête utilisateur.
Puis seulement, la capacité. Répliques de lecture, montée en gamme verticale ou horizontale, CDN pour les ressources statiques. Ces décisions coûtent cher si elles sont prises tôt ; elles deviennent triviales quand les mesures les justifient.
Tester la rupture. Avant le pic, nous simulons deux fois la charge attendue et observons ce qui cède en premier. Mieux vaut casser la plateforme un mardi après-midi qu’un lundi matin en production.
Résultat typique : la même infrastructure logicielle passe à huit fois le trafic, avec des coûts serveurs qui n’ont pas suivi la même courbe.


