Transformer une impression vague que les requêtes sont lentes en une cible de percentile réellement exploitable pour une alerte, et tracer quel saut est responsable en cas de dépassement.
Fait partie de : Servir des modèles open source en production