Waarom het uurtarief van de GPU zelden het getal is dat de kost per token daadwerkelijk bepaalt, en wat het SLO-doel uit hoofdstuk 4 stilletjes kost aan gereserveerde headroom.
Onderdeel van: Open modellen serveren in productie