Drift bør organiseres omkring services
En server kan være grøn, mens forretningsservicen er nede. Serviceorienteret drift forbinder derfor tekniske komponenter med den funktion, brugeren faktisk er afhængig af.
Monitorering og observability
Monitorering kontrollerer kendte signaler som CPU, svartid og kølængde. Observability forsøger bredere at gøre systemets interne tilstand forståelig gennem metrics, logs og traces. Distribuerede systemer har især brug for korrelation på tværs af services og integrationer.
Incident, problem og change
En incident handler om at genoprette normal service. Problem management søger underliggende årsager og mønstre. Change management styrer risikoen ved ændringer. De tre aktiviteter bør dele data i stedet for at blive isolerede ticket-kategorier.
Asset og configuration management
Asset management fokuserer på livscyklus, ejerskab og økonomi for aktiver. Configuration management beskriver de konfigurationselementer og relationer, som er nødvendige for at levere services. En CMDB er kun nyttig, hvis indholdet er aktuelt nok til de beslutninger, den skal understøtte.
SLA, SLO og brugeroplevelse
Tilgængelighedsprocenter bør oversættes til reel konsekvens. 99,9 % og 99,99 % ser næsten ens ud, men tillader meget forskellig nedetid over et år. Brug oppetidsberegneren til at se forskellen.