concepto · intermedio · 2 min de lectura
SLI, SLO y SLA
SLI, SLO y SLA son el marco para medir, comprometer y garantizar la confiabilidad de un servicio: el indicador, el objetivo y el acuerdo.
No requiere conocimientos previos.
Alcance en breve
Cubre
- SLI/SLO/SLA as a concept
No cubre
- implementation details
Supone
- The reader understands relevant fundamentals.
Resumen
Los tres terminos definen como un servicio mide y promete confiabilidad:
- SLI (Service Level Indicator): la medicion real. Ej: latencia p99 = 230ms, disponibilidad = 99.95%.
- SLO (Service Level Objective): el objetivo interno. Ej: latencia p99 < 300ms, disponibilidad > 99.9%.
- SLA (Service Level Agreement): el compromiso con el cliente, con consecuencias economicas si no se cumple. Ej: disponibilidad > 99.5% o se devuelve el 10% de la factura.
El SLO es mas estricto que el SLA: si cumplis el SLO, nunca incumplis el SLA. El error budget —la cantidad de tiempo que el servicio puede estar degradado sin violar el SLO— es la herramienta para balancear innovacion y estabilidad.
Alcance y supuestos
Cubre SLI, SLO, SLA y error budgets como marco de confiabilidad. Asume familiaridad con metricas.
Modelo mental
Un gimnasio. SLI: fuiste 18 dias este mes. SLO: tu objetivo es ir 20 dias. SLA: le prometiste a tu pareja ir 15 dias o lavar los platos toda la semana. Si cumplis tu SLO (20), el SLA (15) se cumple solo.
Uso práctico
- ✅ Establecer expectativas de confiabilidad, priorizar entre features y estabilidad.
- ❌ Fijar SLOs sin medir SLIs primero.
Ejemplo trabajado: presupuesto de error
Un servicio con SLO de 99.9% de disponibilidad mensual tiene un error budget de 43 minutos. Si en dos semanas ya consumio 30 minutos, el equipo congela nuevos deploys y dedica el resto del mes a mejorar estabilidad. Si sobra presupuesto a fin de mes, se acelera el ritmo de features.
Evidencia
- El marco SLI/SLO/SLA fue popularizado por Google en el Site Reliability Engineering book.
Fuentes citadas
- Wikipedia, Observability (software) (Síntesis, 21-07-2026)