Calculadora de SLA y uptime

Convierte un SLA en minutos de caída permitidos por día, semana, mes y año, y controla tu error budget.

toolboox.app/herramientas/uptime-sla-calculator

Herramienta

Caída permitida al día
1 min
A la semana
10 min
Al mes (30 d)
43 min
Al año (365 d)
8 h 46 min
Error budget del periodo
43 min
Presupuesto restante
excedido en 2 min
Disponibilidad real del periodo
99.8958 %
Error budget consumido: 104.2%
SLADíaSemanaMesAño
99 %14 min1 h 41 min7 h 12 min3 d 15 h 36 min
99.5 %7 min50 min3 h 36 min1 d 19 h 48 min
99.9 %1 min10 min43 min8 h 46 min
99.95 %43 s5 min22 min4 h 23 min
99.99 %9 s1 min4 min53 min
99.999 %1 s6 s26 s5 min

Qué problema resuelve

Firmar un 99,9% sin traducirlo a minutos reales lleva a incumplir el SLA sin darse cuenta.

Un SLA del 99,9% suena impecable hasta que lo traduces a minutos: son unos 43 minutos de caída al mes. Esta calculadora convierte cualquier porcentaje de disponibilidad en tiempo de indisponibilidad permitido por día, semana, mes y año, y te deja controlar el error budget que ya has consumido en el periodo.

La tabla de los nueves

Cada nueve adicional divide por diez el tiempo de caída admisible. Con base anual: 99% son unos 3 días y 15 horas; 99,9% (tres nueves) unas 8 horas y 45 minutos; 99,95% unas 4 horas y 22 minutos; 99,99% (cuatro nueves) 52 minutos y medio; 99,999% (cinco nueves) apenas 5 minutos y 15 segundos. Este salto explica por qué el coste crece de forma exponencial: pasar de tres a cuatro nueves obliga a redundancia activa, despliegues sin downtime y automatización de la recuperación.

Error budget: el SLA como presupuesto, no como promesa

La práctica de SRE consiste en tratar el margen de indisponibilidad como un presupuesto que se gasta. Si el SLO mensual es 99,9%, tienes 43 minutos; cada incidente consume parte de ellos. Mientras quede presupuesto, el equipo puede desplegar y asumir riesgo; cuando se agota, se congelan las novedades y se dedica el esfuerzo a fiabilidad. Es una regla objetiva que sustituye la discusión eterna entre producto y operaciones.

SLI, SLO y SLA: no son lo mismo

El SLI (indicador) es la métrica medida: porcentaje de peticiones correctas, latencia por debajo de un umbral, disponibilidad del endpoint de salud. El SLO (objetivo) es el valor que quieres mantener internamente, típicamente más exigente que lo prometido. El SLA (acuerdo) es el compromiso contractual con penalizaciones asociadas. La regla es fijar el SLO por encima del SLA para tener colchón: prometer 99,9% y trabajar con un objetivo interno de 99,95%.

La letra pequeña que cambia el cálculo

Antes de firmar, revisa tres puntos. Qué se mide: ¿disponibilidad del servicio completo o de cada componente por separado? Un sistema con tres dependencias en serie al 99,9% ofrece en conjunto un 99,7%. Qué se excluye: casi todos los SLA descuentan el mantenimiento planificado, la fuerza mayor y los fallos atribuibles al cliente. Cómo se compensa: la penalización suele ser un crédito porcentual sobre la factura del mes, no una indemnización por el daño real al negocio.

Casos de uso comunes

  • Traducir un SLA de proveedor a minutos reales.
  • Definir el SLO interno de un servicio nuevo.
  • Justificar inversión en redundancia con datos.
  • Controlar el error budget consumido durante el mes.

Buenas prácticas

  • Fija el SLO más exigente que el SLA comprometido.
  • Multiplica disponibilidades para dependencias en serie.
  • Mide desde el punto de vista del usuario, no solo del servidor.

Preguntas frecuentes

¿Cuánta caída permite un 99,9%?

Unos 43 minutos al mes (30 días) y algo más de 8 horas y 45 minutos al año.

¿Qué es el error budget?

El tiempo de indisponibilidad que puedes gastar sin incumplir el SLA. Es la herramienta central de SRE para decidir si toca desplegar o estabilizar.

¿Se cuentan las ventanas de mantenimiento?

Depende del contrato: muchos SLA excluyen el mantenimiento planificado y anunciado. Revisa la letra pequeña antes de calcular.