Come calcolare l'uptime
La formula dell'uptime è (Tempo totale - Downtime) / Tempo totale x 100 = Uptime%. Un sito con 43 minuti di downtime in un mese di 30 giorni (43.200 minuti totali) ha un uptime del 99,9%. L'aritmetica è la parte facile. Quello che richiede lavoro è sapere cosa costa in minuti ogni punto percentuale e misurare il downtime con una precisione tale da rendere la formula significativa.
La formula dell'uptime
Per un server o una risorsa con una durata totale nota:
(Overall Lifetime - Overall Downtime) / Overall Lifetime x 100% = Uptime
Per un sito web che stai monitorando attivamente, il caso di gran lunga più comune dato che raramente conosci la durata reale di una risorsa, calcoli l'uptime rispetto al tuo periodo di monitoraggio:
(Monitored Time - Monitored Downtime) / Monitored Time x 100% = Uptime
Scegli una finestra temporale (un giorno, un mese, un anno), somma ogni minuto in cui il sito è risultato confermato irraggiungibile in quella finestra, e dividi. Il risultato è preciso solo quanto lo è il tuo tracciamento del downtime, il che è l'argomento reale a favore del monitoraggio automatizzato rispetto a una stima manuale del tipo "qualcuno ha notato un'interruzione".
Come calcolare il downtime
Il downtime è ogni intervallo continuo in cui il tuo sito è risultato irraggiungibile dall'esterno, conteggiato al secondo dove possibile invece che arrotondato al numero più comodo. I piccoli blip si sommano: cinque interruzioni da due minuti in un mese fanno 10 minuti di downtime, ed è facile sottostimarli se ti affidi alle segnalazioni degli utenti invece che a un monitor che registra ogni cambio di stato con un timestamp.
I nove: cosa significa ogni livello di uptime
Un uptime del 99,9% e uno del 99,999% suonano vicini. In pratica sono mondi a parte. Ecco cosa consente ciascun livello prima di sforare il tuo obiettivo, all'anno e al giorno:
| Disponibilità | Downtime annuo massimo | Downtime giornaliero massimo | Significato pratico |
|---|---|---|---|
| 99,9% ("tre nove") | ~8,77 ore | ~86,4 secondi | La soglia che la maggior parte dei motori di ricerca e delle piattaforme pubblicitarie considera accettabile. Va bene per la maggior parte dei siti, ma non è un impegno SLA serio. |
| 99,95% | ~4,38 ore | ~43,2 secondi | Un SLA SaaS di fascia media comune, e un obiettivo commerciale ragionevole. |
| 99,99% ("quattro nove") | ~52,6 minuti | ~8,64 secondi | Considerato praticamente sempre disponibile dalla maggior parte delle piattaforme. Il tetto realistico per un sito ben gestito e monitorato attivamente. |
| 99,999% ("cinque nove") | ~5,26 minuti | ~0,864 secondi | Lo standard di livello telecom. Raggiungibile con infrastrutture ridondanti e una disciplina di manutenzione quasi perfetta, ma un impegno ingegneristico difficile da giustificare per la maggior parte delle aziende. |
Un uptime del 100% non è un obiettivo realistico per nessuno: finestre di manutenzione, riavvii e occasionali guasti a monte lo rendono strutturalmente irraggiungibile su qualsiasi periodo significativo. Quattro nove sono il tetto pratico a cui dovrebbe puntare la maggior parte dei team. Cinque nove sono un impegno ingegneristico deliberato e costoso, non un obiettivo di default.
Le formule di uptime più comuni, in un unico posto
- Disponibilità cloud/SLA: (Uptime garantito - Downtime) / Uptime garantito, la formula su cui è scritta la maggior parte degli SLA cloud.
- MTBF (Mean Time Between Failures, tempo medio tra i guasti): Tempo operativo totale / Numero di guasti, che indica quanto spesso si verificano gli incidenti a prescindere dalla loro durata.
- Budget annuo di downtime a cinque nove: 86.400 secondi/giorno x 365 x 0,00001, circa 315 secondi ovvero 5,25 minuti l'anno.
- Budget annuo di downtime a tre nove: 1.440 minuti/giorno x 365 x 0,001, circa 526 minuti ovvero 8,77 ore l'anno.
Come raggiungere un uptime più alto
La formula ti dice a che punto sei. Queste sono le leve che muovono il numero:
- Scegli un hosting con un track record reale e verifica tu stesso l'uptime dichiarato da un provider invece di fidarti di una pagina di marketing.
- Monitora in modo continuo dall'esterno della tua infrastruttura. Un monitor che gira da più postazioni indipendenti rileva interruzioni che il tuo logging lato server non può strutturalmente vedere, perché un server che non riesce a raggiungere il mondo esterno non può registrare di essere irraggiungibile.
- Riduci le finestre di manutenzione. Ogni secondo di un riavvio pianificato conta contro l'uptime esattamente come uno non pianificato, quindi raggruppa e automatizza il lavoro.
- Gestisci infrastrutture ridondanti. Un server di backup o una regione secondaria ti permette di spostare il traffico durante la manutenzione o un'interruzione parziale invece di mandare offline l'intero sito.
Misurarlo invece di stimarlo
Tutta la matematica qui sopra vale solo quanto i dati di downtime che la alimentano, motivo per cui una stima manuale ("credo che abbiamo avuto un pomeriggio no il mese scorso") raramente sopravvive al confronto con un report di uptime reale. Il monitoraggio uptime di HostTracker controlla un sito da oltre 300 postazioni in 158 città all'intervallo che imposti, registra ogni cambio di stato al secondo e produce la percentuale di uptime senza bisogno di un foglio di calcolo. La guida al controllo HTTP tratta il controllo che produce la maggior parte di questi cambi di stato, e il resto della sezione sui concetti di monitoraggio copre i termini correlati.
Domande frequenti
Quale formula determina la percentuale di disponibilità di un cloud provider? (Uptime garantito - Downtime) / Uptime garantito, espressa in percentuale. È la formula SLA cloud standard.
Cosa misura il tempo medio tra i guasti? MTBF (Mean Time Between Failures) = Tempo operativo totale / Numero di guasti.
Quanto downtime consente all'anno una disponibilità a cinque nove? Meno di 6 minuti: 86.400 secondi/giorno x 365 giorni x 0,001% sono circa 315 secondi.
Qual è il budget di downtime giornaliero a una disponibilità del 99,9%? Circa 86 secondi al giorno, da 1.440 minuti/giorno x 0,1%.