Cos’è un piano di Disaster Recovery e come funziona
Una domanda semplice, una risposta scomoda
Se tra 10 minuti la tua azienda andasse a fuoco, un dipendente scontento ti cancellasse tutti i dati, un evento elettrico mettesse fuori uso i server e i backup, avresti un piano per ripristinare tutto e ricominciare a lavorare?
Un piano di disaster recovery è esattamente questo: un piano preciso e un sistema informatico che ti permettono di ripartire dopo un evento che ha bloccato i tuoi dati o i tuoi sistemi. Non è un prodotto che si compra e si mette in un angolo, è una procedura costruita sulla tua azienda.
Come nasce un piano: il caso di Matteo
Qualche giorno fa siamo stati da un nuovo cliente per fare un’analisi della sua infrastruttura IT. Chiamiamolo Matteo.
Matteo, come molti imprenditori del nord est, è molto orgoglioso della sua impresa e del suo capannone. Ci racconta delle oltre venti postazioni di lavoro, dei 6 tecnici che disegnano per 8 ore al giorno al computer i prototipi dei suoi macchinari, delle nuove macchine di produzione, dell’ufficio commerciale che sta facendo un ottimo lavoro. Potremmo stare qui ore, come ci siamo stati noi, ma ve lo risparmiamo.
Dopo tutte queste belle parole ci sembra scontato che per Matteo la sua azienda sia importante e che i dati prodotti quotidianamente dai suoi collaboratori siano fondamentali. Così gli facciamo le domande da cui parte ogni piano:
- Ogni quanto effettuate un backup dei dati?
- Hai clienti che accedono ai tuoi dati?
- Hai sistemi legati tra loro?
- Quali programmi causerebbero perdite finanziarie in caso di guasto?
- Quali sistemi causerebbero un blocco della produzione?
- Dove effettuate il backup?
- Quanto tempo impiegate per il ripristino?
La risposta di Matteo è un po’ disarmante, anche se ce l’aspettavamo:
“È tutto dentro quella scatoletta là.”
Quante volte abbiamo sentito la frase “posso stare fermo anche una giornata”. Il punto è che nessuno l’ha mai calcolato davvero. E finché non lo calcoli, il piano non esiste.
RTO e RPO: i due parametri che definiscono il piano
Nel nostro settore le risposte a quelle domande si traducono in due metriche, RTO e RPO, che descrivono la tolleranza ai guasti di un sistema informatico. Sono i numeri che scriviamo nel report ICT del cliente e sono la base su cui si costruisce tutto il resto.
RPO (Recovery Point Objective): quanti dati puoi permetterti di perdere
L’RPO indica la perdita di dati ammissibile. In pratica: se faccio un backup al giorno alle 20.00 e il sistema va in blocco alle 8.00 della mattina seguente, tutto ciò che è stato modificato dall’ultimo backup è perduto. Vuol dire che il mio RPO è di 12 ore di lavoro.
Nel caso dei 6 disegnatori di Matteo, 12 ore di progettazione persa non sono un inconveniente: sono giornate di lavoro da rifare da zero. Se l’azienda non se lo può permettere, la frequenza dei backup si alza fino a scendere ai minuti.
RTO (Recovery Time Objective): quanto tempo puoi stare fermo
L’RTO indica quanto tempo ti occorre per tornare operativo dal momento del disastro, ed è associato alla massima interruzione tollerabile. Si definisce in base al valore dei tuoi dati e al costo del fermo.
Un esempio netto: se sei un’azienda di spedizioni, inserisci dati per tutto l’arco della giornata e devi spedire tutto il giorno, il tuo RTO sarà quasi zero, perché non puoi permetterti interruzioni, e il tuo RPO sarà di pochi minuti, perché non puoi perdere le imputazioni.
Due aziende con lo stesso numero di server possono avere RTO e RPO completamente diversi. È per questo che un piano copiato da un’altra azienda non serve a niente.
Dai parametri alla soluzione
Definiti RTO e RPO, il piano prende forma. Si stabilisce quali sistemi sono critici e vanno ripristinati per primi, dove viene replicato il dato, con quale frequenza, e in quanto tempo l’infrastruttura torna a essere utilizzabile.
Nel caso di Matteo la soluzione che abbiamo proposto gli permette di stare tranquillo: tutto il lavoro fatto dai suoi disegnatori è al sicuro e si può ripristinare con granularità di 5 minuti in caso di danno o cancellazione. I dati amministrativi restano ripristinabili anche in caso di evento catastrofico, perché non vivono più solo dentro “quella scatoletta là”. E se i server dovessero avere problemi, il sistema gli consente di ripartire in un tempo definito e concordato, non in un tempo da scoprire sul momento.
Quando l’obiettivo non è solo ripartire ma non fermarsi affatto, si passa al livello successivo: la continuità operativa, che mantiene i sistemi attivi durante l’evento invece di ripristinarli dopo.
A volte, per non perdere soldi, basta investire qualche centinaio di euro al mese in servizi e sistemi informatici efficienti.
Se prima di entrare nei parametri vuoi capire quanto ti costa davvero un’ora di fermo, l’abbiamo affrontato nell’articolo perché una PMI dovrebbe dotarsi di un piano di disaster recovery.
Il tuo backup nel disco di rete non è sufficiente. Contattaci ora per scoprire il nostro servizio di disaster recovery e definire insieme l’RTO e l’RPO della tua azienda.
Strategy
Maintenance
Data Protection
Cybersecurity
Cloud As-a-Service
Business Solutions