Veeam Backup & Replication: consigli utili per garantire la validità dei backup e delle repliche

Oggi ho il piacere di presentarvi nuovamente alcuni consigli utili del mio collega Evgeny Ivanov, team leader del supporto tecnico Veeam. Questa volta, Zhenya ha condiviso le sue raccomandazioni per lavorare con i backup e le repliche. Spero che possano aiutarvi a evitare errori comuni e che le vostre repliche e i vostri backup non diventino mai il "collo di bottiglia" nel processo di ripristino, qualora fosse necessario.

Dunque, benvenuti sotto.

Veeam Backup & Replication: consigli utili per garantire la vitalità di backup e repliche

Nella mia precedente abbiamo chiarito il corretto completamento dei programmi che utilizzano il mediastreamer. ci siamo occupati di come ottimizzare il carico sui componenti dell'infrastruttura di backup e abbiamo esaminato errori di configurazione tipici. Passiamo a un altro argomento importante: la corretta preparazione e esecuzione del ripristino. Anche questo sarà esaminato attraverso esempi reali con cui ha lavorato il team di supporto tecnico.

Backup senza ristorante — soldi scaricati

Riceviamo regolarmente richieste da parte di utenti che si trovano in situazioni simili: devono eseguire un ripristino da un backup, ma quando provano a farlo, si imbattono in problemi irrisolvibili. E il problema non è affatto l'assenza di una copia di sicurezza, l'attività di CryptoLocker o cose simili. È "soltanto" la scarsa attenzione alla verifica dei backup e delle repliche per la possibilità di ripristino. Molti si concentrano esclusivamente sul processo di creazione del backup, dimenticando che avere semplicemente una copia di sicurezza non è una panacea contro eventuali disastri. Bisogna capire che il ripristino è un processo completamente diverso, che ha le sue peculiarità e che deve essere monitorato e testato prima del lancio in produzione. Ecco alcuni esempi significativi:

  1. L'utente ha subito un guasto di una macchina virtuale critica di 20 TB. I tempi di inattività non sono ammissibili, quindi l'amministratore avvia il processo di ripristino istantaneo della VM – dopo 5 minuti la macchina è attiva. Tuttavia, dobbiamo ricordare che questo stato della macchina può essere utilizzato solo temporaneamente – deve essere migrato sul datastore di produzione. In questo esempio, come si è scoperto, le capacità dell'infrastruttura non permettevano di copiare 20 TB di dati in un tempo ragionevole. Nelle impostazioni del processo di ripristino istantaneo è stata scelta l'opzione di salvare le modifiche su disco. C: server Veeam Backup & Replication (a differenza dello snapshot vSphere) – di conseguenza, lo spazio libero su disco si è riempito rapidamente. Al momento in cui l'utente ha contattato il supporto, la VM aveva già subito modifiche che non potevano essere ignorate. Ciò significa che ci troviamo in una situazione in cui non è possibile completare rapidamente il processo di ripristino istantaneo della macchina critica – come salvare i dati in questo scenario?

    A dire il vero, con il passare degli anni non ricordo tutti i dettagli finali, ma so che alla fine non siamo riusciti a trovare nulla di geniale. I clienti dalla loro parte hanno risolto il problema ampliando il disco C: con risorse di riserva, copiando i file più importanti e solo allora spegnendo la VM per migrare. Insomma, non è successo nulla di miracoloso.

  2. Nell'infrastruttura dell'utente operava un solo controller di dominio e tutti i componenti di Veeam Backup & Replication erano configurati utilizzando DNS. Sì, esatto, non hai sentito male. I possibili sviluppi erano decine, ma la realtà è andata così: le persone hanno pianificato la manutenzione e hanno deciso di passare alla replica del loro controller di dominio. Hanno attivato il failover programmato, cosa che è generalmente consigliata in situazioni simili. Nella prima fase, tutto andava bene, mentre nella seconda hanno temporaneamente spento la VM originale per trasferire i resti dei dati. Naturalmente, il compito di failover è immediatamente fallito, poiché il DNS ha smesso di funzionare.

    Fortunatamente, qui siamo riusciti a gestire la situazione accendendo manualmente la replica tramite vSphere (in effetti, non è consigliabile eseguire questa operazione autonomamente, come vedrete dal prossimo esempio). Tuttavia, come capirete, il processo di manutenzione è stato interrotto e rinviato. Inoltre, abbiamo dovuto inserire manualmente i nomi degli host nel file C:WindowsSystem32driversetchosts sul server Veeam Backup & Replication, per garantire la correttezza durante il ripristino.

  3. Un altro cliente aveva tutta l'infrastruttura di backup costruita attorno a unità a nastro magnetico, mentre sul disco erano memorizzate solo brevi catene di file. Quando hanno avuto bisogno di recuperare alcuni file da un grande server di file, si è scoperto che nessuna macchina poteva essere utilizzata come repository ausiliario per il ripristino da nastro, poiché nessuna di esse aveva spazio libero sufficiente. (Potete leggere del ripristino da nastro magnetico direttamente e utilizzando un repository ausiliario qui (al momento solo in inglese).

Credo che in tutti e tre gli esempi gli utenti, per così dire, fossero prigionieri delle illusioni: avevano supposto che se il backup era andato a buon fine, non ci sarebbero stati problemi anche con il ripristino. Ma, come capirete, questo non è affatto sempre vero, e quindi è necessario prepararsi al ripristino con la stessa attenzione con cui ci si prepara al backup. Innanzitutto, è opportuno esaminare il manuale utente, che contiene informazioni piuttosto dettagliate sui diversi tipi di ripristino. All'inizio di ciascun paragrafo, sono elencati i requisiti, le azioni preparatorie e le possibili limitazioni. La descrizione del ripristino da nastri magnetici o da snapshot hardware degli storage array può essere trovata nelle sezioni della documentazione e nei nostri articoli su Habr. Inoltre, le modalità di preparazione per il ripristino degli oggetti applicativi utilizzando gli strumenti Veeam Explorers sono descritte nella sezione "Planning and preparation" (pianificazione e preparazione) del manuale per ciascuno degli strumenti. Consiglio di esaminarli attentamente: questo vi aiuterà a preparare correttamente il sistema per il ripristino, se necessario. In russo, le istruzioni per il ripristino di un database SQL Server sono riportate qui.

Perché non si deve lavorare con le repliche dalla console vSphere?

In teoria, le repliche di Veeam sono comuni macchine virtuali, con cui sembra logico lavorare, utilizzando gli strumenti di vSphere, in particolare il client vSphere. Tuttavia, non raccomandiamo di farlo, ecco perché: passare a una replica in Veeam Backup & Replication è un processo piuttosto complesso, che richiede l'esecuzione rigorosa dei passaggi (in modo da poter tornare indietro, se necessario) e azioni finali corrette - basta guardare l'immagine che illustra il processo:

Veeam Backup & Replication: consigli utili per garantire la vitalità di backup e repliche

Se decidi di attivare la replica dal client vSphere, ti aspettano con grande probabilità una serie di problemi:

  1. Il meccanismo di attivazione della replica da Veeam Backup & replication (mostrato nel diagramma) non funzionerà più per questa macchina.
  2. I dati nel database di Veeam Backup non corrisponderanno allo stato reale della VM. Nel peggiore dei casi, sarà necessario modificare il database.
  3. C'è anche il rischio di perdita di dati, come in questo esempio: un utente ha attivato manualmente la replica dal client vSphere e ha deciso di continuare a lavorarci. Dopo un po', si è accorto che la replica era ancora visibile nella console di Veeam Backup & Replication e ha deciso di rimuoverla per non averne più bisogno. Ha fatto clic destro su di essa e ha dato il comando «Elimina dal disco». Veeam Backup & Replication ha immediatamente eliminato la replica dal disco, la quale, nota bene, era già in uso come una normale VM e conteneva dati necessari e utili.

Certo, ci sono situazioni in cui è necessario attivare comunque la replica dal client vSphere – generalmente quando il server Veeam è spento e la replica deve essere attivata con un certo ritardo. Ma se il server Veeam funziona correttamente, è necessario lavorare con le repliche direttamente dalla sua console.

Non è consigliabile neanche eliminare le repliche utilizzando il client vSphere. Veeam Backup & Replication rimarrà all' oscuro di tale modifica, il che può portare a errori e dati obsoleti. Se la replica non ti serve più, eliminala tramite la console Veeam, e non come VM dal client vSphere. In questo modo, avrai sempre un elenco aggiornato delle repliche.

«Attenzione» — aggiornamenti in arrivo!

Qui intendiamo ovviamente aggiornamenti per hypervisor e varie applicazioni che vengono salvate con Veeam. Se li guardiamo dal punto di vista del lavoro con Veeam Backup & Replication, gli aggiornamenti possono essere suddivisi in due categorie: grandi e significativi, che apportano molte modifiche, e piccoli.

Consideriamo prima la prima categoria.

Gli aggiornamenti più importanti sono quelli destinati all'hypervisor. Prima di installare un tale aggiornamento, è fondamentale assicurarsi che sia supportato da Veeam Backup & Replication. Tali aggiornamenti apportano diverse modifiche alle librerie e alle interfacce API utilizzate da Veeam Backup & Replication, quindi, per dichiararne ufficialmente il supporto, è necessario aggiornare il codice di Veeam Backup & Replication e condurre test approfonditi.

Bisogna anche considerare che, per esempio, VMware non fornisce accesso anticipato alle ultime versioni di vSphere per i produttori di software, in modo che gli sviluppatori e i tester di Veeam ricevano la nuova versione nello stesso momento con il resto dell'umanità progressista; pertanto, c'è di solito un certo intervallo di tempo tra il rilascio di VMware e la dichiarazione ufficiale del supporto. Il numero e la varietà delle modifiche necessarie sono tali che è difficile racchiuderle in un semplice hotfix; in genere, il supporto ufficiale viene dichiarato insieme al rilascio della versione di Veeam Backup & Replication.

Di conseguenza, si verifica quel momento imbarazzante in cui, dopo il rilascio di una nuova versione di vSphere, il numero di richieste al supporto tecnico aumenta drasticamente, poiché gli utenti si precipitando ad installare la nuova versione, e i loro backup smettono immediatamente di funzionare. A noi, il supporto tecnico di Veeam, tocca spiegare agli utenti cosa abbiano fatto di sbagliato, chiedere loro di tornare indietro (se possibile) o ideare soluzioni complicate per uscire da questa situazione. Quindi, prima di installare un aggiornamento significativo, controllate assolutamente la sua compatibilità con il software in uso, ve lo chiedo sinceramente!

Tutto quanto detto sopra si applica anche alle applicazioni che fai il backup e prevedi di ripristinare utilizzando Veeam. La gamma di strumenti Veeam Explorers ha anche un elenco delle versioni supportate delle relative applicazioni, che viene aggiornato con ogni rilascio di Veeam Backup & Replication. Pertanto, prima di installare una nuova versione della tua applicazione, sia essa Exchange, Oracle o SharePoint, assicurati di leggere di nuovo la sezione corrispondente. della documentazione di Veeam Explorers.

Alla seconda categoria, cioè agli aggiornamenti minori, io includo, per esempio, nuove versioni di VMware Tools, aggiornamenti cumulativi di Exchange, aggiornamenti di sicurezza di vSphere, e così via. Di norma, non portano con sé modifiche significative e nella maggior parte dei casi Veeam Backup & Replication non presenta problemi con essi. (Ecco perché non ci sono annunci pubblici di supporto ufficiale per il prodotto.) Tuttavia, nella nostra pratica abbiamo incontrato casi in cui anche tali aggiornamenti alteravano così significativamente il normale corso delle cose, da provocare errori nel funzionamento di Veeam Backup & Replication. In tali situazioni, dopo aver confermato il problema, gli ingegneri di Veeam si sforzano di rilasciare rapidamente un hotfix.

A chi possiede una conoscenza tecnica dell'ingleseSe desideri rimanere aggiornato su cosa stanno facendo gli ingegneri e su quali problematiche affrontano gli architetti di sistema e gli specialisti del supporto tecnico, ti consiglio di iscriverti ai nostri forum. Ogni settimana per i suoi iscritti viene inviata una newsletter intitolata "Word from Gostev" firmata da TheRealGostev. In essa Anton Gostev, a capo del dipartimento di product management, parla di problemi recentemente individuati (e non solo sul lato Veeam), dei piani per nuove versioni e delle notizie dal mondo IT. Se hai bisogno di ulteriori informazioni, puoi sfogliare gli argomenti del forum: se qualcuno dei clienti riscontra un problema nel funzionamento del prodotto dopo un aggiornamento, molto probabilmente ne ha già scritto sul forum.

Come sapete, le patch e gli aggiornamenti possono causare problemi non solo con i backup, ma anche con le applicazioni per cui questi backup vengono effettuati. E qui entrano in gioco i laboratori virtuali: Veeam DataLabs. Avrete sicuramente sentito parlare della funzionalità SureBackup, progettata per la verifica dei backup. Essa si basa proprio sull'uso di DataLabs, creando un ambiente isolato in cui è possibile, tra le altre cose, testare gli aggiornamenti prima di implementarli in produzione. Ve lo consiglio vivamente – vi risparmierete un sacco di nervi. E se qualcuno non conosce ancora SureBackup, consiglio di leggerne di più. la documentazione.

Direi che per oggi è tutto, grazie per l'attenzione!

Cosa leggere ancora

Articoli su Habr:

Guida utente (in lingua russa)

Fonte: habr.com

Acquista hosting affidabile per siti web con protezione DDoS, server VPS VDS 🔥 Acquista hosting affidabile per siti web con protezione DDoS, server VPS VDS - ProHoster