Domů›Průvodci›Co dělat, když…

Co dělat, když…

Noční zálohování selhalo

Záloha, která jednu noc selže, není havárie, ale zpoždění: poslední čistá kopie je stará nejméně 48 hodin, pokud ta předchozí proběhla úspěšně. Několik selhání za sebou je incident ochrany dat: jeho příčinu hledejte ještě týž den a nespokojte se s potvrzením upozornění.

Aktualizováno v říjnu 20263 min čtení5 citovaných zdrojů

To nejdůležitější

  • Přečtěte si chybovou zprávu, ne jen červenou kontrolku: místo, chybějící zdroj, přihlašovací údaje, zamčené soubory, propustnost, zastavený agent.
  • „Úspěšná“ úloha mohla zkopírovat prázdnou složku: podívejte se na zkopírovaný objem.
  • Poznamenejte si datum poslední úspěšné zálohy a sdělte ho vedoucímu dotčeného oddělení.
  • Po opravě úlohu spusťte znovu a pak zkontrolujte následující noc.
  • Tři selhání za měsíc na stejném stroji: změňte nastavení, ne jen mačkejte tlačítko „znovu spustit“.

1. Číst chybu, ne jen červenou kontrolku

Běžné příčiny v pořadí, v jakém se objevují:

PříčinaZnakOprava
Nedostatek místa v cílovém umístění nebo vyčerpaná kvótaChyba zápisu, zkracující se doba uchováváníNavýšit kapacitu nebo vědomě zkrátit historii
Vypnutý zdroj, mimo síť, změněná cestaPřejmenované písmeno jednotky nebo sdílená složka; „úspěšná“ úloha nad prázdnou složkouObnovit zdroj, opravit cestu, ověřit zkopírovaný objem
Odmítnuté přihlašovací údajeVypršelé heslo služebního účtuObnovit účet: jinak selžou všechny další noci
Zamčené soubory nebo databáze neuvedená do konzistentního stavuČástečná kopiePoužít metodu určenou pro otevřené databáze; databázi SQL v tomto stavu nelze čistě obnovit
Příliš pomalé nebo přerušené připojeníÚloha přerušená na konci časového oknaEfektivnější přírůstková záloha, delší časové okno nebo méně zbytečných dat
Zastavený agent na strojiŽádné odesíláníRestartovat službu, zjistit, proč se zastavila

Nejzrádnější je zelená úloha nad prázdnou složkou. ANSSI, francouzská národní agentura pro kybernetickou bezpečnost, požaduje, aby zálohování bylo systematicky kontrolováno, zejména s ohledem na nekonzistentní objem dat nebo souborů, zpomalení sítě a změny konfigurace. Zkopírovaný objem, který z noci na noc prudce klesne, si zaslouží stejnou pozornost jako selhání.

2. Zjistit, kdy byla poslední úspěšná záloha

To je jediné datum, které je pro dnešní RPO rozhodující. Pokud je starší než několik dní, řekněte to osobě odpovědné za dotčené oddělení. Pracuje bez záchranné sítě a musí to vědět. Potvrdit upozornění v konzoli bez této věty je krok, který z incidentu za dva týdny udělá ztrátu dat.

3. Po opravě spustit znovu

Jakmile je příčina vyřešena, spusťte úlohu ručně. Počkejte, až skončí. Pokud znovu selže, příčina stále trvá. Druhý den ráno zkontrolujte následující noc: mnoho „zřejmých“ oprav druhý běh nevydrží.

Úspěšná úloha dokazuje, že byla zapsána kopie, ne že ji lze obnovit. U databáze SQL Server Microsoft upřesňuje, že příkaz pro ověření zálohy nekontroluje strukturu dat, která obsahuje. ANSSI požaduje pravidelné testování záloh s písemným postupem obnovy; i NIST doporučuje zálohy testovat, aby se ověřilo, že soubory lze obnovit bez chyb. Po incidentu se zálohováním je nejlepší kontrolou zkušební obnova souboru nebo databáze. Viz Jak otestovat, že záloha funguje?.

4. Pokud se to opakuje

Tři selhání za měsíc na stejném stroji: rozsah, propustnost nebo produkt nejsou vhodné. Změňte parametr (vyloučit obrovskou a zbytečnou složku, rozdělit úlohu, navýšit úložiště), nestačí každé pondělí úlohu ručně znovu spouštět.

Ranní kontrolní seznam

  • Jsou všechny noční úlohy dokončené, a ne jen „bez chyby“?
  • Odpovídá zkopírovaný objem předchozím nocím?
  • Je datum poslední úspěšné zálohy každého kritického stroje mladší než 24 hodin?
  • Přečetla upozornění jmenovitě určená osoba, a nebyla jen doručena?
  • Pokrývá zbývající místo v cílovém umístění plánovanou dobu uchovávání?

Jak to řeší WeDoBack

Nepřetržitý monitoring 24 hodin denně sleduje zálohy a odešle upozornění, když záloha neproběhne. Upozornění je začátkem této stránky, ne jejím koncem. V nabídce INTEGRAL lze dvě hodiny podpory měsíčně využít k odstranění příčiny. V nabídce SMART se podpora účtuje za každý zásah: selhání zůstává zákazníkovi viditelné v konzoli a je na něm, aby ho četl. Podpora je k dispozici na čísle +33 9 72 50 78 28, od 9:00 do 13:00 a od 14:00 do 17:30 (pařížského času). Pro dimenzování úložiště je zveřejněným orientačním údajem současný objem vynásobený třemi a následná úprava po týdnu používání: příliš těsně dimenzovaný objem se projeví selhávajícími úlohami nebo zkracující se dobou uchovávání. Šifrovací klíč, který má zákazník, nehraje při selhání odeslání žádnou roli: pokud úloha selže, vzdálená kopie se prostě neaktualizovala.

Časté dotazy

Je jedna neúspěšná noc závažná?

Zřídka, pokud předchozí noc proběhla úspěšně a příčina se během dne opraví. Riziko vzniká hromaděním: každá neúspěšná noc zvětšuje objem práce, která by se při havárii ztratila. Po několika dnech jde o incident, který je třeba nahlásit vedení.

Stačí stav „úspěšné“ jako důkaz, že je záloha v pořádku?

Ne. ANSSI požaduje systematickou kontrolu záloh, zejména nekonzistentních objemů dat, a pravidelné testy obnovy. U SQL Serveru Microsoft upřesňuje, že ověření zálohy nekontroluje strukturu dat, která obsahuje: prokázat to může jen skutečná obnova následovaná kontrolou konzistence.

Kdo má sledovat upozornění na zálohování?

Jmenovitě určená osoba se zástupcem pro dobu dovolené. Upozornění, které přichází do sdílené schránky, kterou nikdo nečte, je jako by žádné nebylo. Rozhodněte také, kdo informuje vedení, když poslední úspěšná záloha překročí předem dohodnutou hranici.

Potřebujete pomoc hned teď?

Nic neobnovujte, dokud neidentifikujete zdravou kopii. Rádi vás provedeme.

Volejte +33 9 72 50 78 28nebo nám napište

Řešíte právě incident?

Naše týmy vám pomohou určit správnou kopii a obnovit data, od pondělí do pátku 9:00–13:00 a 14:00–17:30 (pařížského času).