Recovery-Time-Objectives (RTO) und Recovery-Point-Objectives (RPO) geben die zulässige Dauer von Softwareausfällen und den zeitlichen Abstand zwischen Backups eines Unternehmens an.
- RTO: Die maximale Dauer eines Anwendungsausfalls, bevor der Geschäftsbetrieb erheblichen Schaden nimmt.
- RPO: Die Datenmenge, die verloren gehen kann, bevor ein Unternehmen erhebliche betriebliche oder finanzielle Folgen zu spüren bekommt.
RTO und RPO sind zusammen nützliche Werkzeuge für Notfallwiederherstellungs- und Geschäftskontinuitätsverfahren und für Unternehmen, die Backup-Anforderungen genau verfolgen müssen, unverzichtbar. Dieser Artikel untersucht beide Kennzahlen, ihre Unterschiede und ihre Anwendungsfälle im Detail.
- Vergleichstabelle: RTO vs. RPO
- Wie funktionieren RPO und RTO?
- Funktionsweise des Recovery-Time-Objectives
- Best Practices zum Erreichen des RTO
- Funktionsweise des Recovery-Point-Objectives
- Best Practices zum Erreichen des RPO
- Gemeinsamkeiten und Unterschiede zwischen RPO und RTO
- Wann RPO und RTO verwendet werden
- Anwendungsfälle für das Recovery-Time-Objective
- Anwendungsfälle für das Recovery-Point-Objective
- Fazit: Ziele für Backup und Wiederherstellung im Unternehmen priorisieren
Vergleichstabelle: RTO vs. RPO
Die folgende Tabelle zeigt die Unterschiede zwischen Recovery-Time-Objectives und Recovery-Point-Objectives auf einen Blick.
| Merkmal | Gemessen in | Variiert aufgrund von | Relevante Überlegungen |
|---|---|---|---|
| RTO | Sekunden, Minuten, Stunden oder Tagen sowie den erforderlichen Schritten zur Wiederaufnahme des Geschäftsbetriebs | Kritikalität der beeinträchtigten Anwendung | Erwartete durchschnittliche Ausfallkosten Wie schnell die Wiederherstellung erfolgen muss, um Komplikationen zu begrenzen |
| RPO | Menge der verlorenen Daten | Häufigkeit des Backup-Zeitplans | Die Datenmenge, deren Verlust sich ein Unternehmen leisten kann Häufigkeit und Vollständigkeit des bestehenden Backup-Zeitplans |
Wie funktionieren RPO und RTO?
IT-Verantwortliche in einem Unternehmen führen eine Business-Impact-Analyse (BIA) durch, um die RPO- und RTO-Werte zu ermitteln. Dabei bestimmen sie die wahrscheinlichen Auswirkungen von Störungen kritischer Anwendungen oder Prozesse durch Katastrophen, schwerwiegende Fehler oder andere Notfälle.
Die Ergebnisse der BIA hängen unter anderem von der Art der Geschäftsanwendungen des Unternehmens, der Beschaffenheit der erfassten und gespeicherten Daten sowie der Art des möglichen Notfalls ab. Zu den relevanten Katastrophen zählen:
- Stürme oder Überschwemmungen, die Datenspeicheranlagen beeinträchtigen
- Computerviren, die kritische Anwendungen infizieren
- Ransomware-Angriffe, die den Dateizugriff einschränken
- Böswillige Insider, die Datendiebstahl begehen
- Ausfälle von Anwendungen von Drittanbietern
Unternehmen können RPO und RTO als Kontinuum darstellen und beide als Zielvorgaben betrachten. Über diese Gemeinsamkeit hinaus bestehen bei den erforderlichen Berechnungen grundlegende Unterschiede.
Funktionsweise des Recovery-Time-Objectives
Das Recovery-Time-Objective eines Unternehmens gibt an, wie lange es sich einen Anwendungsausfall leisten kann, ohne dass der Geschäftsbetrieb erheblich geschädigt wird. Manche Anwendungen können tagelang ausfallen, ohne dass wesentliche Folgen entstehen, während Anwendungen mit hoher Priorität nur wenige Sekunden ausfallen dürfen, bevor sie Kunden frustrieren und zu Umsatzeinbußen führen.
RTO berechnen
Bei der Berechnung des RTO sollte ein Unternehmen Anwendungen nach Priorität und potenziellem Verlust sowie anhand der verfügbaren Ressourcen oder Optionen kategorisieren. So erfordern Standardpläne für RTOs nahe null Failover-Dienste, während vierstündige RTOs eine Wiederherstellung vor Ort erlauben, die mit Bare-Metal-Recovery beginnt und mit der vollständigen Verfügbarkeit von Anwendung und Daten endet.
Hat die IT für Anwendungen mit hoher Priorität in Failover-Dienste investiert, kann sie das RTO sicher in Sekunden angeben. Failover-Dienste wechseln automatisch zu einem anderen Server oder einer anderen Plattform, wenn ein System ausfällt. Die IT muss zwar weiterhin eine lokale Umgebung wiederherstellen, hat dafür aber mehr Zeit, da die Anwendung in der Cloud verarbeitet wird.
Fragen zur Berechnung des RTO
Das RTO unterscheidet sich typischerweise je nach Anwendung und deren Funktion. Viele Entscheidungsträger können kritische RTO-Berechnungen leichter durchführen, wenn sie folgende Fragen stellen:
- Welche kundenorientierten Anwendungen müssen für Kunden ständig verfügbar sein?
- Welche Anwendungen müssen verfügbar sein, damit die umsatzrelevanten Abläufe des Unternehmens funktionieren?
- Verfügt das Unternehmen über Anwendungen, die die Sicherheit an vorderster Front gewährleisten?
- In welchen Datenspeichern liegen die kritischen Anwendungen des Unternehmens?
- Wie lange kann eine Anwendung ausfallen, bevor sie die Nutzererfahrung beeinträchtigt?
- Wie lange dauert es typischerweise, die Funktionalität einer erforderlichen Anwendung nach einem Ausfall wiederherzustellen?
- Kann das Unternehmen die verlorenen Daten einer Anwendung aus vorhandenen Backups wiederherstellen?
- Wie unterstützt diese Anwendung das Unternehmen beim Erreichen seiner Ziele?
Best Practices zum Erreichen des RTO
Obwohl das RTO von einer Vielzahl von Variablen abhängt, können die folgenden Grundsätze Unternehmen dabei helfen, ihre RTO-Ziele besser zu erreichen.
Realistisch bleiben und Verbesserungspotenzial erkennen
Beginnen Sie mit realistischen Erwartungen – dennoch kann sich herausstellen, dass das RTO außer Reichweite liegt. In solchen Fällen besteht eine praktikable Vorgehensweise darin, die wahrscheinlichen Schwachstellen zu ermitteln.
Beispielsweise kann ein Unternehmen unterbesetzt sein, sodass Teams selbst dann kontinuierlich Schwierigkeiten haben, die Funktionalität einer Anwendung wiederherzustellen, wenn alle Mitarbeiter an der Aufgabe arbeiten. Die Einstellung weiterer Mitarbeiter kann dann die geeignetste Option sein.
Vorhandene Backup-Technologien prüfen
Prüfen Sie die aktuelle Backup-Lösung Ihres Unternehmens – wenn sie Ihre Ziele nicht erfüllt, sollten Sie in eine bessere Alternative investieren. Das gilt besonders, wenn das Unternehmen eine veraltete Backup-Lösung einsetzt, die regelmäßig hinter den RTO-Zielen zurückbleibt. Die Investition in ein aktualisiertes Backup oder eine Notfallwiederherstellungsplattform kann Unternehmen dabei helfen, das gewünschte RTO zu erreichen.
Anwendungscode bei Bedarf aktualisieren
Prüfen Sie, ob Probleme mit einer Anwendung auf Fehler oder veralteten Code zurückzuführen sind – falls ja, können deren Behebung zu weniger Ausfällen und kürzeren Stillstandszeiten führen.
Echtzeitbenachrichtigungen nutzen
Konfigurieren Sie Echtzeitwarnungen, die sofort Rückmeldung geben, wenn eine Anwendung Leistungsprobleme zeigt, oder richten Sie Tools so ein, dass Benachrichtigungen die zuständigen Mitarbeiter auf den geeigneten Plattformen und Geräten erreichen.
Anwendungen mit niedrigem RTO ermitteln
Beschränken Sie niedrige RTOs auf wenige ausgewählte Anwendungen. Die meisten Unternehmen können für viele Systeme keine sehr kurzen RTOs aufrechterhalten, da das Erstellen und Speichern von Backups für jede Unternehmensanwendung alle paar Stunden teuer ist.
Notfallwiederherstellung und Geschäftskontinuität planen
Erwägen Sie die Einführung eines leistungsstarken Plans für Notfallwiederherstellung oder Geschäftskontinuität. Für einige große Unternehmen, die sich eine fortschrittlichere Wiederherstellungsplattform leisten können, macht dies beim Erreichen der RTO-Erwartungen einen erheblichen Unterschied. Obwohl die Auswahl und Bereitstellung solcher Lösungen Zeit und die Zustimmung der Stakeholder erfordert, sind sie wertvolle Ressourcen – insbesondere für Unternehmen mit vielen geschäftskritischen Systemen.
Funktionsweise des Recovery-Point-Objectives
Das Recovery-Point-Objective eines Unternehmens bezeichnet seine Verlusttoleranz, also die Datenmenge, die verloren gehen kann, bevor erheblicher Schaden entsteht. Das RPO ist eine Zeitspanne zwischen dem Verlustereignis und dem aktuellsten Backup.
Wenn ein Unternehmen alle oder die meisten seiner Daten regelmäßig in Intervallen von 24 Stunden sichert, wären im schlimmsten Fall 24 Stunden Daten verloren. Für manche Anwendungen ist das akzeptabel, für andere nicht.
RPO berechnen
Das RPO lässt sich schrittweise berechnen. Befolgen Sie diese Richtlinien und legen Sie Zeitspannen für alle wichtigen Systeme fest, um zu bestimmen, wie viele Daten Ihr Unternehmen ohne erheblichen Schaden verlieren kann:
- Führen Sie Tests durch, um zu ermitteln, wie schnell Daten für jede Unternehmensanwendung verfügbar sein müssen, beispielsweise für Cloud-Speicherplattformen, CRM-Lösungen und E-Commerce-Anwendungen.
- Kategorisieren Sie alle wichtigen Unternehmensanwendungen anhand ihrer Anforderungen an die Backup-Wiederherstellung – müssen die Daten beispielsweise innerhalb weniger Minuten wiederhergestellt werden, oder können sie einen Tag warten?
- Berechnen Sie die finanzielle Situation des Unternehmens in Bezug auf Backups. Für wie viele Anwendungen kann es sich leisten, Failover- und Replikationsdienste aufrechtzuerhalten? Muss das Unternehmen einige Backups offline speichern, etwa auf physischen Festplatten?
- Wählen Sie Anwendungen mit höchster Priorität für die sofortige Wiederherstellung aus. Dies kann schnell erfolgen, wenn die Server, die die zentrale Cloud-Plattform unterstützen, kontinuierlich repliziert werden. Eine Datenbank mit früheren Vertriebskontakten, die auf Festplatten gesichert wurde, könnte hingegen Stunden für die Wiederherstellung benötigen. Die meisten Unternehmen können sich keine schnellen Backups für sämtliche Software leisten – priorisieren Sie daher sorgfältig.
RPO-Ziele festlegen
Je nach Priorität der Anwendung reichen einzelne RPOs typischerweise von nahezu null (gemessen in Sekunden) bis zu 24 Stunden. Unternehmen, die RPOs von mehr als acht Stunden festlegen, können diese möglicherweise mit vorhandenen Backup-Lösungen erreichen, sofern dies die Produktionssysteme nur minimal beeinträchtigt.
Vierstündige RPOs erfordern eine geplante Snapshot-Replikation. RPOs nahe null erfordern kontinuierliche Replikation. Wenn sowohl RPO als auch RTO nahe null liegen, sollten Unternehmen kontinuierliche Replikation mit Failover-Diensten kombinieren, um eine nahezu 100-prozentige Verfügbarkeit von Anwendungen und Daten zu erreichen.
Anwendungsbezogene RPO-Ziele festlegen
Legen Sie RPO-Ziele anhand der Art und Dringlichkeit der von den betroffenen Anwendungen gespeicherten Daten fest. Ein vierstündiges RPO für eine Anwendung bietet beispielsweise einen maximal vierstündigen Zeitraum, um Daten vor einem Verlust zu sichern.
Ein vierstündiges RPO bedeutet nicht zwangsläufig, dass das Unternehmen vier Stunden an Daten verliert. Eine Textverarbeitungsanwendung, die um Mitternacht ausfällt und um 1:15 Uhr wieder verfügbar ist, verliert möglicherweise gar keine Daten. Fällt jedoch eine stark ausgelastete Anwendung um 10 Uhr aus und wird um 14 Uhr wiederhergestellt, könnte das Unternehmen Stunden wertvoller und möglicherweise unersetzlicher Informationen verlieren. In solchen Fällen sollten häufigere Backups eingerichtet werden, um ein anwendungsspezifisches RPO zu erreichen.
Best Practices zum Erreichen des RPO
Beginnen Sie wie bei den RTO-Zielvorgaben damit, zu verstehen, welches RPO das Unternehmen mit den aktuellen Ressourcen realistisch erreichen kann. Testen Sie vor der Festlegung dieser Ziele die Backup-Raten verschiedener Failover- und Replikationsdienste, Festplatten und Flash-Arrays. Untersuchen Sie historische Daten, um festzustellen, wie lange frühere Wiederherstellungen gedauert haben. Der Versuch, ein RPO zu erreichen, das erheblich von historischen Trends abweicht, kann zu Entmutigung und Frustration führen und zugleich darauf hindeuten, dass das Unternehmen seine Ressourcen erweitern muss.
Auch die Schulung der Mitarbeiter ist entscheidend. Alle am Backup-Prozess beteiligten Personen müssen bei einem Vorfall oder Ausfall schnell und unverzüglich reagieren, damit sie wissen, was bei einem Systemausfall zu tun ist, und in einer dringenden Situation sicher handeln können.
Möglicherweise sind auch technologische Upgrades erforderlich. Stellen Sie sicher, dass Replikations- und Failover-Dienste zuverlässig und modern sind – Dienste auf einem alten, unzuverlässigen Server arbeiten möglicherweise nicht ebenso schnell. Optimieren Sie außerdem die Netzwerkleistung, damit das Unternehmensnetzwerk die Backup-Raten für Daten unterstützt. Hoher Datenverkehr könnte das Unternehmen daran hindern, seine Backup-Zeiten einzuhalten.
Gemeinsamkeiten und Unterschiede zwischen RPO und RTO
RPO und RTO sind wichtige Überlegungen für Pläne zur Notfallwiederherstellung oder Geschäftskontinuität. Eine Business-Impact-Analyse kann in den frühen Phasen der Berechnung von RPO und RTO eingesetzt werden.
RTO bezieht sich auf die Dauer eines Ausfalls. RPO steht mit Datenverlust und Backup-Häufigkeit in Zusammenhang. Einige Ursachen für Ausfallzeiten liegen außerhalb der Kontrolle eines Unternehmens, aber Unternehmensverantwortliche können entscheiden, wie oft Backups erstellt werden, und so den potenziellen Schaden begrenzen.
Das RTO ist eine zukunftsorientierte Kennzahl, mit der bestimmt wird, wie lange ein betroffenes Unternehmen für die Wiederaufnahme des Betriebs benötigt. Beim RPO hingegen wird zurückgeblickt, um festzustellen, wann das letzte Datenbackup erstellt wurde und wie viele Informationen das Unternehmen aufgrund des Problems verlieren wird.
Wann RPO und RTO verwendet werden
Verwenden Sie das Recovery-Point-Objective beim Umgang mit Daten, die für den Geschäftsbetrieb kritisch sind und deren Verlust sich das Unternehmen nicht leisten kann. RPO ist auch die richtige Wahl, wenn ein Unternehmen bestimmte Datenanforderungen erfüllen muss, um regulatorische Vorgaben einzuhalten.
Darüber hinaus zeichnet sich ein zunehmender Trend ab, Recovery-Point-Objectives festzulegen, wenn Informationen an mehreren Orten gespeichert werden, etwa in der Cloud und an einem physischen Standort. Solche Konstellationen sind komplexer, sodass zusätzliche Vorsichtsmaßnahmen erforderlich sind.
Zunehmende Ransomware-Angriffe haben Unternehmensverantwortliche ebenfalls dazu bewegt, RPO ernster zu nehmen. Dies kann die Auswirkungen eines Vorfalls verringern und den Druck zur Zahlung des Lösegelds reduzieren. Unternehmen, die häufige Backups durchführen und über robuste Wiederherstellungspläne verfügen, erleiden deutlich seltener erhebliche finanzielle Folgen und betriebliche Unterbrechungen.
Die geeignetsten Anwendungsfälle für Recovery-Time-Objectives sind solche, bei denen selbst kurze Ausfälle katastrophale Folgen haben könnten. Notrufsysteme und Überwachungstools für kritische Industriesysteme sind gute Beispiele.
Berücksichtigen Sie die Folgen von Ausfällen für Kunden. So stürzte Ticketmaster ab, als Fans versuchten, Taylor-Swift-Tickets zu kaufen. Der Vorfall wurde in Nachrichtenartikeln und sozialen Medien vielfach thematisiert und kritisiert und lieferte anderen Unternehmen Beispiele dafür, wie sie nicht vorgehen sollten.
Anwendungsfälle für das Recovery-Time-Objective
Die folgenden Beispiele zeigen verschiedene Einsatzmöglichkeiten, mit denen RTOs Unternehmen helfen können, katastrophale Folgen zu vermeiden.
Wiederherstellung wichtiger E-Mails
Ein Unternehmensanwalt löscht versehentlich eine zeitkritische E-Mail und leert anschließend den Papierkorb. Die IT sichert jedoch kontinuierlich Änderungen auf Delta-Ebene in Microsoft Exchange, einer geschäftskritischen Anwendung dieses stark ausgelasteten Unternehmens. Die Backup-Anwendung unterstützt die granulare Sicherung und Wiederherstellung, sodass das Unternehmen die einzelne Nachricht innerhalb eines RTO von fünf Minuten wiederherstellen kann, anstatt für eine einzige E-Mail eine komplette virtuelle Maschine wiederherzustellen.
Verfügbarkeit einer E-Commerce-Website sicherstellen
Die selbst gehostete E-Commerce-Website eines Geschäfts nutzt drei Datenbanken: eine relationale Datenbank für den Produktkatalog, eine Dokumentendatenbank mit historischen Bestelldaten und eine API-Datenbank, die eine Verbindung zum Gateway des Zahlungsdienstleisters herstellt.
Die Dokumentendatenbank kann Daten aus anderen Quellen rekonstruieren, daher liegen ihr RTO und RPO innerhalb von 24 Stunden. Das Unternehmen fügt der relationalen Datenbank nur einmal pro Woche Produkte hinzu, daher ist das RPO nicht kritisch. Das RTO hingegen ist entscheidend: Wenn die Datenbank ausfällt, werden Kundentransaktionen unterbrochen.
Das Unternehmen investiert in einen Failover-Dienst, durch den die Datenbank sofort auf virtuellen Servern gestartet wird. Die wenigen während der Woche vorgenommenen Änderungen repliziert das Unternehmen auf die Notfallwiederherstellungsplattform seines Anbieters. Die API-Datenbank enthält Bestellinformationen und benötigt sowohl beim RPO als auch beim RTO Werte im Sekundenbereich. Die IT repliziert die Daten kontinuierlich auf den Failover-Standort, der die Verarbeitung sofort übernimmt, wenn die API-Datenbank ausfällt.
Anwendungsfälle für das Recovery-Point-Objective
Die folgenden Beispiele zeigen verschiedene Einsatzmöglichkeiten des RPO, um die Geschäftskontinuität nach einem Ereignis aufrechtzuerhalten.
Wiederherstellung einer CRM-Plattform
Die in der Hauptniederlassung eines Unternehmens in Florida gehostete CRM-Software fällt aus, als ein schwerer Sturm aufzieht. Der Serverraum wird beschädigt, aber alle CRM-Daten werden in ein Rechenzentrum gesichert in Missouri. Aufgrund der Bedeutung der CRM-Plattform priorisierten die Teams Replikations- und Failover-Dienste und replizierten die Backups des Rechenzentrums nur wenige Minuten vor dem Eintreffen des Sturms.
Die für die Wiederherstellung zuständigen Teammitglieder – viele von ihnen außerhalb des Bundesstaats und nicht direkt in Florida tätig – befolgen sofort den Eskalationsprozess ihres Notfallwiederherstellungsplans und können das RPO von 15 Minuten einhalten.
Zeitgesteuerte Festplatten-Backups einrichten
Backups sind für alle Beteiligten am bequemsten, wenn sie automatisch oder mit nur geringem Überwachungsaufwand durchgeführt werden. Apples Mac-Computer verfügen über die Anwendung Time Machine, die diese Aufgabe übernimmt: Sobald jemand ein externes Laufwerk an einen Mac mit Time Machine anschließt und die Anwendung aktiviert, führt sie die folgenden automatischen Backups durch:
- Stündliche Backups für den vergangenen Tag
- Tägliche Backups für den vergangenen Monat
- Wöchentliche Backups für alle Zeiträume von mehr als einem Monat
In diesem Fall wird der aktuellste Wiederherstellungspunkt verwendet, wenn der Bedarf für eine Datenwiederherstellung erkannt wird. Die meisten Unternehmen nutzen technologisch fortschrittlichere Lösungen als Time Machine – das Konzept der Anwendung veranschaulicht jedoch deutlich, warum Unternehmen vor der Festlegung des RPO wichtige Entscheidungen zu ihren Daten treffen müssen.
Fazit: Ziele für Backup und Wiederherstellung im Unternehmen priorisieren
Die Verwaltung von RTO und RPO ist für Unternehmen entscheidend, damit sie ihre Ziele für die Datensicherung strategisch erreichen. Diese Messgrößen liefern Unternehmen konkrete Kennzahlen, die sie bei der Entwicklung von Backup- und Wiederherstellungsstrategien berücksichtigen können. Darüber hinaus macht die Ermittlung dieser wichtigen Leistungsindikatoren überwältigend wirkende Aufgaben besser handhabbar.
Die Herausforderung für alle Unternehmen besteht darin, Anwendungen zu priorisieren und zu entscheiden, in welche Anwendungen mehr finanzielle Mittel investiert werden müssen. Wie viele Lösungen für die sofortige Wiederherstellung kann sich das Unternehmen leisten? Die RTO- und RPO-Werte der einzelnen Systeme zu kennen, kann bei dieser Entscheidung helfen.
Unternehmensverantwortliche sollten RTO und RPO als gleichermaßen wichtig betrachten, statt nur eines der beiden zu messen. Beide Messgrößen zeigen, welche Anwendungen und Daten für das Unternehmen am kritischsten sind und was erforderlich ist, damit sie für einen erfolgreichen Betrieb funktionsfähig bleiben.
Lesen Sie 11 Best Practices für die Datensicherung, um weitere Grundsätze des Datenmanagements in Unternehmen zu entdecken.