存儲評論網

避免史詩般的災難恢復失敗的四種方法——在為時已晚之前你需要知道的

資料保護  ◇  企業

備份和恢復有點像滑雪。 當需要加速下山或在發生災難時保持業務正常運轉時,稍作準備將決定是順利著陸還是直接墜入雪堆。 這裡有四種方法可以避免史詩般的失敗。

史詩般的失敗#1:齒輪故障

您如何在斜坡上發現新手? 擁有昂貴、時尚的滑雪夾克但手套很薄且油漆不防水的滑雪者怎麼樣? 還是那個忘記確保他的固定器處於良好工作狀態並且在半山腰丟失了他的滑板的人? 畢竟,除非您的裝備正常工作,否則您無法粉碎山丘。

同樣,如果在數據丟失發生之前您的備份沒有到位,您將無法從災難中恢復。 在災難發生之前,確保您的技術正常工作並擁有足夠強大的功能集對您的業務至關重要,這一點至關重要。 您需要一個自動且可靠的實施,通過在線和離線驗證維護數據的完整性,通過恢復保證軟件自動進行恢復測試,並將備份成功複製到輔助位置或云。 簡而言之,確保您的數據確實在異地備份和復制。 聽起來很簡單,但重要的是要確認即使您的本地服務器出現故障,您的業務也能繼續運行。

史詩般的失敗 #2:忽略路線圖

如果不檢查它是去綠色斜坡還是黑色鑽石,你就不會登上滑雪纜車。 你也不會在沒有計劃的情況下轉出小徑並在樹林中滑雪,因為你很可能會發現自己撞到泥土或更糟糕的東西,比如掉進裂縫或峽谷。 在你上山之前,你需要計劃你的下降。 您還需要檢查沿途的標誌以確保您仍在路線上。

正如您需要一張滑雪板探險路線圖一樣,您還需要一份成功災難恢復的書面計劃。 這意味著您需要創建一個範圍廣泛且包含分步指南的文檔。 這應該考慮到三個獨特的領域:

  • 人員:確定關鍵運營人員,並為他們制定在災難發生時遠程或在次要地點工作的方式。 這意味著無論他們位於何處,都可以讓他們直接訪問維持業務運營所需的恢復系統、數據和其他資源。 在您組織的主要通信基礎設施(例如,公司電子郵件或電話系統)出現故障的情況下,設置備用通信方式(例如,員工的手機)也很重要。
  • 基礎設施:確定關鍵的運營基礎設施——您的業務離不開的那些基礎設施部分——並確保它們受到保護。 請記住,您希望您的 IT 基礎架構成功度過災難的原因是您最重要的資產,您的員工,擁有他們需要的工具來繼續推動業務收入和盈利能力。
  • 流程:確定關鍵的運營流程——概述在發生中斷時誰做什麼的分步指南——並確保團隊成員了解並實踐他們的角色。 考慮對企業日常運營至關重要的每個流程,不要只關注 IT 流程。

您的 DR 計劃以及您的數據保護解決方案還應該滿足您公司的恢復點目標 (RPO),或者您可以承受丟失的最大數據量(以時間表示),以及您的恢復時間目標(RTO),這是您可以承受的沒有數據和系統的最長時間。 最好的 DR 計劃基於正在恢復的數據量以及這些信息需要以多快的速度上線。

史詩般的失敗#3:忽視練習

如果您第一次下山是在雙黑鑽步道上,您肯定會摔倒在地。 您不能僅僅購買裝備並研究路線圖,然後神奇地知道如何在沒有踏上雪地的情況下滑雪。 練習技巧、鍛煉身體素質和磨練直覺是成功下山的關鍵。

在災難期間繼續您的業務並恢復丟失的數據是黑鑽級別的事件。 如果您從未測試過您的 DR 策略,您很可能會一敗塗地。 IT 管理員安裝備份解決方案並且很少(或從不)抽空測試實際恢復的情況並不少見。 此外,在測試方面,一兩個是不夠的。 當今數字化轉型和 IT 發展的快速步伐意味著您的基礎設施也在快速變化。 最好的 DR 測試是迭代的,並且按照一致的計劃進行,因此您可以確保您的備份能夠保護公司基礎架構的當前狀態。 數據的更改率是確定測試災難恢復計劃的頻率的良好基準。 一些備份供應商提供自動 DR 測試,這可以為您節省大量時間和麻煩。

您還需要考慮各種災難場景並評估 DR 流程可能會因此發生怎樣的變化。 例如,您的策略是否需要團隊成員開車到次要位置輪換媒體? 如果洪水或暴風雪等大規模自然災害阻礙了旅行怎麼辦? 在雲中備份是克服物理和基於站點限制的一個很好的解決方案,但您還需要計劃從雲中恢復數據的速度。 超大規模雲可以提供廉價的存儲,但可能需要數天才能通過 WAN 恢復數據。 如果您沒有在地理上與主站點分開的輔助站點(對許多企業來說這是一個昂貴的提議),DR 即服務可以在雲中提供負擔得起的啟動和業務連續性。 無論您選擇什麼,都要了解供應商的 SLA,了解您的 RPO 和 RTO,當然還有測試。

史詩般的失敗#4:假設所有的雪都是一樣的

如果粉末總是新鮮的並且小徑從不擁擠,那就太好了,但讓我們面對現實吧,有時您會在泥濘中掙扎或在春假期間避開遊客。 經驗豐富的寄宿生也知道,如果你培養了應對不同地形和不同雪地公園的技能,你往往會玩到最有趣的單板滑雪。 即使您將大部分時間花在自己喜歡的斜坡上,步道也會每天和每個季節發生變化。 如果您假設所有的雪都是一樣的,那麼您會發現自己在下山的路上遇到了麻煩。

對於您的 IT 基礎架構,您不能假定同質性。 也許您更喜歡盡可能多的虛擬化,但您的組織需要一些物理服務器。 保持靈活性非常重要,這樣您的 IT 團隊才能對用戶不斷變化的需求和不斷發展的技術環境保持響應和敏捷。

舉一個最常見的例子,避免單一供應商鎖定對於現代 IT 的技術和財務成功都至關重要。 DR 故障經常發生是因為管理員在他們的 DR 規劃中只支持單一的技術。 例如,它們將支持 SAN 或 NAS 等存儲技術,但忽略直接附加存儲; 擁抱虛擬化,忽視物理服務器; 或支持物理設備,但未考慮不同型號和不同代服務器之間的恢復需求。 創建並測試包含您的業務保持運行所需的技術範圍的備份和災難恢復計劃。

如果您是單板滑雪新手,首先要知道的事情之一就是您會摔倒。 IT 基礎設施也是如此——無論是用戶的輕微刪除、破壞性的惡意軟件入侵,還是導致整個站點癱瘓的全面自然災害,都會發生數據丟失。 無論大小如何,您都可以做好準備。 通過確保您的設備正常運行、完成您的計劃、測試您的 DR 並保持策略的靈活性來避免史詩般的失敗。 這樣一來,您很快就會粉碎這些斜坡。

關於作者

Brooke Bullman是Unitrends的產品行銷經理,Unitrends是企業級雲端業務連續性解決方案的領先供應商。欲了解更多信息,請通過info@unitrends.com聯繫作者,或訪問www.unitrends.com。

討論這個故事

註冊 StorageReview 時事通訊

參與 StorageReview

電子報| YouTube | PodcastiTunes / Spotify | Instagram | Twitter | TikTok | RSS訂閱

訪客作者