View a markdown version of this page

OPS06-BP01 為失敗變更進行規劃 - AWS Well-Architected 架構

OPS06-BP01 為失敗變更進行規劃

計劃在變更未達到理想成果時,恢復到已知的良好狀態,或者在生產環境中進行補救。透過這樣準備可加快回應速度,以縮短復原時間。

常用的反模式:

  • 您執行了部署,而您的應用程式變得不穩定,但系統中似乎有作用中使用者。您必須決定是否要復原變更並影響作用中使用者,或在知道使用者無論如何都會受到影響的情況下,等待復原變更。

  • 在進行路由變更後,您可以存取新的環境,但其中一個子網路變成無法連線。您必須決定是否要復原所有項目,或嘗試修正無法存取的子網路。當您做出該決定時,子網路仍無法連線。

建立此最佳實務的優勢: 具有適當的計劃可減少從不成功變更中復原的平均時間 (MTTR),從而減少對最終使用者的影響。

若未建立此最佳實務,暴露的風險等級:

實作指引

  • 為失敗變更進行規劃:計劃在變更未達到理想成果時,恢復到已知的良好狀態 (即回復變更),或者在生產環境中進行補救 (即向前回復變更)。當您確定無法回復的變更時,在提交之前應進行盡職調查。