View a markdown version of this page

OPS06-BP01 针对不成功的更改制定计划 - AWS Well-Architected Framework

OPS06-BP01 针对不成功的更改制定计划

制定计划,以便在变更没有达到目标成效时在生产环境中恢复到已知良好状态,或者进行修复。做好充分的准备,以备快速响应,最大限度缩短回滚时间。

常见反模式:

  • 您执行部署以后应用程序变得不稳定,但是系统上似乎还有活动用户。您必须决定是回滚更改并影响活动用户,还是等到知道用户无论如何都可能受到影响后再回滚更改。

  • 更改路由后,可以访问新环境,但是其中一个子网无法访问。您必须决定是回滚所有内容还是尝试修复无法访问的子网。在您做决定时,子网仍然无法访问。

建立此最佳实践的好处: 实施计划来缩短不成功更改的平均修复时间(MTTR,Mean Time To Recover),减少对最终用户的影响。

未建立这种最佳实践的情况下暴露的风险等级:

实施指导

  • 针对不成功的更改制定计划:制定计划,以便在更改没有实现所需成果时在生产环境中恢复到已知良好状态(即回滚更改),或者进行修复(即前滚更改)。如果发现在失败后无法回滚的更改,请在提交更改之前做好准备。