PERF03-BP03 收集並記錄資料存放區效能指標
追蹤並記錄資料存放區的相關績效指標,以了解資料管理解決方案的成效。這些指標可協助您最佳化資料存放區、確認是否符合工作負載需求,並提供工作負載執行方式的清晰概觀。
常見的反模式:
-
您只使用手動日誌檔案來搜尋指標。
-
您只會將指標發佈到團隊使用的內部工具,而不會全面了解您的工作負載。
-
您只會使用所選監控軟體記錄的預設指標。
-
您只會在有問題時審查指標。
-
您只監控系統層級指標,而沒有擷取資料存取或用量指標。
建立此最佳實務的優勢:建立效能基準可協助您了解工作負載的正常行為和需求。異常模式可以更快地識別和偵錯,進而改善資料存放區的效能和可靠性。
未建立此最佳實務時的曝險等級:高
實作指引
要監控資料存放區的效能,您必須記錄一段時間的多個效能指標。這可讓您偵測異常情況,並根據業務指標衡量效能,以確認您是否滿足工作負載需求。
指標應包括支援資料存放區的基礎系統和資料庫指標。基礎系統指標可能包括 CPU 使用率、記憶體、可用磁碟儲存體、磁碟 I/O、快取命中率以及網路輸入和輸出指標,而資料存放區指標可能包括每秒交易數、常用查詢、平均查詢速率、回應時間、索引使用狀況、表格鎖定、查詢逾時以及開啟的連線數目。此資料對於了解工作負載的執行情況以及資料管理解決方案的使用方式至關重要。將這些指標納入資料驅動的方法,以調整和優化工作負載的資源。
使用工具、程式庫和系統來記錄與資料庫效能有關的效能測量值。
實作步驟
-
找出要追蹤的資料存放區關鍵效能指標。
-
使用核准的日誌記錄和監控解決方案來收集這些指標。Amazon CloudWatch
可以收集架構中各種資源的指標。您還可以收集和發佈自訂指標以顯示業務或衍生指標。使用 CloudWatch 或第三方解決方案,設定可指出何時超過閾值的警示。 -
檢查資料存放區監控是否能從可偵測效能異常的機器學習解決方案中獲益。
-
適用於 Amazon RDS 的 Amazon DevOps Guru 可檢視效能問題,並提出修正動作的建議。
-
-
在監控和日誌記錄解決方案中設定資料保留,以符合安全性和營運目標。
資源
相關文件:
相關影片:
相關範例: