2025年3月29日 星期六

若出現AWS EC2"數據不足"且異常重啟,應如何檢視與處置

            

    當AWS EC2實例本身出現數據不足(例如存儲、內存或網絡資源不足)時,且因此發生重啟,通常是因為EC2內部資源分配或使用達到極限,導致實例無法正常運行,進而觸發重啟或宕機。可依序檢視EC2以下功能是否正常:

1. 檢查 EC2 實例的 CPU、內存和磁碟使用情況

    如下圖,在EC2檢視時選取並檢視項目如CPU、內存、磁碟與網路,會即刻呈現使用情形:

            


2. 查看 CloudWatch Logs

(1)查看EC2系統日誌:檢查 EC2 系統日誌,了解是否有硬體或系統錯誤的記錄。

(2)查看CloudWatch監控指標:在 CloudWatch 中查看 EC2 的 CPU 使用率、記憶體使用率、磁碟 I/O 等指標。這些指標能幫助確認資源過載的時間與資訊。



3. 查看 AWS Health Dashboard

    有時 AWS 本身的基礎設施問題(如區域內的硬體故障)會導致實例異常重啟。可以查看 AWS Health Dashboard 以查看是否有任何影響你的區域或服務的問題。

常見的故障排除方法:

1.重啟實例:如果實例的狀態檢查未通過,首先重啟實例可能會解決許多暫時性問題。

2.停止並啟動實例:如果重啟無效,可以停止並重新啟動實例,這樣會將實例移動到新的物理主機上。

3.更換實例類型:若實例仍處於過載狀態,可以考慮升級實例類型(提升規格等),並協助調整所需設定。

4.若異常發生當下有排程工作,應確認應用程式方面有無錯誤,是否有程式衝突/資源瓶頸

以下技術文技可供參考








沒有留言:

張貼留言

AWS 帳戶異常活動處理方式

搜尋此網誌