我的 Amazon Elastic Compute Cloud (Amazon EC2) 執行個體有一或多項狀態檢查失敗。
簡短說明
Amazon EC2 使用三項狀態檢查來監控 EC2 執行個體的運作狀態:
重要: 部分狀態檢查解決方法需要您先停止再啟動執行個體。重新啟動執行個體時,執行個體會保留在相同的實體主機上。若要遷移至新硬體,您必須停止再啟動執行個體。
解決方法
首先,請檢視執行個體的狀態檢查指標,以找出失敗的狀態檢查。接著,根據失敗的狀態檢查採取以下動作。
設定執行個體以進行停止再啟動
注意: 停止再啟動執行個體後,執行個體的公共 IP 位址會變更。最佳實務是使用彈性 IP 位址將外部流量路由至執行個體,而非使用公共 IP 位址。如果您使用 Amazon Route 53,則公共 IP 位址變更時,可能需要更新 Route 53 DNS 記錄。停止再啟動與重新啟動執行個體不同。如需更多資訊,請參閱 EC2 執行個體的停止和啟動運作方式。
停止再啟動執行個體之前,請採取以下動作:
疑難排解系統狀態檢查失敗問題
執行個體執行所在的基礎結構發生問題時,系統狀態檢查會失敗。
若要疑難排解系統狀態檢查失敗問題,請在執行個體所在的 AWS 區域內,檢查 AWS Health 儀表板是否有服務中斷情形。
如果沒有服務中斷,則表示執行個體的基礎主機發生問題。若要疑難排解此問題,請完成以下步驟,將執行個體遷移至新的基礎主機:
- 停止執行個體。
注意: 如果執行個體停滯在正在停止狀態,請強制停止執行個體。此動作最多可能需要 10 分鐘。
- 啟動執行個體。
若要自動復原因系統狀態檢查失敗的執行個體,請設定執行個體自動復原。
重要: 強制停止不會將檔案系統快取中的資料寫入磁碟,可能造成資料遺失或損毀。重新啟動後,請根據您的作業系統 (OS) 執行以下命令,以檢查檔案系統是否有一致性錯誤。
Linux:
fsck
Windows:
chkdsk
sfc /scannow
chkdsk 命令會檢查磁碟區的檔案系統與檔案系統中繼資料是否有邏輯及實體錯誤。sfc /scannow 命令會檢查檔案系統是否損毀。如需更多資訊,請參閱 Microsoft 網站上的 chkdsk 與使用系統檔案檢查程式。
疑難排解執行個體狀態檢查失敗問題
執行個體狀態檢查可識別作業系統、網路組態及資源使用量的問題。若要疑難排解執行個體狀態檢查失敗問題,請根據執行個體的作業系統使用以下資源:
疑難排解附加的 EBS 狀態檢查失敗問題
如果執行個體的附加 EBS 狀態檢查失敗,請檢查受影響磁碟區的 VolumeStalledIOCheck 這項Amazon CloudWatch 指標。如果值為 1,則磁碟區發生問題。Amazon EBS 通常會在幾分鐘內自動診斷並復原磁碟區。如需更多資訊,請參閱 Amazon EBS I/O 特性與監控。
若要驗證磁碟區是否已復原,請檢查 VolumeStalledIOCheck 的值是否變更為 0。
如果問題仍然存在,請停止再啟動執行個體,以將執行個體遷移至新主機。如果重新啟動後特定磁碟區仍然發生問題,您必須替換該磁碟區。建立磁碟區的快照,然後使用該快照建立新磁碟區。使用新磁碟區替換現有磁碟區。
相關資訊
疑難排解無法連線的 Amazon EC2 執行個體