跳至内容

如何设置 CloudWatch 警报以自动恢复我的 EC2 实例?

1 分钟阅读
0

我想使用 Amazon CloudWatch 设置 Amazon Elastic Compute Cloud (Amazon EC2) 实例的自动恢复。

简短描述

如果您的实例未通过系统状态检查,则可以使用 CloudWatch 警报操作自动恢复您的实例。恢复选项适用于 90% 以上的已部署 Amazon EC2 实例。但是,恢复选项仅适用于系统检查失败,不适用于实例状态检查失败。此外,如果您终止实例,则无法将其恢复。

如果您的实例未通过状态检查,则可能需要重启实例或更改配置。有关详细信息,请参阅状态检查的类型

解决方法

创建警报

1.    打开 Amazon EC2 控制台

2.    在导航窗格中,选择 Instances(实例)。

3.    选择要配置的实例。

4.    选择 Actions(操作),然后选择 Monitor and troubleshoot(监控和故障排除)。然后,选择 Manage CloudWatch alarms(管理 CloudWatch 警报)。

5.    选择 Create an alarm(创建警报)。
**注意:**要创建警报,您必须拥有 AWS Identity and Access Management (IAM) 权限才能停止和启动关联实例。有关详细信息,请参阅创建 IAM 角色

6.    对于 Alarm notification(警报通知),请选择现有的 Amazon Simple Notification Service (Amazon SNS) 主题。要创建新主题,请参阅创建 Amazon SNS 主题。**
注意:**要在触发警报时接收通知,您必须订阅 SNS 主题

7.    打开 Alarm action(警报操作),然后选择 Recover(恢复)。

8.    对于 Group samples by(样本分组依据)和 Type of data to sample(样本数据类型),请为您的使用案例选择适当的统计数据和指标。

9.    对于 Consecutive period(连续周期)和 Period(周期),指定警报的评估周期。

10.    (可选)修改自动创建的 Alarm name(警报名称)。

11.    选择 Create(创建)。

设置重启警报

1.    打开 CloudWatch 控制台

2.    在导航窗格中,选择 All Alarms(所有警报)。

3.    选择您创建的警报。选择 Action(操作),然后选择 Edit(编辑)。

4.    在 Additional Configuration(其他配置)部分中,选择 Treat missing data as bad (breaching threshold)(将缺失数据视为损坏(超出阈值))。

5.    选择 Save(保存)。


相关信息

创建停止、终止、重启或恢复实例的警报

AWS 官方已更新 3 年前