AWS Builder Center: Learn, Build and Connect with builders in the AWS community
AWS Builder Center is the official home for builders on AWS. Share and read what others are working on, follow people who inspire you, explore training and workshops, and find tools to support what you're building.
Perché il mio allarme di CloudWatch si è attivato se la metrica monitorata non contiene datapoint violati?
Un allarme di Amazon CloudWatch è passato allo stato ALARM. Quando controllo la metrica monitorata, non vedo una violazione dei datapoint nel grafico di CloudWatch. Tuttavia, la cronologia degli allarmi contiene una voce con un datapoint violato. Desidero sapere cosa ha causato l’attivazione dell’allarme in CloudWatch.
Breve descrizione
Se l'applicazione pubblica datapoint aggiuntivi per lo stesso periodo di tempo dopo la valutazione dell'allarme, il grafico di CloudWatch mostra un valore aggregato aggiornato. Il valore aggregato aggiornato include i datapoint in ritardo. Il grafico potrebbe non mostrare una violazione anche se la cronologia degli allarmi ne ha registrata una a seconda dei datapoint disponibili durante la valutazione.
Risoluzione
Individua i datapoint violati
L'esempio seguente mostra come i datapoint in ritardo facciano sì che il grafico di CloudWatch sia diverso dalla cronologia degli allarmi.
Nel seguente esempio, un allarme è configurato con i seguenti parametri:
- Namespace: Web_App
- Metrica: ResponseTime
- Dimensione: host,h_04254448d4e964956
- Statistica: media
- Soglia: 0,005
- ComparisonOperator: GreaterThanThreshold
- Periodo: 60 secondi (1 minuto)
- Periodo di valutazione: 1
Quando l'allarme valuta il periodo compreso tra le 12:00:00 e le 12:01:00 UTC, la metrica recupera i seguenti valori:
Sample-1: 12:00:00 UTC, numeric value: 0.00675 Sample-2: 12:00:00 UTC, numeric value: 0.00789 Sample-3: 12:00:00 UTC, numeric value: 0.00421
Poiché la media di questi valori è 0,006283333, la media supera la soglia di 0,005 secondi e l'allarme passa allo stato ALARM. La cronologia degli allarmi registra i valori aggregati che superano la soglia.
Un host che presenta temporaneamente un problema di prestazioni influisce sull'applicazione client responsabile della pubblicazione delle metriche. Di conseguenza, l'host potrebbe non pubblicare datapoint a intervalli equidistanti. In questo caso, l'applicazione pubblica i campioni per le 12:00 dopo la valutazione dell'allarme.
L'esempio seguente rappresenta tutti i campioni per il timestamp delle 12:00:
Sample-1: 12:00:00 UTC, numeric value: 0.00675 Sample-2: 12:00:00 UTC, numeric value: 0.00789 Sample-3: 12:00:00 UTC, numeric value: 0.00421 Sample-4: 12:00:00 UTC, numeric value: 0.00002 Sample-5: 12:00:00 UTC, numeric value: 0.00007
Quando ricevi un avviso dall'allarme, genera un grafico di CloudWatch per esaminare il comportamento delle metriche. CloudWatch recupera i cinque campioni dalle 12:00:00 alle 12:01:00 UTC e li aggrega con una media di 0,003788. Questo valore è diverso dal valore calcolato in precedenza ed è inferiore alla soglia. Se l'applicazione pubblica campioni aggiuntivi dopo la valutazione dell'allarme, i datapoint violati non sono visibili nell'intervallo temporale.
Aumenta l'intervallo di valutazione degli allarmi
Quando configuri Data point per allarme, potrebbe verificarsi un intervallo di valutazione più lungo. Quando un allarme genera falsi avvisi a causa di metriche in ritardo, l'intervallo di valutazione aumenta. L'intervallo di valutazione prolungato include i datapoint in ritardo nella valutazione degli allarmi. In questo modo si riduce il numero di falsi avvisi.
Per aumentare l'intervallo di valutazione, utilizza una delle seguenti opzioni.
Aumenta il periodo
Nell'esempio seguente, il periodo viene aumentato a 5 minuti:
Namespace: Web_App
Metrica: ResponseTime
Dimensione: host,h_04254448d4e964956
Statistica: media
Soglia: 0,005
ComparisonOperator: GreaterThanThreshold
Periodo: 300 secondi (5 minuti)
Periodo di valutazione: 1
Configura M su N datapoint per allarme
Configura l'allarme in modo che richieda più datapoint violati prima che l'allarme passi allo stato ALARM.
Nell'esempio seguente, M su N datapoint sono configurati come due su tre datapoint:
Namespace: Web_App
Metrica: ResponseTime
Dimensione: host,h_04254448d4e964956
Statistica: media
Soglia: 0,005
ComparisonOperator: GreaterThanThreshold
Periodo: 60 secondi (1 minuto)
Periodo di valutazione (N): 3
Datapoint per allarme (M): 2
Quando configuri Periodi di valutazione e Datapoint per allarme come valori diversi, crei un allarme M su N. Datapoint per allarme è impostato su M e Periodo di valutazione su N. Ad esempio, se configuri quattro datapoint su cinque con un periodo di 1 minuto, l'intervallo di valutazione è di 5 minuti. Se configuri tre datapoint su tre con un periodo di 10 minuti, l'intervallo di valutazione è di 30 minuti.
Se configuri Datapoint per allarme con valori diversi, gli allarmi di CloudWatch valutano più datapoint. Gli allarmi di CloudWatch modificano anche lo stato dell'allarme in caso di violazione di un numero minimo di datapoint all'interno di un set di datapoint. Il parametro ti permette di regolare l'allarme in modo che si attivi su un singolo datapoint o richiedere più datapoint per passare allo stato ALARM.
Per ulteriori informazioni, consulta Crea un allarme in CloudWatch basato su una soglia statica e Configurazione del modo in cui gli allarmi di CloudWatch trattano i dati mancanti.
Informazioni correlate
Perché non ho ricevuto una notifica da Amazon SNS per l'attivazione del mio allarme in CloudWatch?
Come posso risolvere i problemi del mio allarme in CloudWatch nello stato INSUFFICIENT_DATA?
Perché il mio allarme CloudWatch mi ha inviato una notifica dopo un solo datapoint violato?
- Argomenti
- Management & Governance
- Lingua
- Italiano

Contenuto pertinente
AWS UFFICIALEAggiornata un anno fa