Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Verwenden Sie CloudWatch Metriken, um die Ressourcen von Amazon Managed Service for Prometheus zu überwachen
Amazon Managed Service for Prometheus verkauft Nutzungsmetriken an. CloudWatch Diese Metriken geben Aufschluss über Ihre Workspace-Nutzung. Die verkauften Metriken finden Sie in den Namespaces und in. AWS/Usage AWS/Prometheus CloudWatch Diese Metriken sind kostenlos erhältlich. CloudWatch Weitere Informationen zu Nutzungsmetriken finden Sie unter CloudWatch -Nutzungsmetriken.
| CloudWatch Name der Metrik | Ressourcenname | CloudWatch Namespace | Description |
|---|---|---|---|
|
ResourceCount* |
CreateAlertManagerAlertsTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
DeleteAlertManagerSilencesTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
GetAlertManagerSilenceTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
GetAlertManagerStatusTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
GetLabelsTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
GetMetricMetadataTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
GetSeriesTPS |
|
Die maximale Anzahl von |
|
ResourceCount |
InhibitionRulesInAlertManagerDefinition |
|
Die maximale Anzahl von Unterdrückungsregeln in der Alert-Manager-Definitionsdatei. |
|
ResourceCount* |
ListAlertManagerAlertGroupInfosTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
ListAlertManagerAlertGroupsTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
ListAlertManagerAlertsTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
ListAlertManagerReceiversTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
ListAlertManagerSilencesTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
ListAlertsTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
ListRulesTPS |
|
Die maximale Anzahl von |
|
ResourceCount* |
PutAlertManagerSilencesTPS |
|
Die maximale Anzahl von |
|
ResourceCount |
HAReplicaGroupCount |
|
Anzahl der Replikatgruppen mit hoher Verfügbarkeit |
|
ResourceCount* |
QueryMetricsTPS |
|
Abfragevorgänge pro Sekunde |
|
ResourceCount* |
RemoteWriteTPS |
|
Fernschreibvorgänge pro Sekunde |
|
ResourceCount |
ActiveAlerts |
|
Anzahl der aktiven Alarme pro Workspace Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
ActiveSeries |
|
Anzahl der aktiven Serien pro Workspace Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
AlertAggregationGroupSize |
|
Die maximale Größe einer Alarmaggregationsgruppe in der Alert-Manager-Definitionsdatei. Jede Kombination von Labelwerten |
|
ResourceCount |
AlertManagerDefinitionSizeBytes |
|
Die maximale Größe einer Warnungs-Manager-Definitionsdatei in Byte. |
|
ResourceCount |
AllSilences |
|
Maximale Anzahl von Stillständen, einschließlich abgelaufener, aktiver und ausstehender Stille, pro Arbeitsbereich. |
|
ResourceCount |
IngestionRate |
|
Beispielerfassungsrate Einheiten: Anzahl pro Sekunde Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
RuleEvaluationInterval |
|
Das Mindestintervall für die Regelauswertung |
|
ResourceCount |
RuleGroupNamespaceDefinitionSizeBytes |
|
Die maximale Größe einer Regelgruppen-Namespace-Definitionsdatei in Byte. |
|
ResourceCount |
TemplatesInAlertManagerDefinition |
|
Die maximale Anzahl der Vorlagen in der Alert-Manager-Definitionsdatei. |
|
ResourceCount |
WorkspaceCount |
|
Die maximale Anzahl von Workspaces pro Region, pro Konto. |
|
ResourceCount |
SizeOfAlerts |
|
Gesamtgröße aller Benachrichtigungen im Workspace, in Byte Einheiten: Byte Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
SuppressedAlerts |
|
Anzahl der Alarme im unterdrückten Status pro Workspace. Ein Alarm kann durch Stummschalten oder Unterdrückung unterbunden werden. Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
UnprocessedAlerts |
|
Anzahl der Alarme im unbearbeiteten Zustand pro Workspace. Eine Warnung befindet sich im Status „Unverarbeitet“, sobald sie von empfangen wurde AlertManager, wartet aber auf die nächste Auswertung der Aggregationsgruppe. Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
AllAlerts |
|
Anzahl der Benachrichtigungen in einem beliebigen Status pro Workspace Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
AllRules |
|
Anzahl der Regeln in einem beliebigen Bundesstaat pro Workspace Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
NativeHistogramActiveSeries |
|
Die Anzahl der einzelnen aktiven nativen Histogrammserien pro Workspace Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
ResourceCount |
NativeHistogramIngestionRate |
|
Aufnahmerate für native Histogrammproben pro Workspace pro Sekunde Einheiten: Anzahl pro Sekunde Gültige Statistiken: Durchschnitt, Minimum, Maximum |
ActiveSeriesPerLabelSet |
- |
|
Die aktuelle Nutzung der aktiven Serie für jeden benutzerdefinierten Labelsatz Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
ActiveSeriesLimitPerLabelSet |
- |
|
Der aktuelle aktive Seriengrenzwert für jeden benutzerdefinierten Labelsatz Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
AlertManagerAlertsReceived |
- |
|
Gesamtzahl der erfolgreichen Alerts, die vom Alert Manager empfangen wurden Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
AlertManagerNotificationsFailed |
- |
|
Anzahl der fehlgeschlagenen Alarme Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
AlertManagerNotificationsThrottled |
- |
|
Anzahl der gedrosselten Alarme Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
AnomalyDetectors |
WorkspaceId |
|
Gesamtzahl der Anomaliedetektoren für einen bestimmten Arbeitsbereich Einheiten: Anzahl Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
AnomalyDetectorEvaluations |
WorkspaceId, AnomalyDetectorId |
|
Gesamtzahl der Bewertungen durch Anomaliedetektoren Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
AnomalyDetectorEvaluationFailures |
WorkspaceId, AnomalyDetectorId |
|
Anzahl der Ausfälle des Anomaliedetektors im Intervall Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
AnomalyDetectorLastEvaluationDuration |
WorkspaceId, AnomalyDetectorId |
|
Dauer der letzten Bewertung eines Anomaliedetektors Einheiten: Sekunden Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
AnomalyDetectorMissedEvaluations |
WorkspaceId, AnomalyDetectorId |
|
Anzahl der verpassten Bewertungen durch einen Anomaliedetektor innerhalb des Intervalls Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
DiscardedSamples** |
- |
|
Anzahl der verworfenen Beispiele nach Grund Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
DiscardedSeries** |
- |
|
Anzahl der Serien, die eine verworfene Probe enthalten, aufgeschlüsselt nach dem Grund Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
DiscardedSamplesPerLabelSet |
- |
|
Die Anzahl der verworfenen Proben für jeden benutzerdefinierten Labelsatz Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
DiscardedSeriesPerLabelSet |
- |
|
Die Anzahl der Serien, die eine verworfene Probe für jeden benutzerdefinierten Labelsatz enthalten Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
IngestionRatePerLabelSet |
- |
|
Die Aufnahmerate für jeden benutzerdefinierten Etikettensatz Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
NativeHistogramIngestedBucketsRate |
- |
|
Rate der pro Sekunde empfangenen befüllten Buckets in allen nativen Histogrammproben. Schließt abgelehnte Buckets aus. Einheiten: Anzahl pro Sekunde Gültige Statistiken: Durchschnitt, Minimum, Maximum |
|
NativeHistogramReducedResolutionCount |
- |
|
Anzahl der nativen Histogrammproben mit automatisch reduzierter Bucket-Auflösung. Die Auflösung wird reduziert, wenn eine Probe den Grenzwert für die maximale Anzahl an Buckets überschreitet. Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
OutOfOrderIngestionRate |
- |
|
Out-of-order Aufnahmerate der Probe Einheiten: Anzahl pro Sekunde Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
OutOfOrderSampleAge*** |
- |
|
Die Differenz zwischen dem Zeitstempel einer Probe, die nicht in der richtigen Reihenfolge ist, und der Aufnahmezeit, die angibt, wie alt die Probe bei der Einnahme ist. Einheiten: Sekunden Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
QuerySamplesProcessed |
- |
|
Anzahl der verarbeiteten Abfrageproben Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
RuleEvaluations |
- |
|
Gesamtzahl der Regelauswertungen Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
RuleEvaluationFailures |
- |
|
Anzahl der Fehler bei der Regelauswertung im Intervall Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
RuleGroupIterationsMissed |
- |
|
Anzahl der Regelgruppen-Iterationen, die im Intervall verpasst wurden. Einheiten: Anzahl Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
|
RuleGroupLastEvaluationDuration |
- |
|
Dauer der letzten Auswertung einer Regelgruppe. Einheiten: Sekunden Gültige Statistiken: Minimum, Maximum, Summe, Durchschnitt |
* TPS-Metriken werden jede Minute generiert und sind ein Durchschnittswert pro Sekunde für diese Minute. Kurze Burst-Perioden werden in den TPS-Metriken nicht erfasst.
** Einige der Gründe, die dazu führen, dass Proben verworfen werden, sind folgende. Nicht alle unten aufgeführten Gründe sind in der DiscardedSeries Metrik enthalten.
|
Grund |
Bedeutung |
|---|---|
|
greater_than_max_sample_age |
Proben, die älter als eine Stunde sind, werden verworfen. |
|
new-value-for-timestamp |
Doppelte Proben werden mit demselben Zeitstempel wie die vorherige Probe, aber mit unterschiedlichen Werten gesendet. |
|
per_labelset_series_limit |
Der Benutzer hat das Limit für die Gesamtzahl der aktiven Serien pro Labelsatz erreicht. |
|
per_metric_series_limit |
Der Benutzer hat das Limit für aktive Serien pro Metrik erreicht. |
|
per_user_series_limit |
Der Benutzer hat das Limit für die Gesamtzahl der aktiven Serien erreicht. |
|
rate_limited |
Die Aufnahmerate ist begrenzt. |
|
sample-out-of-order |
Die Proben werden nicht in der richtigen Reihenfolge versandt und können nicht bearbeitet werden. |
|
Die Probe ist zu alt |
Die Probe ist älter als das konfigurierte Zeitfenster, in dem die Reihenfolge abgelaufen ist, und kann nicht verarbeitet werden. |
|
Ratenlimit bei Nichtbestellung |
Out-of-order Die maximale Aufnahmerate wurde erreicht und die Probe kann nicht verarbeitet werden. Weitere Informationen finden Sie unter Servicekontingente von Amazon Managed Service für Prometheus. |
|
label_value_too_long |
Der Labelwert ist länger als die zulässige Zeichenbeschränkung. |
|
max_label_names_per_series |
Der Benutzer hat die Labelnamen pro Metrik eingegeben. |
|
missing_metric_name |
Der Metrikname wurde nicht angegeben. |
|
metric_name_invalid |
Ungültiger Metrikname angegeben. |
|
label_invalid |
Ungültiges Etikett angegeben. |
|
duplicate_label_names |
Doppelte Labelnamen wurden angegeben. |
|
native_histogram_sample_size_bytes_exceeded |
Die native Histogrammprobe überschreitet die maximal zulässige Stichprobengröße in Byte. |
|
native_histogram_invalid_schema |
Das native Histogramm hat einen ungültigen Schemawert. Gültige Schemas liegen im Bereich von -4 bis 8. |
|
native_histogram_invalid |
Das native Histogramm schlägt bei der Überprüfung fehl (z. B. negative Bucket-Anzahl, nicht übereinstimmende Bucket-Anzahl oder falsch formatierte Bucket-Spans). |
|
native_histogram_buckets_exceeded |
Das native Histogramm überschreitet die maximale Anzahl an Buckets und die Auflösung kann nicht automatisch reduziert werden. |
|
native_histogram_rate_limited |
Eine native Histogrammprobe wurde zurückgewiesen, da die maximale Aufnahmerate für native Histogramme erreicht wurde. |
|
per_user_native_histogram_series_limit |
Der Benutzer hat das Limit für aktive Serien für native Histogramme pro Workspace erreicht. |
*** Die OutOfOrderSampleAge Metrik beinhaltet eine Percentile Dimension. Anhand dieser Kennzahl können Sie das für Ihren Workspace passende Zeitfenster für Außerbetriebnahme ermitteln. Die gültigen Werte für die Percentile Dimension lauten wie folgt.
|
Perzentil |
Description |
|---|---|
|
p50 |
Das 50. Perzentilalter von Proben, die nicht in Ordnung sind. |
|
p99 |
Das 99. Perzentil-Alter von Proben, die nicht in Ordnung sind. |
|
max |
Das maximale Alter von Proben, die nicht in der richtigen Reihenfolge sind. |
Anmerkung
Eine Metrik, die nicht existiert oder fehlt, entspricht dem Wert dieser Metrik, der 0 ist.
Anmerkung
RuleGroupIterationsMissed, RuleEvaluationsRuleEvaluationFailures, und RuleGroupLastEvaluationDuration haben die RuleGroup Dimension der folgenden Struktur:
RuleGroupNamespace;RuleGroup
CloudWatch Alarm schlagen bei den von Prometheus verkauften Metriken
Sie können die Nutzung der Prometheus-Ressourcen mithilfe CloudWatch von Alarmen überwachen.
Um einen Alarm für die Anzahl von einzustellen ActiveSeries in Prometheus
-
Wählen Sie den Tab Graphed Metrics und scrollen Sie nach unten zum Label. ActiveSeries
In der Ansicht Graphische Metriken werden nur die Metriken angezeigt, die gerade erfasst werden.
-
Wählen Sie das Benachrichtigungssymbol in der Spalte Aktionen aus.
-
Geben Sie unter Metrik und Bedingungen angeben die Schwellenwertbedingung in das Feld Bedingungswert ein und klicken Sie auf Weiter.
-
Wählen Sie unter Aktionen konfigurieren ein vorhandenes SNS-Thema aus oder erstellen Sie ein neues SNS-Thema, an das die Benachrichtigung gesendet werden soll.
-
In Namen und Beschreibung hinzufügen den Namen des Alarms und eine optionale Beschreibung hinzufügen.
-
Wählen Sie Alarm erstellen aus.