

Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.

# Alarme und Protokolle zur Verfolgung von Metriken von Serverless-Endpunkten
<a name="serverless-endpoints-monitoring"></a>

Um Ihren serverlosen Endpunkt zu überwachen, können Sie CloudWatch Amazon-Alarme verwenden. CloudWatch ist ein Service, der in Echtzeit Metriken aus Ihren AWS Anwendungen und Ressourcen sammelt. Ein Alarm überwacht die erfassten Messwerte und gibt Ihnen die Möglichkeit, vorab einen Schwellenwert und die Maßnahmen festzulegen, die bei einer Überschreitung dieses Schwellenwerts zu ergreifen sind. Ihr CloudWatch Alarm kann Ihnen beispielsweise eine Benachrichtigung senden, wenn Ihr Endpunkt einen Fehlerschwellenwert überschreitet. Durch die Einrichtung von CloudWatch Alarmen erhalten Sie einen Überblick über die Leistung und Funktionalität Ihres Endgeräts. Weitere Informationen zu CloudWatch Alarmen finden Sie unter [Verwenden von CloudWatch Amazon-Alarmen](https://docs.aws.amazon.com/AmazonCloudWatch/latest/monitoring/AlarmThatSendsEmail.html) im * CloudWatch Amazon-Benutzerhandbuch*.

## Überwachung mit CloudWatch
<a name="serverless-endpoints-monitoring-metrics"></a>

Die folgenden Metriken sind eine vollständige Liste von Metriken für serverlose Endgeräte. Alle unten nicht aufgeführten Metriken werden nicht für serverlose Endgeräte veröffentlicht. Informationen zu den folgenden Metriken finden Sie unter [Überwachen von Amazon SageMaker AI mit Amazon CloudWatch](https://docs.aws.amazon.com/sagemaker/latest/dg/monitoring-cloudwatch.html).

### Allgemeine Endpunktmetriken
<a name="serverless-endpoints-monitoring-metrics-common"></a>

Diese CloudWatch Metriken entsprechen den für Echtzeit-Endpunkte veröffentlichten Metriken.

Die `OverheadLatency` Metrik erfasst alle zusätzlichen Latenzen, die SageMaker KI hinzugefügt hat, einschließlich der Kaltstartzeit für den Start neuer Rechenressourcen für Ihren serverlosen Endpunkt. Im Vergleich zu serverlosen On-Demand-Endpunkten ist die `OverheadLatency` bei serverlosen Endpunkten mit paralleler Bereitstellung im Allgemeinen deutlich geringer.

Serverlose Endgeräte können auch die `Invocations4XXErrors`, `Invocations5XXErrors`, `Invocations`, `ModelLatency`, `ModelSetupTime` und `MemoryUtilization` Metriken verwenden. Weitere Informationen zu diesen Metriken finden Sie unter [SageMaker Metriken zum Aufrufen von KI-Endpunkten](monitoring-cloudwatch.md#cloudwatch-metrics-endpoint-invocation).

### Metriken für serverlose Endgeräte
<a name="serverless-endpoints-monitoring-metrics-serverless"></a>

Diese CloudWatch Metriken werden sowohl für serverlose On-Demand-Endpoints als auch für serverlose Endpoints mit Provisioned Concurrency veröffentlicht.


| Metrikname | Description | Unit/Stats | 
| --- | --- | --- | 
| ServerlessConcurrentExecutionsUtilization | Die Anzahl der gleichzeitigen Ausführungen geteilt durch die maximale Gleichzeitigkeit. | Einheiten: keine<br />Gültige Statistiken: Durchschnitt, Maximum und Minimum | 

### Serverloser Endpunkt mit Metriken für Provisioned Concurrency
<a name="serverless-endpoints-monitoring-metrics-serverless-pc"></a>

Diese CloudWatch Metriken werden für serverlose Endpunkte mit Provisioned Concurrency veröffentlicht.


| Metrikname | Description | Unit/Stats | 
| --- | --- | --- | 
| ServerlessProvisionedConcurrencyExecutions | Die Anzahl der gleichzeitigen Ausführungen, die vom Endpunkt verarbeitet werden. | Einheiten: Anzahl<br />Gültige Statistiken: Durchschnitt, Maximum und Minimum | 
| ServerlessProvisionedConcurrencyUtilization | Die Anzahl der gleichzeitigen Ausführungen geteilt durch die zugewiesene Provisioned Concurrency. | Einheiten: keine<br />Gültige Statistiken: Durchschnitt, Maximum und Minimum | 
| ServerlessProvisionedConcurrencyInvocations | Die Anzahl der InvokeEndpoint Anfragen, die von Provisioned Concurrency bearbeitet wurden. | Einheiten: Anzahl<br />Gültige Statistiken: Durchschnitt, Maximum und Minimum | 
| ServerlessProvisionedConcurrencySpilloverInvocations | Die Anzahl der InvokeEndpoint Anfragen, die nicht von Provisioned Concurrency, sondern von On-Demand-serverlose Inferenz bearbeitet werden. | Einheiten: Anzahl<br />Gültige Statistiken: Durchschnitt, Maximum und Minimum | 

## Protokolle
<a name="serverless-endpoints-monitoring-logs"></a>

Wenn Sie die Protokolle von Ihrem Endpunkt aus zum Debuggen oder zur Fortschrittsanalyse überwachen möchten, können Sie Amazon CloudWatch Logs verwenden. Die SageMaker AI-provided Protokollgruppe, die Sie für serverlose Endpunkte verwenden können, ist. `/aws/sagemaker/Endpoints/[EndpointName]` Weitere Informationen zur Verwendung von CloudWatch Logs in SageMaker AI finden Sie unter. [CloudWatch Protokolle für Amazon SageMaker AI](logging-cloudwatch.md) Weitere Informationen zu CloudWatch Logs finden Sie unter [Was ist Amazon CloudWatch Logs?](https://docs.aws.amazon.com/AmazonCloudWatch/latest/logs/WhatIsCloudWatchLogs.html) im *Amazon CloudWatch Logs-Benutzerhandbuch*.