API-Nutzung überwachen
Mit Sammlungen den Überblick behalten
Sie können Inhalte basierend auf Ihren Einstellungen speichern und kategorisieren.
Auf dieser Seite wird beschrieben, wie Sie mit API-Messwerten Ihre Nutzung von Google APIs und Google Cloud APIs verfolgen und verstehen.
Google APIs bietet detaillierte Nutzungsmesswerte, die Ihnen helfen können:
Verfolgen und verstehen Sie Ihre Nutzung von Google APIs.
Überwachen Sie die Leistung Ihrer Anwendungen und Google APIs.
Probleme zwischen Ihren Anwendungen und Google APIs ermitteln.
Sie kann erheblich schneller helfen, wenn Sie Probleme beheben oder technischen Support von Google benötigen.
Die von Google APIs erzeugten Messwerte sind die Standardsignale, anhand derer Site Reliability Engineers den Zustand eines Dienstes bewerten.
Diese Messwerte umfassen Anfrageanzahl, Fehlerraten, Gesamtlatenzen, Backend-Latenzen, Anfragegrößen und Antwortgrößen. Informationen zu API-Messwerten finden Sie in der Cloud Monitoring-Dokumentation.
Sie können sich API-Messwerte an zwei Orten ansehen: im API-Dashboard und in Cloud Monitoring. Die angezeigten Messwerte beziehen sich auf Ihr Projekt und geben nicht den Gesamtstatus des Dienstes wieder.
API-Dashboard verwenden
Die API-Messwerte lassen sich am einfachsten über das API-Dashboard der Google Cloud Console aufrufen. Hier erhalten Sie eine Übersicht über sämtliche Messwerte zu Ihrer API-Nutzung oder können sich die Nutzung einer bestimmten API im Detail ansehen.
So erhalten Sie eine Übersicht über Ihre API-Nutzung:
Rufen Sie in der Cloud Console den Abschnitt APIs und Dienste auf.
Das Haupt-API-Dashboard wird standardmäßig angezeigt. Hier sehen Sie alle APIs, die momentan für Ihr Projekt aktiviert sind, sowie Übersichtsdiagramme für die folgenden Messwerte:
Traffic: die Anzahl der Anfragen pro Sekunde, die von oder zu Ihrem Projekt an aktivierten APIs gesendet wurden
Fehler: der Prozentsatz der Anfragen zu aktivierten APIs, die zu Fehlern geführt haben
Medianlatenz: Die Medianlatenz für Anfragen zu aktivierten APIs, sofern verfügbar.
So können Sie Details zur Nutzung für eine bestimmte API anzeigen lassen:
Wählen Sie in der Liste auf der Hauptseite des API-Dashboards die gewünschte API aus. Die Übersichtsseite der API zeigt ein detailliertes Traffic-Diagramm mit einer Aufschlüsselung nach Antwortcode an.
Wenn Sie noch mehr Details zu den Nutzungsinformationen sehen möchten, wählen Sie Messwerte aufrufen aus.
Standardmäßig werden die folgenden vorgefertigten Diagramme angezeigt. Es stehen jedoch noch mehr zur Verfügung:
Traffic nach Antwortcode
Fehler nach API-Methode
Gesamtlatenz für das 50., 95. und 99. Perzentil
Latenz nach API-Methode (Medianwert)
Wenn Sie weitere Diagramme hinzufügen möchten, können Sie über das Drop-down-Menü Grafiken auswählen weitere vorgefertigte Diagramme auswählen.
Cloud Monitoring verwenden
Wenn Sie Cloud Monitoring verwenden, erhalten Sie mithilfe des Metrics Explorers einen Überblick über die verfügbaren Messwertdaten, um einen besseren Einblick in Ihre API-Nutzung zu erhalten.
Cloud Monitoring unterstützt eine Vielfalt an Messwerten, die Sie mit Filtern und Aggregationen kombinieren können. Auf diese Weise erhalten Sie neue und aufschlussreiche Einblicke in Ihre Kontingentnutzung. So haben Sie z. B. die Möglichkeit, einen Messwert zur Anzahl der Anfragen mit einem Filter für die Klasse des HTTP-Antwortcodes zu kombinieren, um dann in einem erstellten Dashboard Fehlerraten im Zeitverlauf anzeigen zu lassen. Sie können sich aber auch für das 95. Perzentil die Latenz von Anfragen an die Cloud Pub/Sub API ansehen.
Verfügbare Messwerte
In der folgenden Tabelle sind die verfügbaren serviceruntime-Messwerte aufgeführt.
Die Messwerte zur API-Nutzung sind diejenigen, die consumed_api als überwachte Ressource enthalten.
Den Strings vom Typ "metric type" in dieser Tabelle muss serviceruntime.googleapis.com/ vorangestellt werden. Dieses Präfix wurde in den Einträgen der Tabelle weggelassen.
Verwenden Sie beim Abfragen eines Labels das Präfix metric.labels.. Beispiel: metric.labels.LABEL="VALUE".
Messwerttyp Startphase(Ebenen der Ressourcenhierarchie) Anzeigename
Die Anzahl der abgeschlossenen Anfragen. Alle 60 Sekunden wird eine Stichprobe erstellt. Nach der Stichprobe werden bis zu 1.800 Sekunden lang keine Daten angezeigt. protocol:
Das Protokoll der Anfrage, z.B. „http“ oder „grpc“.
response_code:
Der HTTP-Antwortcode für HTTP-Anfragen oder der HTTP-äquivalente Code für gRPC-Anfragen. Die Codezuordnung finden Sie unter https://github.com/googleapis/googleapis/blob/master/google/rpc/code.proto.
response_code_class:
Die Antwortcodeklasse für HTTP-Anfragen oder die HTTP-äquivalente Klasse für gRPC-Anfragen, z.B. „2xx“, „4xx“.
grpc_status_code:
Der numerische gRPC-Antwortcode für gRPC-Anfragen oder der gRPC-äquivalente Code für HTTP-Anfragen. Die Codezuordnung finden Sie unter https://github.com/googleapis/googleapis/blob/master/google/rpc/code.proto.
Verteilung der Latenzen in Sekunden für Nicht-Streaming-Anfragen. Alle 60 Sekunden wird eine Stichprobe erstellt. Nach der Stichprobe werden bis zu 1.800 Sekunden lang keine Daten angezeigt.
api/request_latencies_backendGA(Projekt) Backend-Latenzen für Anfragen
Verteilung der Backend-Latenzen in Sekunden für Nicht-Streaming-Anfragen. Alle 60 Sekunden wird eine Stichprobe erstellt. Nach der Stichprobe werden bis zu 1.800 Sekunden lang keine Daten angezeigt.
api/request_latencies_overheadGA(Projekt) Latenzen für Anfrage-Overhead
Verteilung der Anfragelatenzen in Sekunden für Nicht-Streaming-Anfragen ohne das Backend. Alle 60 Sekunden wird eine Stichprobe erstellt. Nach der Stichprobe werden bis zu 1.800 Sekunden lang keine Daten angezeigt.
Verteilung der Anfragengrößen in Byte, die beim Abschluss der Anfrage erfasst wurden. Alle 60 Sekunden wird eine Stichprobe erstellt. Nach der Stichprobe werden bis zu 1.800 Sekunden lang keine Daten angezeigt.
Verteilung der Antwortgrößen in Byte, die bei Abschluss der Anfrage aufgezeichnet wurden. Alle 60 Sekunden wird eine Stichprobe erstellt. Nach der Stichprobe werden bis zu 1.800 Sekunden lang keine Daten angezeigt.
mcp/request_countBETA(Projekt) Anzahl der MCP-Anfragen
Anzahl der MCP-Anfragen response_code:
Der HTTP-Antwortcode für HTTP-Anfragen oder der HTTP-Äquivalentcode für MCP-Anfragen.
response_code_class:
Die Antwortcodeklasse für HTTP-Anfragen oder die HTTP-äquivalente Klasse für gRPC-Anfragen, z.B. „2xx“, „4xx“.
mcp/request_durationsBETA(Projekt) Dauer von MCP-Anfragen
Das insgesamt verbrauchte Zuweisungskontingent. Werte, die mehr als einmal pro Minute gemeldet werden, werden verworfen. Wenn sich die Kontingentnutzung nicht ändert, wird der letzte Wert mindestens alle 24 Stunden wiederholt. Alle 60 Sekunden wird eine Stichprobe erstellt. quota_metric:
Der Name des Kontingentmesswerts oder der Kontingentgruppe.