Zum Hauptinhalt springen
Technologiebereiche
close
KI und ML
Anwendungsentwicklung
Anwendungshosting
Compute
Datenanalyse und Pipelines
Datenbanken
Verteilt, Hybrid und Multi-Cloud
Branchenlösungen
Migration
Netzwerk
Beobachtbarkeit und Monitoring
Sicherheit
Storage
Produktübergreifende Tools
close
Zugriffs- und Ressourcenverwaltung
Kosten- und Nutzungsmanagement
Infrastruktur als Code
SDK, Sprachen, Frameworks und Tools
/
Console
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Anmelden
AI Hypercomputer
Jetzt kostenlos testen
Übersicht
Leitfäden
Ressourcen
Technologiebereiche
Mehr
Übersicht
Leitfäden
Ressourcen
Produktübergreifende Tools
Mehr
Console
Erste Schritte
Übersicht
Accelerator-Infrastruktur auswählen
Orchestrator und Bereitstellungsoption auswählen
Beschleuniger
GPU-Beschleuniger
Allgemeine GPUs
Clustered GPUs
Leistungsoptimierte Infrastruktur
GPU-Maschinen
Netzwerkdienste
GPU-Netzwerkübersicht
Netzwerkdienste für Bereitstellungen
Netzwerke/Best Practices
Speicherdienste
Offene Software
Betriebssystem- und Docker-Images
Eine Option für die Aufnahme auswählen
Clusterverwaltung
Übersicht über die Clusterverwaltung
Konfigurationen für die Clusterverwaltung
Terminologie
Los gehts
KI-Infrastruktur planen und erstellen
Zwischen allgemeinen und gruppierten GPUs auswählen
Kapazität und Kontingent abrufen
Übersicht
Kapazität reservieren
Reservierte Kapazität ansehen
Kurzanleitungen
Vollständig verwalteten Slurm-Cluster mit A4-VMs erstellen
Selbstverwalteten Slurm-Cluster mit A4-VMs erstellen
Infrastruktur bereitstellen
Übersicht über die Bereitstellungsoptionen
Richtlinie für kompakte Platzierung und Arbeitslastrichtlinie – Übersicht
KI-optimierte VMs und Cluster bereitstellen
GKE-Cluster erstellen
KI-optimierten GKE-Cluster mit Standardkonfiguration erstellen
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X Max verwendet
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X verwendet
Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4 oder A3 Ultra verwendet
GKE-Standardcluster erstellen, die A3 Mega oder A3 High verwenden
GKE Autopilot-Cluster erstellen, die A3 Mega oder A3 High verwenden
Slurm-Cluster erstellen
Vollständig verwalteten Cluster erstellen
Selbstverwalteten Cluster erstellen
Instanz erstellen
A4X Max erstellen
A4X erstellen
A4- oder A3-Ultra-Cluster erstellen
A3 High- oder A3 Mega-Cluster erstellen
A3 Edge erstellen
A2 erstellen
G4 erstellen
G2 erstellen
N1-VM mit GPUs erstellen
Instanzen im Bulk erstellen
A4X Max erstellen
A4X erstellen
A4- oder A3-Ultra-Cluster erstellen
A3 High- oder A3 Mega-Cluster erstellen
A3 Edge erstellen
A2 erstellen
G4 erstellen
G2 erstellen
N1-VM mit GPUs erstellen
Eine verwaltete Instanzgruppe (MIG) erstellen
A4X Max erstellen
A4X erstellen
A4- oder A3-Ultra-Cluster erstellen
A3 High- oder A3 Mega-Cluster erstellen
A3 Edge erstellen
A2 erstellen
G4 erstellen
G2 erstellen
N1-VM mit GPUs erstellen
Arbeitslasten ausführen
Arbeitslasten mit Pathways on Cloud ausführen
Einführung in Pathways in der Cloud
GKE-Cluster mit Pathways erstellen
Batcharbeitslast mit Pathways ausführen
Interaktive Arbeitslast mit Pathways ausführen
Inferenz auf mehreren Hosts mit Pathways durchführen
Resilienztraining mit Pathways
JAX-Arbeitslasten zu Pathways portieren
Fehlerbehebung bei Pathways on Cloud
GKE-Arbeitslasten planen
Arbeitslasten mit Topology Aware Scheduling (TAS) planen
Knotenstatusvorhersage aktivieren
Arbeitslasten mit Kueue orchestrieren
Tutorials zu KI-Arbeitslasten
Übersicht
GPU
Inferenz mit vLLM in GKE ausführen
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4
Qwen3
Feinabstimmung ausführen
Gemma 3 in einem GKE-Cluster
Gemma 3 in einem GKE-Cluster mit mehreren Hosts
Gemma 3 in einem Slurm-Cluster
Gemma 3 für Vision-Aufgaben in GKE
Llama 4 in einem Slurm-Cluster
Mixtral-8x7b in einem Slurm-Cluster
Training ausführen
Qwen2 in einem Slurm-Cluster
TPU
Arbeitslasten bereitstellen
Qwen2-7B mit vLLM auf TPUs bereitstellen
Qwen2-7B-Instruct mit vLLM auf TPUs bereitstellen
Qwen3-8B-Base mit vLLM auf TPUs bereitstellen
Llama-3.1-8B mit vLLM auf TPUs bereitstellen
Feinabstimmung ausführen
Überwachte Feinabstimmung auf einer TPU-VM mit MaxText ausführen
Überwachte Feinabstimmung auf mehreren Hosts für Qwen3-14b mit MaxText ausführen
RL-Training auf einer TPU v6e-8-VM ausführen
RL-Training mit mehreren Hosts für Qwen3-30b-a3b mit MaxText ausführen
Infrastruktur verwalten
GKE-Cluster verwalten
Instanzen und Slurm-Cluster verwalten
Topologie einer Instanz ansehen
Host-Events verwalten
Events in Instanzen hosten
Hostereignisse in Reservierungen
Fehlerhaften Host melden
Testen und optimieren
Cluster-Netzwerke mithilfe von NCCL/gIB optimieren
NCCL-Tests ausführen
NCCL auf Compute Engine-Instanzen ausführen
NCCL in GKE-Clustern mit Standardkonfiguration ausführen
NCCL auf benutzerdefinierten GKE-Clustern mit A4X Max ausführen
NCCL in benutzerdefinierten GKE-Clustern mit A4X ausführen
NCCL auf benutzerdefinierten GKE-Clustern ausführen, die A4 oder A3 Ultra verwenden
NCCL auf benutzerdefinierten GKE-Clustern mit A3 Mega oder A3 High ausführen
NCCL in Slurm-Clustern ausführen
NCCL-Logs zur Fehlerbehebung erfassen und verstehen
Arbeitslasten mit Rezepten testen
Benchmarking-Rezepte
Goodput-Optimierungsschemas
Versionshinweise zu NCCL/gIB
Versionshinweise zu NCCL/gIB (x86 64-Bit)
Versionshinweise zu NCCL/gIB (ARM 64-Bit)
Überwachen
VMs und Slurm-Cluster überwachen
Verwalten, wie CoMMA NCCL-Telemetriedaten erfasst
Collective Communication Analyzer (CoMMA)
CoMMA aktivieren, deaktivieren und konfigurieren
Fehler beheben
Bekannte Probleme
Fehlerbehebung bei unzureichender Leistung
Fehlerbehebung beim Melden eines fehlerhaften Hosts
Fehlerbehebung bei CoMMA