Zum Hauptinhalt springen
Google Cloud Documentation
Technologiebereiche
  • KI und ML
  • Anwendungsentwicklung
  • Anwendungshosting
  • Compute
  • Datenanalyse und Pipelines
  • Datenbanken
  • Verteilt, Hybrid und Multi-Cloud
  • Branchenlösungen
  • Migration
  • Netzwerk
  • Beobachtbarkeit und Monitoring
  • Sicherheit
  • Storage
Produktübergreifende Tools
  • Zugriffs- und Ressourcenverwaltung
  • Kosten- und Nutzungsmanagement
  • Infrastruktur als Code
  • SDK, Sprachen, Frameworks und Tools
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Anmelden
  • AI Hypercomputer
Jetzt kostenlos testen
Übersicht Leitfäden Ressourcen
Google Cloud Documentation
  • Technologiebereiche
    • Mehr
    • Übersicht
    • Leitfäden
    • Ressourcen
  • Produktübergreifende Tools
    • Mehr
  • Console
  • Erste Schritte
  • Übersicht
  • Accelerator-Infrastruktur auswählen
  • Orchestrator und Bereitstellungsoption auswählen
  • Beschleuniger
    • GPU-Beschleuniger
    • Allgemeine GPUs
    • Clustered GPUs
  • Leistungsoptimierte Infrastruktur
    • GPU-Maschinen
    • Netzwerkdienste
      • GPU-Netzwerkübersicht
      • Netzwerkdienste für Bereitstellungen
      • Netzwerke/Best Practices
    • Speicherdienste
  • Offene Software
    • Betriebssystem- und Docker-Images
  • Eine Option für die Aufnahme auswählen
  • Clusterverwaltung
    • Übersicht über die Clusterverwaltung
    • Konfigurationen für die Clusterverwaltung
  • Terminologie
  • Los gehts
  • KI-Infrastruktur planen und erstellen
  • Zwischen allgemeinen und gruppierten GPUs auswählen
  • Kapazität und Kontingent abrufen
    • Übersicht
    • Kapazität reservieren
    • Reservierte Kapazität ansehen
  • Kurzanleitungen
    • Vollständig verwalteten Slurm-Cluster mit A4-VMs erstellen
    • Selbstverwalteten Slurm-Cluster mit A4-VMs erstellen
  • Infrastruktur bereitstellen
  • Übersicht über die Bereitstellungsoptionen
  • Richtlinie für kompakte Platzierung und Arbeitslastrichtlinie – Übersicht
  • KI-optimierte VMs und Cluster bereitstellen
    • GKE-Cluster erstellen
      • KI-optimierten GKE-Cluster mit Standardkonfiguration erstellen
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X Max verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4 oder A3 Ultra verwendet
      • GKE-Standardcluster erstellen, die A3 Mega oder A3 High verwenden
      • GKE Autopilot-Cluster erstellen, die A3 Mega oder A3 High verwenden
    • Slurm-Cluster erstellen
      • Vollständig verwalteten Cluster erstellen
      • Selbstverwalteten Cluster erstellen
    • Instanz erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
    • Instanzen im Bulk erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
    • Eine verwaltete Instanzgruppe (MIG) erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
  • Arbeitslasten ausführen
  • Arbeitslasten mit Pathways on Cloud ausführen
    • Einführung in Pathways in der Cloud
    • GKE-Cluster mit Pathways erstellen
    • Batcharbeitslast mit Pathways ausführen
    • Interaktive Arbeitslast mit Pathways ausführen
    • Inferenz auf mehreren Hosts mit Pathways durchführen
    • Resilienztraining mit Pathways
    • JAX-Arbeitslasten zu Pathways portieren
    • Fehlerbehebung bei Pathways on Cloud
  • GKE-Arbeitslasten planen
    • Arbeitslasten mit Topology Aware Scheduling (TAS) planen
    • Knotenstatusvorhersage aktivieren
  • Arbeitslasten mit Kueue orchestrieren
  • Tutorials zu KI-Arbeitslasten
    • Übersicht
    • GPU
      • Inferenz mit vLLM in GKE ausführen
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4
        • Qwen3
      • Feinabstimmung ausführen
        • Gemma 3 in einem GKE-Cluster
        • Gemma 3 in einem GKE-Cluster mit mehreren Hosts
        • Gemma 3 in einem Slurm-Cluster
        • Gemma 3 für Vision-Aufgaben in GKE
        • Llama 4 in einem Slurm-Cluster
        • Mixtral-8x7b in einem Slurm-Cluster
      • Training ausführen
        • Qwen2 in einem Slurm-Cluster
    • TPU
      • Arbeitslasten bereitstellen
        • Qwen2-7B mit vLLM auf TPUs bereitstellen
        • Qwen2-7B-Instruct mit vLLM auf TPUs bereitstellen
        • Qwen3-8B-Base mit vLLM auf TPUs bereitstellen
        • Llama-3.1-8B mit vLLM auf TPUs bereitstellen
      • Feinabstimmung ausführen
        • Überwachte Feinabstimmung auf einer TPU-VM mit MaxText ausführen
        • Überwachte Feinabstimmung auf mehreren Hosts für Qwen3-14b mit MaxText ausführen
        • RL-Training auf einer TPU v6e-8-VM ausführen
        • RL-Training mit mehreren Hosts für Qwen3-30b-a3b mit MaxText ausführen
  • Infrastruktur verwalten
  • GKE-Cluster verwalten
  • Instanzen und Slurm-Cluster verwalten
    • Topologie einer Instanz ansehen
    • Host-Events verwalten
      • Events in Instanzen hosten
      • Hostereignisse in Reservierungen
    • Fehlerhaften Host melden
  • Testen und optimieren
  • Cluster-Netzwerke mithilfe von NCCL/gIB optimieren
  • NCCL-Tests ausführen
    • NCCL auf Compute Engine-Instanzen ausführen
    • NCCL in GKE-Clustern mit Standardkonfiguration ausführen
    • NCCL auf benutzerdefinierten GKE-Clustern mit A4X Max ausführen
    • NCCL in benutzerdefinierten GKE-Clustern mit A4X ausführen
    • NCCL auf benutzerdefinierten GKE-Clustern ausführen, die A4 oder A3 Ultra verwenden
    • NCCL auf benutzerdefinierten GKE-Clustern mit A3 Mega oder A3 High ausführen
    • NCCL in Slurm-Clustern ausführen
  • NCCL-Logs zur Fehlerbehebung erfassen und verstehen
  • Arbeitslasten mit Rezepten testen
    • Benchmarking-Rezepte
    • Goodput-Optimierungsschemas
  • Versionshinweise zu NCCL/gIB
    • Versionshinweise zu NCCL/gIB (x86 64-Bit)
    • Versionshinweise zu NCCL/gIB (ARM 64-Bit)
  • Überwachen
  • VMs und Slurm-Cluster überwachen
  • Verwalten, wie CoMMA NCCL-Telemetriedaten erfasst
    • Collective Communication Analyzer (CoMMA)
    • CoMMA aktivieren, deaktivieren und konfigurieren
  • Fehler beheben
  • Bekannte Probleme
  • Fehlerbehebung bei unzureichender Leistung
  • Fehlerbehebung beim Melden eines fehlerhaften Hosts
  • Fehlerbehebung bei CoMMA
  • KI und ML
  • Anwendungsentwicklung
  • Anwendungshosting
  • Compute
  • Datenanalyse und Pipelines
  • Datenbanken
  • Verteilt, Hybrid und Multi-Cloud
  • Branchenlösungen
  • Migration
  • Netzwerk
  • Beobachtbarkeit und Monitoring
  • Sicherheit