Zum Hauptinhalt springen
Google Cloud Documentation
Technologiebereiche
  • KI und ML
  • Anwendungsentwicklung
  • Anwendungshosting
  • Compute
  • Datenanalyse und Pipelines
  • Datenbanken
  • Verteilt, Hybrid und Multi-Cloud
  • Branchenlösungen
  • Migration
  • Netzwerk
  • Beobachtbarkeit und Monitoring
  • Sicherheit
  • Storage
Produktübergreifende Tools
  • Zugriffs- und Ressourcenverwaltung
  • Kosten- und Nutzungsmanagement
  • Infrastruktur als Code
  • SDK, Sprachen, Frameworks und Tools
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Anmelden
  • AI Hypercomputer
Jetzt kostenlos testen
Übersicht Leitfäden Ressourcen
Google Cloud Documentation
  • Technologiebereiche
    • Mehr
    • Übersicht
    • Leitfäden
    • Ressourcen
  • Produktübergreifende Tools
    • Mehr
  • Console
  • Erste Schritte
  • Übersicht
  • Accelerator-Infrastruktur auswählen
  • Orchestrator und Bereitstellungsoption auswählen
  • Beschleuniger
    • GPU-Beschleuniger
    • Allgemeine GPUs
    • Clustered GPUs
  • Leistungsoptimierte Infrastruktur
    • GPU-Maschinen
    • Netzwerkdienste
      • GPU-Netzwerkübersicht
      • Netzwerkdienste für Bereitstellungen
      • Netzwerke/Best Practices
    • Speicherdienste
  • Offene Software
    • Betriebssystem- und Docker-Images
  • Eine Option für die Aufnahme auswählen
  • Clusterverwaltung
    • Übersicht über die Clusterverwaltung
    • Konfigurationen für die Clusterverwaltung
  • Terminologie
  • Los gehts
  • KI-Infrastruktur planen und erstellen
  • Zwischen allgemeinen und gruppierten GPUs auswählen
  • Kapazität und Kontingent abrufen
    • Übersicht
    • Kapazität reservieren
    • Reservierte Kapazität ansehen
  • Kurzanleitungen
    • Vollständig verwalteten Slurm-Cluster mit A4-VMs erstellen
    • Selbstverwalteten Slurm-Cluster mit A4-VMs erstellen
  • Infrastruktur bereitstellen
  • Übersicht über die Bereitstellungsoptionen
  • Richtlinie für kompakte Platzierung und Arbeitslastrichtlinie – Übersicht
  • KI-optimierte VMs und Cluster bereitstellen
    • GKE-Cluster erstellen
      • KI-optimierten GKE-Cluster mit Standardkonfiguration erstellen
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X Max verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4X verwendet
      • Benutzerdefinierten KI-optimierten GKE-Cluster erstellen, der A4 oder A3 Ultra verwendet
      • GKE-Standardcluster erstellen, die A3 Mega oder A3 High verwenden
      • GKE Autopilot-Cluster erstellen, die A3 Mega oder A3 High verwenden
    • Slurm-Cluster erstellen
      • Vollständig verwalteten Cluster erstellen
      • Selbstverwalteten Cluster erstellen
    • Instanz erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
    • Instanzen im Bulk erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
    • Eine verwaltete Instanzgruppe (MIG) erstellen
      • A4X Max erstellen
      • A4X erstellen
      • A4- oder A3-Ultra-Cluster erstellen
      • A3 High- oder A3 Mega-Cluster erstellen
      • A3 Edge erstellen
      • A2 erstellen
      • G4 erstellen
      • G2 erstellen
      • N1-VM mit GPUs erstellen
  • Arbeitslasten ausführen
  • Arbeitslasten mit Pathways on Cloud ausführen
    • Einführung in Pathways in der Cloud
    • GKE-Cluster mit Pathways erstellen
    • Batcharbeitslast mit Pathways ausführen
    • Interaktive Arbeitslast mit Pathways ausführen
    • Inferenz auf mehreren Hosts mit Pathways durchführen
    • Resilienztraining mit Pathways
    • JAX-Arbeitslasten zu Pathways portieren
    • Fehlerbehebung bei Pathways on Cloud
  • GKE-Arbeitslasten planen
    • Arbeitslasten mit Topology Aware Scheduling (TAS) planen
    • Knotenstatusvorhersage aktivieren
  • Arbeitslasten mit Kueue orchestrieren
  • Tutorials zu KI-Arbeitslasten
    • Übersicht
    • GPU
      • Inferenz mit vLLM in GKE ausführen
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4
        • Qwen3