Passa ai contenuti principali
Google Cloud Documentation
Aree tecnologiche
  • AI e ML
  • Sviluppo di applicazioni
  • Hosting di applicazioni
  • Computing
  • Analisi dei dati e pipeline
  • Database
  • Distribuito, ibrido e multi-cloud
  • Soluzioni di settore
  • Migrazione
  • Networking
  • Osservabilità e monitoraggio
  • Sicurezza
  • Storage
Strumenti per più prodotti
  • Gestione di accessi e risorse
  • Gestione di costi e utilizzo
  • Infrastructure as Code (IaC)
  • SDK, linguaggi, framework e strumenti
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Accedi
  • AI Hypercomputer
Inizia gratuitamente
Panoramica Guide Risorse
Google Cloud Documentation
  • Aree tecnologiche
    • Altro
    • Panoramica
    • Guide
    • Risorse
  • Strumenti per più prodotti
    • Altro
  • Console
  • Scopri
  • Panoramica
  • Scegliere l'infrastruttura dell'acceleratore
  • Scegli un orchestratore e un'opzione di deployment
  • Acceleratori
    • Informazioni sugli acceleratori GPU
    • GPU generiche
    • GPU in cluster
  • Infrastruttura ottimizzata per le prestazioni
    • Macchine GPU
    • Servizi di networking
      • Panoramica del networking GPU
      • Servizi di rete per i deployment
      • Best practice di networking
    • Servizi di archiviazione
  • Apri software
    • Immagini sistema operativo e Docker
  • Scegli un'opzione di consumo
  • Gestione dei cluster
    • Panoramica della gestione del cluster
    • Configurazioni di gestione del cluster
  • Terminologia
  • Per iniziare
  • Pianifica e crea la tua infrastruttura AI
  • Scegliere tra GPU generiche e GPU in cluster
  • Ottenere capacità e quota
    • Panoramica
    • Prenota la capacità
    • Visualizzare la capacità riservata
  • Guide rapide
    • Crea un cluster Slurm completamente gestito con VM A4
    • Crea un cluster Slurm autogestito con VM A4
  • Esegui il deployment dell'infrastruttura
  • Panoramica delle opzioni di deployment
  • Panoramica della policy di posizionamento compatto e della policy workload
  • Esegui il deployment di VM e cluster ottimizzati per l'AI
    • Crea cluster GKE
      • Crea un cluster GKE ottimizzato per l'AI con la configurazione predefinita
      • Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A4X Max
      • Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A4X
      • Crea un cluster GKE personalizzato ottimizzato per l'AI che utilizza A4 o A3 Ultra
      • Crea cluster GKE Standard che utilizzano A3 Mega o A3 High
      • Crea cluster GKE Autopilot che utilizzano A3 Mega o A3 High
    • Crea cluster Slurm
      • Crea un cluster completamente gestito
      • Crea un cluster autogestito
    • Crea un'istanza
      • Crea A4X Max
      • Crea A4X
      • Crea A4 o A3 Ultra
      • Crea A3 High o A3 Mega
      • Crea A3 Edge
      • Crea A2
      • Crea G4
      • Crea G2
      • Crea N1 con GPU
    • Creare istanze collettivamente
      • Crea A4X Max
      • Crea A4X
      • Crea A4 o A3 Ultra
      • Crea A3 High o A3 Mega
      • Crea A3 Edge
      • Crea A2
      • Crea G4
      • Crea G2
      • Crea N1 con GPU
    • Creazione di un gruppo di istanze gestite (MIG)
      • Crea A4X Max
      • Crea A4X
      • Crea A4 o A3 Ultra
      • Crea A3 High o A3 Mega
      • Crea A3 Edge
      • Crea A2
      • Crea G4
      • Crea G2
      • Crea N1 con GPU
  • Esegui carichi di lavoro
  • Esegui i workload con Pathways on Cloud
    • Introduzione ai percorsi su Cloud
    • Crea un cluster GKE con Pathways
    • Esegui un carico di lavoro batch con Pathways
    • Esegui un carico di lavoro interattivo con Pathways
    • Esegui l'inferenza multihost utilizzando Pathways
    • Formazione resiliente con Pathways
    • Portare i carichi di lavoro JAX su Pathways
    • Risolvi i problemi di Pathways on Cloud
  • Pianifica i workload GKE
    • Pianificare i workload con Topology Aware Scheduling (TAS)
    • Abilita la previsione dello stato di integrità dei nodi
  • Utilizza Kueue per orchestrare i workload
  • Tutorial sui workload AI
    • Panoramica
    • GPU
      • Esegui l'inferenza con vLLM su GKE
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4
        • Qwen3
      • Esegui l'ottimizzazione
        • Gemma 3 su un cluster GKE
        • Gemma 3 su un cluster GKE multi-host
        • Gemma 3 su un cluster Slurm
        • Gemma 3 per attività di visione su GKE
        • Llama 4 su un cluster Slurm
        • Mixtral-8x7b su un cluster Slurm
      • Allenamento di corsa