Passer au contenu principal
Google Cloud Documentation
Domaines technologiques
  • IA et ML
  • Développement d'applications
  • Hébergement d'applications
  • Calcul
  • Analyses de données et pipelines
  • Bases de données
  • Solutions distribuées, hybrides et multicloud
  • Solutions par secteur d'activité
  • Migration
  • Mise en réseau
  • Observabilité et surveillance
  • Sécurité
  • Storage
Outils de produits croisés
  • Gestion des accès et des ressources
  • Gestion des coûts et de l'utilisation
  • Infrastructure as Code
  • SDK, langages, frameworks et outils
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Connexion
  • AI Hypercomputer
Commencer l'essai gratuit
Aperçu Guides Ressources
Google Cloud Documentation
  • Domaines technologiques
    • Plus
    • Aperçu
    • Guides
    • Ressources
  • Outils de produits croisés
    • Plus
  • Console
  • Découvrir
  • Aperçu
  • Choisir votre infrastructure d'accélérateur
  • Choisir un outil d'orchestration et une option de déploiement
  • Accélérateurs
    • À propos des accélérateurs GPU
    • GPU généraux
    • GPU en cluster
  • Infrastructure optimisée pour les performances
    • Machines avec GPU
    • Services de mise en réseau
      • Présentation de la mise en réseau des GPU
      • Services réseau pour les déploiements
      • Bonnes pratiques de mise en réseau
    • Services de stockage
  • Ouvrir le logiciel
    • Images de l'OS et Docker
  • Sélectionner une option de consommation
  • Gestion des clusters
    • Présentation de la gestion des clusters
    • Configurations de gestion des clusters
  • Terminologie
  • Premiers pas
  • Planifier et créer votre infrastructure d'IA
  • Choisir entre des GPU généraux et des GPU en cluster
  • Obtenir la capacité et le quota
    • Aperçu
    • Capacité de réservation
    • Afficher la capacité réservée
  • Guides de démarrage rapide
    • Créer un cluster Slurm entièrement géré avec des VM A4
    • Créer un cluster Slurm autogéré avec des VM A4
  • Déployer l'infrastructure
  • Présentation des options de déploiement
  • Présentation des règles d'emplacement compact et des règles de charge de travail
  • Déployer des VM et des clusters optimisés pour l'IA
    • Créer des clusters GKE
      • Créer un cluster GKE optimisé pour l'IA avec la configuration par défaut
      • Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X Max
      • Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X
      • Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4 ou A3 Ultra
      • Créer des clusters GKE Standard qui utilisent A3 Mega ou A3 High
      • Créer des clusters GKE Autopilot qui utilisent A3 Mega ou A3 High
    • Créer des clusters Slurm
      • Créer un cluster entièrement géré
      • Créer un cluster autogéré
    • Créer une instance
      • Créer A4X Max
      • Créer un A4X
      • Créer une VM A4 ou A3 Ultra
      • Créer une instance A3 High ou A3 Mega
      • Créer une machine A3 Edge
      • Créer A2
      • Créer une propriété GA4
      • Créer un G2
      • Créer une instance N1 avec des GPU
    • Créer des instances de manière groupée
      • Créer A4X Max
      • Créer un A4X
      • Créer une VM A4 ou A3 Ultra
      • Créer une instance A3 High ou A3 Mega
      • Créer une machine A3 Edge
      • Créer A2
      • Créer une propriété GA4
      • Créer un G2
      • Créer une instance N1 avec des GPU
    • Créer un groupe d'instances géré
      • Créer A4X Max
      • Créer un A4X
      • Créer une VM A4 ou A3 Ultra
      • Créer une instance A3 High ou A3 Mega
      • Créer une machine A3 Edge
      • Créer A2
      • Créer une propriété GA4
      • Créer un G2
      • Créer une instance N1 avec des GPU
  • Exécuter des charges de travail
  • Exécuter des charges de travail avec Pathways on Cloud
    • Présentation des parcours sur Cloud
    • Créer un cluster GKE avec Pathways
    • Exécuter une charge de travail par lot avec Pathways
    • Exécuter une charge de travail interactive avec Pathways
    • Effectuer une inférence multihôte à l'aide de Pathways
    • Entraînement résilient avec Pathways
    • Transférer des charges de travail JAX vers Pathways
    • Résoudre les problèmes liés à Pathways on Cloud
  • Planifier des charges de travail GKE
    • Planifier des charges de travail avec la planification sensible à la topologie
    • Activer la prédiction de l'état des nœuds
  • Utiliser Kueue pour orchestrer les charges de travail
  • Tutoriels sur les charges de travail d'IA
    • Aperçu
    • GPU
      • Exécuter l'inférence avec vLLM sur GKE
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4,
        • Qwen3
      • Exécuter l'affinage
        • Gemma 3 sur un cluster GKE
        • Gemma 3 sur un cluster GKE multihôte
        • Gemma 3 sur un cluster Slurm
        • Gemma 3 pour les tâches de vision sur GKE
        • Llama 4 sur un cluster Slurm
        • Mixtral-8x7b sur un cluster Slurm
      • Exécuter l'entraînement
        • Qwen2 sur un cluster Slurm
    • TPU
      • Diffuser des charges de travail
        • Diffuser Qwen2-7B avec vLLM sur des TPU
        • Diffuser Qwen2-7B-Instruct avec vLLM sur des TPU
        • Diffuser Qwen3-8B-Base avec vLLM sur des TPU
        • Diffuser Llama-3.1-8B avec vLLM sur des TPU
      • Exécuter l'affinage
        • Exécuter l'affinage supervisé sur une VM TPU avec MaxText
        • Exécuter l'affinage supervisé multi-hôtes sur Qwen3-14b à l'aide de MaxText
        • Exécuter l'entraînement RL sur une VM TPU v6e-8
        • Exécuter un entraînement RL multi-hôtes sur Qwen3-30b-a3b à l'aide de MaxText
  • Gérer l'infrastructure
  • Gérer les clusters GKE
  • Gérer les instances et les clusters Slurm
    • Afficher la topologie d'une instance
    • Gérer les événements de l'hôte
      • Événements hôtes dans les instances
      • Événements hôtes dans les réservations
    • Signaler un hôte défectueux
  • Tester et optimiser
  • Optimisez la mise en réseau du cluster à l'aide de NCCL/gIB
  • Exécuter des tests NCCL
    • Exécuter NCCL sur des instances Compute Engine
    • Exécuter NCCL sur des clusters GKE qui utilisent la configuration par défaut
    • Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A4X Max
    • Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A4X
    • Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A4 ou A3 Ultra
    • Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A3 Mega ou A3 High
    • Exécuter NCCL sur des clusters Slurm
  • Collecter et comprendre les journaux NCCL pour résoudre les problèmes
  • Tester des charges de travail avec des recettes
    • Recettes de benchmarking
    • Recettes d'optimisation du bon débit
  • Notes de version de NCCL/gIB
    • Notes de version NCCL/gIB (x86 64 bits)
    • Notes de version de NCCL/gIB (ARM 64 bits)
  • Surveiller
  • Surveiller les VM et les clusters Slurm
  • Gérer la façon dont CoMMA collecte la télémétrie NCCL
    • Collective Communication Analyzer (CoMMA)
    • Activer, désactiver et configurer CoMMA
  • Dépannage
  • Problèmes connus
  • Résoudre les problèmes de lenteur
  • Résoudre les problèmes liés au signalement d'un hôte défectueux
  • Résoudre les problèmes liés à CoMMA
  • IA et ML
  • Développement d'applications
  • Hébergement d'applications
  • Calcul
  • Analyses de données et pipelines
  • Bases de données
  • Solutions distribuées, hybrides et multicloud
  • Solutions par secteur d'activité
  • Migration