Passer au contenu principal
Domaines technologiques
close
IA et ML
Développement d'applications
Hébergement d'applications
Calcul
Analyses de données et pipelines
Bases de données
Solutions distribuées, hybrides et multicloud
Solutions par secteur d'activité
Migration
Mise en réseau
Observabilité et surveillance
Sécurité
Storage
Outils de produits croisés
close
Gestion des accès et des ressources
Gestion des coûts et de l'utilisation
Infrastructure as Code
SDK, langages, frameworks et outils
/
Console
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Connexion
AI Hypercomputer
Commencer l'essai gratuit
Aperçu
Guides
Ressources
Domaines technologiques
Plus
Aperçu
Guides
Ressources
Outils de produits croisés
Plus
Console
Découvrir
Aperçu
Choisir votre infrastructure d'accélérateur
Choisir un outil d'orchestration et une option de déploiement
Accélérateurs
À propos des accélérateurs GPU
GPU généraux
GPU en cluster
Infrastructure optimisée pour les performances
Machines avec GPU
Services de mise en réseau
Présentation de la mise en réseau des GPU
Services réseau pour les déploiements
Bonnes pratiques de mise en réseau
Services de stockage
Ouvrir le logiciel
Images de l'OS et Docker
Sélectionner une option de consommation
Gestion des clusters
Présentation de la gestion des clusters
Configurations de gestion des clusters
Terminologie
Premiers pas
Planifier et créer votre infrastructure d'IA
Choisir entre des GPU généraux et des GPU en cluster
Obtenir la capacité et le quota
Aperçu
Capacité de réservation
Afficher la capacité réservée
Guides de démarrage rapide
Créer un cluster Slurm entièrement géré avec des VM A4
Créer un cluster Slurm autogéré avec des VM A4
Déployer l'infrastructure
Présentation des options de déploiement
Présentation des règles d'emplacement compact et des règles de charge de travail
Déployer des VM et des clusters optimisés pour l'IA
Créer des clusters GKE
Créer un cluster GKE optimisé pour l'IA avec la configuration par défaut
Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X Max
Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4X
Créer un cluster GKE personnalisé optimisé pour l'IA qui utilise A4 ou A3 Ultra
Créer des clusters GKE Standard qui utilisent A3 Mega ou A3 High
Créer des clusters GKE Autopilot qui utilisent A3 Mega ou A3 High
Créer des clusters Slurm
Créer un cluster entièrement géré
Créer un cluster autogéré
Créer une instance
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer une machine A3 Edge
Créer A2
Créer une propriété GA4
Créer un G2
Créer une instance N1 avec des GPU
Créer des instances de manière groupée
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer une machine A3 Edge
Créer A2
Créer une propriété GA4
Créer un G2
Créer une instance N1 avec des GPU
Créer un groupe d'instances géré
Créer A4X Max
Créer un A4X
Créer une VM A4 ou A3 Ultra
Créer une instance A3 High ou A3 Mega
Créer une machine A3 Edge
Créer A2
Créer une propriété GA4
Créer un G2
Créer une instance N1 avec des GPU
Exécuter des charges de travail
Exécuter des charges de travail avec Pathways on Cloud
Présentation des parcours sur Cloud
Créer un cluster GKE avec Pathways
Exécuter une charge de travail par lot avec Pathways
Exécuter une charge de travail interactive avec Pathways
Effectuer une inférence multihôte à l'aide de Pathways
Entraînement résilient avec Pathways
Transférer des charges de travail JAX vers Pathways
Résoudre les problèmes liés à Pathways on Cloud
Planifier des charges de travail GKE
Planifier des charges de travail avec la planification sensible à la topologie
Activer la prédiction de l'état des nœuds
Utiliser Kueue pour orchestrer les charges de travail
Tutoriels sur les charges de travail d'IA
Aperçu
GPU
Exécuter l'inférence avec vLLM sur GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4,
Qwen3
Exécuter l'affinage
Gemma 3 sur un cluster GKE
Gemma 3 sur un cluster GKE multihôte
Gemma 3 sur un cluster Slurm
Gemma 3 pour les tâches de vision sur GKE
Llama 4 sur un cluster Slurm
Mixtral-8x7b sur un cluster Slurm
Exécuter l'entraînement
Qwen2 sur un cluster Slurm
TPU
Diffuser des charges de travail
Diffuser Qwen2-7B avec vLLM sur des TPU
Diffuser Qwen2-7B-Instruct avec vLLM sur des TPU
Diffuser Qwen3-8B-Base avec vLLM sur des TPU
Diffuser Llama-3.1-8B avec vLLM sur des TPU
Exécuter l'affinage
Exécuter l'affinage supervisé sur une VM TPU avec MaxText
Exécuter l'affinage supervisé multi-hôtes sur Qwen3-14b à l'aide de MaxText
Exécuter l'entraînement RL sur une VM TPU v6e-8
Exécuter un entraînement RL multi-hôtes sur Qwen3-30b-a3b à l'aide de MaxText
Gérer l'infrastructure
Gérer les clusters GKE
Gérer les instances et les clusters Slurm
Afficher la topologie d'une instance
Gérer les événements de l'hôte
Événements hôtes dans les instances
Événements hôtes dans les réservations
Signaler un hôte défectueux
Tester et optimiser
Optimisez la mise en réseau du cluster à l'aide de NCCL/gIB
Exécuter des tests NCCL
Exécuter NCCL sur des instances Compute Engine
Exécuter NCCL sur des clusters GKE qui utilisent la configuration par défaut
Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A4X Max
Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A4X
Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A4 ou A3 Ultra
Exécuter NCCL sur des clusters GKE personnalisés qui utilisent A3 Mega ou A3 High
Exécuter NCCL sur des clusters Slurm
Collecter et comprendre les journaux NCCL pour résoudre les problèmes
Tester des charges de travail avec des recettes
Recettes de benchmarking
Recettes d'optimisation du bon débit
Notes de version de NCCL/gIB
Notes de version NCCL/gIB (x86 64 bits)
Notes de version de NCCL/gIB (ARM 64 bits)
Surveiller
Surveiller les VM et les clusters Slurm
Gérer la façon dont CoMMA collecte la télémétrie NCCL
Collective Communication Analyzer (CoMMA)
Activer, désactiver et configurer CoMMA
Dépannage
Problèmes connus
Résoudre les problèmes de lenteur
Résoudre les problèmes liés au signalement d'un hôte défectueux
Résoudre les problèmes liés à CoMMA
IA et ML
Développement d'applications
Hébergement d'applications
Calcul
Analyses de données et pipelines
Bases de données
Solutions distribuées, hybrides et multicloud
Solutions par secteur d'activité
Migration
Mise en réseau
Observabilité et surveillance
Sécurité
Storage
Gestion des accès et des ressources
Gestion des coûts et de l'utilisation
Infrastructure as Code
SDK, langages, frameworks et outils