Ir al contenido principal
Áreas de tecnología
close
IA y AA
Desarrollo de aplicaciones
Hosting de aplicaciones
Procesamiento
Canalizaciones y análisis de datos
Bases de datos
Nubes distribuidas, híbridas y múltiples
Soluciones de la industria
Migración
Redes
Observabilidad y supervisión
Seguridad
Storage
Herramientas para uso entre productos
close
Administración de accesos y recursos
Administración de uso y costos
Infraestructura como código
SDK, lenguajes, frameworks y herramientas
/
Consola
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Acceder
AI Hypercomputer
Comenzar gratis
Descripción general
Guías
Recursos
Áreas de tecnología
Más
Descripción general
Guías
Recursos
Herramientas para uso entre productos
Más
Consola
Descubrimiento
Descripción general
Elige tu infraestructura de aceleradores
Elige un organizador y una opción de implementación
Aceleradores
Acerca de los aceleradores de GPU
GPUs generales
GPU agrupadas en clústeres
Infraestructura con optimización de rendimiento
Máquinas con GPU
Servicios de Herramientas de redes
Descripción general de las redes de GPU
Servicios de red para implementaciones
Prácticas recomendadas para redes
Servicios de almacenamiento
Software abierto
Imágenes de SO y Docker
Elige una opción de consumo
Administración de clústeres
Descripción general de la administración de clústeres
Configuraciones de administración de clústeres
Terminología
Comenzar
Planifica y crea tu infraestructura de IA
Elige entre GPUs generales y GPUs agrupadas
Obtén capacidad y cuota
Descripción general
Reservar capacidad
Cómo ver la capacidad reservada
Guías de inicio rápido
Crea un clúster de Slurm completamente administrado con VMs A4
Crea un clúster de Slurm autoadministrado con VMs A4
Implementa la infraestructura
Descripción general de las opciones de Deployment
Descripción general de la política de posición compacta y la política de cargas de trabajo
Implementa VMs y clústeres optimizados para IA
Crea clústeres de GKE
Crea un clúster de GKE optimizado para IA con la configuración predeterminada
Crea un clúster de GKE personalizado y optimizado para IA que use A4X Max
Crea un clúster de GKE personalizado y optimizado para la IA que use A4X
Crea un clúster de GKE personalizado y optimizado para IA que use A4 o A3 Ultra
Crea clústeres de GKE Standard que usen A3 Mega o A3 High
Crea clústeres de GKE Autopilot que usen A3 Mega o A3 High
Crea clústeres de Slurm
Crea un clúster completamente administrado
Crea un clúster autoadministrado
Crea una instancia
Crear A4X Max
Crea un A4X
Crea una VM A4 o A3 Ultra
Crea un A3 High o A3 Mega
Crea un A3 Edge
Crear A2
Crea un G4
Crear G2
Crea una VM N1 con GPUs
Crea instancias de forma masiva
Crear A4X Max
Crea un A4X
Crea una VM A4 o A3 Ultra
Crea un A3 High o A3 Mega
Crea un A3 Edge
Crear A2
Crea un G4
Crear G2
Crea una VM N1 con GPUs
Crea un grupo de instancias administrado (MIG).
Crear A4X Max
Crea un A4X
Crea una VM A4 o A3 Ultra
Crea un A3 High o A3 Mega
Crea un A3 Edge
Crear A2
Crea un G4
Crear G2
Crea una VM N1 con GPUs
Ejecuta cargas de trabajo
Ejecuta cargas de trabajo con Pathways on Cloud
Introducción a las rutas de aprendizaje en Cloud
Crea un clúster de GKE con Pathways
Ejecuta una carga de trabajo por lotes con Pathways
Ejecuta una carga de trabajo interactiva con Pathways
Realiza la inferencia multihost con Pathways
Entrenamiento resiliente con Rutas
Cómo portar cargas de trabajo de JAX a Pathways
Soluciona problemas de Pathways on Cloud
Programa cargas de trabajo de GKE
Programa cargas de trabajo con la programación consciente de la topología (TAS)
Habilita la predicción del estado del nodo
Usa Kueue para organizar cargas de trabajo
Instructivos sobre cargas de trabajo de IA
Descripción general
GPU
Ejecuta la inferencia con vLLM en GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4
Qwen3
Ejecuta el ajuste
Gemma 3 en un clúster de GKE
Gemma 3 en un clúster de GKE de varios hosts
Gemma 3 en un clúster de Slurm
Gemma 3 para tareas de visión en GKE
Llama 4 en un clúster de Slurm
Mixtral-8x7b en un clúster de Slurm
Ejecuta el entrenamiento
Qwen2 en un clúster de Slurm
TPU
Entrega de cargas de trabajo
Entrega Qwen2-7B con vLLM en TPU
Entrega Qwen2-7B-Instruct con vLLM en TPU
Entrega Qwen3-8B-Base con vLLM en TPU
Entrega Llama-3.1-8B con vLLM en TPU
Ejecuta el ajuste
Ejecuta el ajuste supervisado en una VM de TPU con MaxText
Ejecuta el ajuste supervisado de varios hosts en Qwen3-14b con MaxText
Ejecuta el entrenamiento de RL en una VM de TPU v6e-8
Ejecuta el entrenamiento de RL de varios hosts en Qwen3-30b-a3b con MaxText
Administra la infraestructura
Administra clústeres de GKE
Administra instancias y clústeres de Slurm
Cómo ver la topología de una instancia
Administra eventos del organizador
Eventos de host en instancias
Eventos del host en las reservas
Cómo informar un host defectuoso
Realiza pruebas y optimizaciones
Optimiza las redes de clústeres con SNCCL/gIB
Ejecuta pruebas de NCCL
Ejecuta NCCL en instancias de Compute Engine
Ejecuta NCCL en clústeres de GKE que usan la configuración predeterminada
Ejecuta NCCL en clústeres personalizados de GKE que usan A4X Max
Ejecuta NCCL en clústeres personalizados de GKE que usan A4X
Ejecuta NCCL en clústeres personalizados de GKE que usan A4 o A3 Ultra
Ejecuta NCCL en clústeres personalizados de GKE que usan A3 Mega o A3 High
Ejecuta NCCL en clústeres de Slurm
Recopila y comprende los registros de NCCL para solucionar problemas
Cómo probar cargas de trabajo con recetas
Recetas de comparativas
Recetas de optimización de Goodput
Notas de la versión de NCCL/gIB
Notas de la versión de NCCL/gIB (x86 de 64 bits)
Notas de la versión de NCCL/gIB (ARM de 64 bits)
Supervisión
Supervisa las VMs y los clústeres de Slurm
Administra la forma en que CoMMA recopila datos de telemetría de NCCL
Collective Communication Analyzer (CoMMA)
Habilita, inhabilita y configura CoMMA
Solución de problemas
Errores conocidos
Soluciona problemas de rendimiento lento
Soluciona problemas para informar un host defectuoso
Soluciona problemas de CoMMA
IA y AA
Desarrollo de aplicaciones
Hosting de aplicaciones
Procesamiento
Canalizaciones y análisis de datos
Bases de datos
Nubes distribuidas, híbridas y múltiples
Soluciones de la industria
Migración
Redes
Observabilidad y supervisión
Seguridad
Storage
Administración de accesos y recursos
Administración de uso y costos
Infraestructura como código