Ir al contenido principal
Google Cloud Documentation
Áreas de tecnología
  • IA y AA
  • Desarrollo de aplicaciones
  • Hosting de aplicaciones
  • Procesamiento
  • Canalizaciones y análisis de datos
  • Bases de datos
  • Nubes distribuidas, híbridas y múltiples
  • Soluciones de la industria
  • Migración
  • Redes
  • Observabilidad y supervisión
  • Seguridad
  • Storage
Herramientas para uso entre productos
  • Administración de accesos y recursos
  • Administración de uso y costos
  • Infraestructura como código
  • SDK, lenguajes, frameworks y herramientas
/
Consola
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Acceder
  • AI Hypercomputer
Comenzar gratis
Descripción general Guías Recursos
Google Cloud Documentation
  • Áreas de tecnología
    • Más
    • Descripción general
    • Guías
    • Recursos
  • Herramientas para uso entre productos
    • Más
  • Consola
  • Descubrimiento
  • Descripción general
  • Elige tu infraestructura de aceleradores
  • Elige un organizador y una opción de implementación
  • Aceleradores
    • Acerca de los aceleradores de GPU
    • GPUs generales
    • GPU agrupadas en clústeres
  • Infraestructura con optimización de rendimiento
    • Máquinas con GPU
    • Servicios de Herramientas de redes
      • Descripción general de las redes de GPU
      • Servicios de red para implementaciones
      • Prácticas recomendadas para redes
    • Servicios de almacenamiento
  • Software abierto
    • Imágenes de SO y Docker
  • Elige una opción de consumo
  • Administración de clústeres
    • Descripción general de la administración de clústeres
    • Configuraciones de administración de clústeres
  • Terminología
  • Comenzar
  • Planifica y crea tu infraestructura de IA
  • Elige entre GPUs generales y GPUs agrupadas
  • Obtén capacidad y cuota
    • Descripción general
    • Reservar capacidad
    • Cómo ver la capacidad reservada
  • Guías de inicio rápido
    • Crea un clúster de Slurm completamente administrado con VMs A4
    • Crea un clúster de Slurm autoadministrado con VMs A4
  • Implementa la infraestructura
  • Descripción general de las opciones de Deployment
  • Descripción general de la política de posición compacta y la política de cargas de trabajo
  • Implementa VMs y clústeres optimizados para IA
    • Crea clústeres de GKE
      • Crea un clúster de GKE optimizado para IA con la configuración predeterminada
      • Crea un clúster de GKE personalizado y optimizado para IA que use A4X Max
      • Crea un clúster de GKE personalizado y optimizado para la IA que use A4X
      • Crea un clúster de GKE personalizado y optimizado para IA que use A4 o A3 Ultra
      • Crea clústeres de GKE Standard que usen A3 Mega o A3 High
      • Crea clústeres de GKE Autopilot que usen A3 Mega o A3 High
    • Crea clústeres de Slurm
      • Crea un clúster completamente administrado
      • Crea un clúster autoadministrado
    • Crea una instancia
      • Crear A4X Max
      • Crea un A4X
      • Crea una VM A4 o A3 Ultra
      • Crea un A3 High o A3 Mega
      • Crea un A3 Edge
      • Crear A2
      • Crea un G4
      • Crear G2
      • Crea una VM N1 con GPUs
    • Crea instancias de forma masiva
      • Crear A4X Max
      • Crea un A4X
      • Crea una VM A4 o A3 Ultra
      • Crea un A3 High o A3 Mega
      • Crea un A3 Edge
      • Crear A2
      • Crea un G4
      • Crear G2
      • Crea una VM N1 con GPUs
    • Crea un grupo de instancias administrado (MIG).
      • Crear A4X Max
      • Crea un A4X
      • Crea una VM A4 o A3 Ultra
      • Crea un A3 High o A3 Mega
      • Crea un A3 Edge
      • Crear A2
      • Crea un G4
      • Crear G2
      • Crea una VM N1 con GPUs
  • Ejecuta cargas de trabajo
  • Ejecuta cargas de trabajo con Pathways on Cloud
    • Introducción a las rutas de aprendizaje en Cloud
    • Crea un clúster de GKE con Pathways
    • Ejecuta una carga de trabajo por lotes con Pathways
    • Ejecuta una carga de trabajo interactiva con Pathways
    • Realiza la inferencia multihost con Pathways
    • Entrenamiento resiliente con Rutas
    • Cómo portar cargas de trabajo de JAX a Pathways
    • Soluciona problemas de Pathways on Cloud
  • Programa cargas de trabajo de GKE
    • Programa cargas de trabajo con la programación consciente de la topología (TAS)
    • Habilita la predicción del estado del nodo
  • Usa Kueue para organizar cargas de trabajo
  • Instructivos sobre cargas de trabajo de IA
    • Descripción general
    • GPU
      • Ejecuta la inferencia con vLLM en GKE
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4
        • Qwen3
      • Ejecuta el ajuste
        • Gemma 3 en un clúster de GKE
        • Gemma 3 en un clúster de GKE de varios hosts
        • Gemma 3 en un clúster de Slurm
        • Gemma 3 para tareas de visión en GKE
        • Llama 4 en un clúster de Slurm
        • Mixtral-8x7b en un clúster de Slurm
      • Ejecuta el entrenamiento
        • Qwen2 en un clúster de Slurm
    • TPU
      • Entrega de cargas de trabajo
        • Entrega Qwen2-7B con vLLM en TPU
        • Entrega Qwen2-7B-Instruct con vLLM en TPU
        • Entrega Qwen3-8B-Base con vLLM en TPU
        • Entrega Llama-3.1-8B con vLLM en TPU
      • Ejecuta el ajuste
        • Ejecuta el ajuste supervisado en una VM de TPU con MaxText
        • Ejecuta el ajuste supervisado de varios hosts en Qwen3-14b con MaxText
        • Ejecuta el entrenamiento de RL en una VM de TPU v6e-8
        • Ejecuta el entrenamiento de RL de varios hosts en Qwen3-30b-a3b con MaxText
  • Administra la infraestructura
  • Administra clústeres de GKE
  • Administra instancias y clústeres de Slurm
    • Cómo ver la topología de una instancia
    • Administra eventos del organizador
      • Eventos de host en instancias
      • Eventos del host en las reservas
    • Cómo informar un host defectuoso
  • Realiza pruebas y optimizaciones
  • Optimiza las redes de clústeres con SNCCL/gIB
  • Ejecuta pruebas de NCCL
    • Ejecuta NCCL en instancias de Compute Engine
    • Ejecuta NCCL en clústeres de GKE que usan la configuración predeterminada
    • Ejecuta NCCL en clústeres personalizados de GKE que usan A4X Max
    • Ejecuta NCCL en clústeres personalizados de GKE que usan A4X
    • Ejecuta NCCL en clústeres personalizados de GKE que usan A4 o A3 Ultra
    • Ejecuta NCCL en clústeres personalizados de GKE que usan A3 Mega o A3 High
    • Ejecuta NCCL en clústeres de Slurm
  • Recopila y comprende los registros de NCCL para solucionar problemas
  • Cómo probar cargas de trabajo con recetas
    • Recetas de comparativas
    • Recetas de optimización de Goodput
  • Notas de la versión de NCCL/gIB
    • Notas de la versión de NCCL/gIB (x86 de 64 bits)