Ir para o conteúdo principal
Google Cloud Documentation
Áreas de tecnologia
  • IA e ML
  • Desenvolvimento de aplicativos
  • Hospedagem de aplicativos
  • Computação
  • Pipelines e análises de dados
  • Bancos de dados
  • Distribuído, híbrido e multicloud
  • Soluções por setor
  • Migração
  • Rede
  • Observabilidade e monitoramento
  • Segurança
  • Storage
Ferramentas de vários produtos
  • Gerenciamento de recursos e acesso
  • Gerenciamento de custos e uso
  • Infraestrutura como código
  • SDK, linguagens, frameworks e ferramentas
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Fazer login
  • AI Hypercomputer
Comece sem custos financeiros
Visão geral Guias Recursos
Google Cloud Documentation
  • Áreas de tecnologia
    • Mais
    • Visão geral
    • Guias
    • Recursos
  • Ferramentas de vários produtos
    • Mais
  • Console
  • Descoberta
  • Visão geral
  • Escolher sua infraestrutura de acelerador
  • Escolher um orquestrador e uma opção de implantação
  • Aceleradores
    • Sobre aceleradores de GPU
    • GPUs gerais
    • GPUs em cluster
  • Infraestrutura com desempenho otimizado
    • Máquinas de GPU
    • Serviços de redes
      • Visão geral da rede de GPU
      • Serviços de rede para implantações
      • Práticas recomendadas de rede
    • Serviços de armazenamento
  • Software aberto
    • Imagens do SO e do Docker
  • Escolha uma opção de consumo
  • Gerenciamento de clusters
    • Visão geral do gerenciamento de clusters
    • Configurações de gerenciamento de clusters
  • Terminologia
  • Começar
  • Planejar e criar sua infraestrutura de IA
  • Escolher entre GPUs gerais e em cluster
  • Obter capacidade e cota
    • Visão geral
    • Capacidade de reserva
    • Ver capacidade reservada
  • Guias de início rápido
    • Criar um cluster Slurm totalmente gerenciado com VMs A4
    • Criar um cluster Slurm autogerenciado com VMs A4
  • Implantar infraestrutura
  • Visão geral das opções de implantação
  • Visão geral das políticas de posicionamento compacto e de carga de trabalho
  • Implante VMs e clusters otimizados para IA
    • Criar clusters do GKE
      • Criar um cluster do GKE otimizado para IA com configuração padrão
      • Criar um cluster do GKE personalizado otimizado para IA que usa o A4X Max
      • Criar um cluster do GKE personalizado otimizado para IA que usa o A4X
      • Criar um cluster personalizado do GKE otimizado para IA que usa A4 ou A3 Ultra
      • Criar clusters do GKE Standard que usam A3 Mega ou A3 High
      • Criar clusters do GKE Autopilot que usam A3 Mega ou A3 High
    • Criar clusters do Slurm
      • Criar um cluster totalmente gerenciado
      • Criar um cluster autogerenciado
    • Criar uma instância
      • Criar A4X Max
      • Criar A4X
      • Criar A4 ou A3 Ultra
      • Criar A3 High ou A3 Mega
      • Criar A3 Edge
      • Criar A2
      • Criar G4
      • Criar G2
      • Criar N1 com GPUs
    • Criar instâncias em massa
      • Criar A4X Max
      • Criar A4X
      • Criar A4 ou A3 Ultra
      • Criar A3 High ou A3 Mega
      • Criar A3 Edge
      • Criar A2
      • Criar G4
      • Criar G2
      • Criar N1 com GPUs
    • Criar um grupo gerenciado de instâncias (MIG, na sigla em inglês)
      • Criar A4X Max
      • Criar A4X
      • Criar A4 ou A3 Ultra
      • Criar A3 High ou A3 Mega
      • Criar A3 Edge
      • Criar A2
      • Criar G4
      • Criar G2
      • Criar N1 com GPUs
  • Executar cargas de trabalho
  • Executar cargas de trabalho com os programas de aprendizado no Cloud
    • Introdução aos programas no Cloud
    • Criar um cluster do GKE com o Pathways
    • Executar uma carga de trabalho em lote com os programas
    • Executar uma carga de trabalho interativa com os programas
    • Fazer inferência multihost usando o Pathways
    • Treinamento resiliente com programas de aprendizado
    • Portar cargas de trabalho do JAX para o Pathways
    • Resolver problemas do Pathways on Cloud
  • Agendar cargas de trabalho do GKE
    • Programar cargas de trabalho com o Agendamento com reconhecimento de topologia (TAS, na sigla em inglês)
    • Ativar a previsão de integridade do nó
  • Usar o Kueue para orquestrar cargas de trabalho
  • Tutoriais sobre cargas de trabalho de IA
    • Visão geral
    • GPU
      • Executar inferência com vLLM no GKE
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • O Gemma 3
        • GPT-OSS
        • o Llama 3
        • Qwen3
      • Executar ajuste
        • Gemma 3 em um cluster do GKE
        • Gemma 3 em um cluster do GKE de vários hosts
        • Gemma 3 em um cluster do Slurm
        • Gemma 3 para tarefas de visão no GKE
        • Llama 4 em um cluster do Slurm
        • Mixtral-8x7b em um cluster Slurm
      • Executar o treinamento
        • Qwen2 em um cluster Slurm
    • TPU
      • Disponibilizar cargas de trabalho
        • Disponibilizar o Qwen2-7B com o vLLM em TPUs
        • Disponibilizar o Qwen2-7B-Instruct com vLLM em TPUs
        • Disponibilizar o Qwen3-8B-Base com vLLM em TPUs
        • Disponibilizar o Llama-3.1-8B com o vLLM em TPUs
      • Executar ajuste
        • Executar o ajuste supervisionado em uma VM da TPU com o MaxText
        • Executar o ajuste supervisionado de vários hosts no Qwen3-14b usando o MaxText
        • Executar treinamento de RL em uma VM da TPU v6e-8
        • Executar treinamento de RL de vários hosts no Qwen3-30b-a3b usando o MaxText
  • Gerenciar infraestrutura
  • Gerenciar clusters do GKE
  • Gerenciar instâncias e clusters do Slurm
    • Ver a topologia de uma instância
    • Gerenciar eventos do organizador
      • Eventos de host em instâncias
      • Eventos de host em reservas
    • Denunciar um host com falha
  • Testar e otimizar
  • Otimizar a rede de computadores do cluster usando NCCL/gIB
  • Executar testes da NCCL
    • Executar o NCCL em instâncias do Compute Engine
    • Executar o NCCL em clusters do GKE que usam a configuração padrão
    • Executar o NCCL em clusters personalizados do GKE que usam o A4X Max
    • Executar o NCCL em clusters personalizados do GKE que usam A4X
    • Executar o NCCL em clusters personalizados do GKE que usam A4 ou A3 Ultra
    • Executar NCCL em clusters personalizados do GKE que usam A3 Mega ou A3 High
    • Executar o NCCL em clusters Slurm
  • Coletar e entender registros do NCCL para solução de problemas
  • Testar cargas de trabalho com receitas
    • Receitas de comparativo de mercado