Ir para o conteúdo principal
Áreas de tecnologia
close
IA e ML
Desenvolvimento de aplicativos
Hospedagem de aplicativos
Computação
Pipelines e análises de dados
Bancos de dados
Distribuído, híbrido e multicloud
Soluções por setor
Migração
Rede
Observabilidade e monitoramento
Segurança
Storage
Ferramentas de vários produtos
close
Gerenciamento de recursos e acesso
Gerenciamento de custos e uso
Infraestrutura como código
SDK, linguagens, frameworks e ferramentas
/
Console
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
Fazer login
AI Hypercomputer
Comece sem custos financeiros
Visão geral
Guias
Recursos
Áreas de tecnologia
Mais
Visão geral
Guias
Recursos
Ferramentas de vários produtos
Mais
Console
Descoberta
Visão geral
Escolher sua infraestrutura de acelerador
Escolher um orquestrador e uma opção de implantação
Aceleradores
Sobre aceleradores de GPU
GPUs gerais
GPUs em cluster
Infraestrutura com desempenho otimizado
Máquinas de GPU
Serviços de redes
Visão geral da rede de GPU
Serviços de rede para implantações
Práticas recomendadas de rede
Serviços de armazenamento
Software aberto
Imagens do SO e do Docker
Escolha uma opção de consumo
Gerenciamento de clusters
Visão geral do gerenciamento de clusters
Configurações de gerenciamento de clusters
Terminologia
Começar
Planejar e criar sua infraestrutura de IA
Escolher entre GPUs gerais e em cluster
Obter capacidade e cota
Visão geral
Capacidade de reserva
Ver capacidade reservada
Guias de início rápido
Criar um cluster Slurm totalmente gerenciado com VMs A4
Criar um cluster Slurm autogerenciado com VMs A4
Implantar infraestrutura
Visão geral das opções de implantação
Visão geral das políticas de posicionamento compacto e de carga de trabalho
Implante VMs e clusters otimizados para IA
Criar clusters do GKE
Criar um cluster do GKE otimizado para IA com configuração padrão
Criar um cluster do GKE personalizado otimizado para IA que usa o A4X Max
Criar um cluster do GKE personalizado otimizado para IA que usa o A4X
Criar um cluster personalizado do GKE otimizado para IA que usa A4 ou A3 Ultra
Criar clusters do GKE Standard que usam A3 Mega ou A3 High
Criar clusters do GKE Autopilot que usam A3 Mega ou A3 High
Criar clusters do Slurm
Criar um cluster totalmente gerenciado
Criar um cluster autogerenciado
Criar uma instância
Criar A4X Max
Criar A4X
Criar A4 ou A3 Ultra
Criar A3 High ou A3 Mega
Criar A3 Edge
Criar A2
Criar G4
Criar G2
Criar N1 com GPUs
Criar instâncias em massa
Criar A4X Max
Criar A4X
Criar A4 ou A3 Ultra
Criar A3 High ou A3 Mega
Criar A3 Edge
Criar A2
Criar G4
Criar G2
Criar N1 com GPUs
Criar um grupo gerenciado de instâncias (MIG, na sigla em inglês)
Criar A4X Max
Criar A4X
Criar A4 ou A3 Ultra
Criar A3 High ou A3 Mega
Criar A3 Edge
Criar A2
Criar G4
Criar G2
Criar N1 com GPUs
Executar cargas de trabalho
Executar cargas de trabalho com os programas de aprendizado no Cloud
Introdução aos programas no Cloud
Criar um cluster do GKE com o Pathways
Executar uma carga de trabalho em lote com os programas
Executar uma carga de trabalho interativa com os programas
Fazer inferência multihost usando o Pathways
Treinamento resiliente com programas de aprendizado
Portar cargas de trabalho do JAX para o Pathways
Resolver problemas do Pathways on Cloud
Agendar cargas de trabalho do GKE
Programar cargas de trabalho com o Agendamento com reconhecimento de topologia (TAS, na sigla em inglês)
Ativar a previsão de integridade do nó
Usar o Kueue para orquestrar cargas de trabalho
Tutoriais sobre cargas de trabalho de IA
Visão geral
GPU
Executar inferência com vLLM no GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
O Gemma 3
GPT-OSS
o Llama 3
Qwen3
Executar ajuste
Gemma 3 em um cluster do GKE
Gemma 3 em um cluster do GKE de vários hosts
Gemma 3 em um cluster do Slurm
Gemma 3 para tarefas de visão no GKE
Llama 4 em um cluster do Slurm
Mixtral-8x7b em um cluster Slurm
Executar o treinamento
Qwen2 em um cluster Slurm
TPU
Disponibilizar cargas de trabalho
Disponibilizar o Qwen2-7B com o vLLM em TPUs
Disponibilizar o Qwen2-7B-Instruct com vLLM em TPUs
Disponibilizar o Qwen3-8B-Base com vLLM em TPUs
Disponibilizar o Llama-3.1-8B com o vLLM em TPUs
Executar ajuste
Executar o ajuste supervisionado em uma VM da TPU com o MaxText
Executar o ajuste supervisionado de vários hosts no Qwen3-14b usando o MaxText
Executar treinamento de RL em uma VM da TPU v6e-8
Executar treinamento de RL de vários hosts no Qwen3-30b-a3b usando o MaxText
Gerenciar infraestrutura
Gerenciar clusters do GKE
Gerenciar instâncias e clusters do Slurm
Ver a topologia de uma instância
Gerenciar eventos do organizador
Eventos de host em instâncias
Eventos de host em reservas
Denunciar um host com falha
Testar e otimizar
Otimizar a rede de computadores do cluster usando NCCL/gIB
Executar testes da NCCL
Executar o NCCL em instâncias do Compute Engine
Executar o NCCL em clusters do GKE que usam a configuração padrão
Executar o NCCL em clusters personalizados do GKE que usam o A4X Max
Executar o NCCL em clusters personalizados do GKE que usam A4X
Executar o NCCL em clusters personalizados do GKE que usam A4 ou A3 Ultra
Executar NCCL em clusters personalizados do GKE que usam A3 Mega ou A3 High
Executar o NCCL em clusters Slurm
Coletar e entender registros do NCCL para solução de problemas
Testar cargas de trabalho com receitas
Receitas de comparativo de mercado