기본 콘텐츠로 건너뛰기
기술 영역
close
AI 및 ML
애플리케이션 개발
애플리케이션 호스팅
컴퓨팅
데이터 분석 및 파이프라인
데이터베이스
분산, 하이브리드, 멀티 클라우드
업종별 솔루션
이전
네트워킹
모니터링 가능성 및 모니터링
보안
Storage
크로스 프로덕트 도구
close
액세스 및 리소스 관리
비용 및 사용량 관리
코드형 인프라
SDK, 언어, 프레임워크, 도구
/
콘솔
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
로그인
AI Hypercomputer
무료로 시작하기
개요
가이드
리소스
기술 영역
더보기
개요
가이드
리소스
크로스 프로덕트 도구
더보기
콘솔
Discover
개요
액셀러레이터 인프라 선택
조정자 및 배포 옵션 선택
가속기
GPU 가속기 정보
일반 GPU
클러스터링된 GPU
성능 최적화 인프라
GPU 머신
네트워킹 서비스
GPU 네트워킹 개요
배포를 위한 네트워크 서비스
네트워킹 권장사항
스토리지 서비스
오픈 소프트웨어
OS 및 Docker 이미지
소비 옵션 선택
클러스터 관리
클러스터 관리 개요
클러스터 관리 구성
용어
시작하기
AI 인프라 계획 및 만들기
일반 GPU와 클러스터링된 GPU 중에서 선택
용량 및 할당량 가져오기
개요
용량 예약
예약된 용량 보기
빠른 시작
A4 VM으로 완전 관리형 Slurm 클러스터 만들기
A4 VM으로 자체 관리형 Slurm 클러스터 만들기
인프라 배포
배포 옵션 개요
압축 배치 정책 및 워크로드 정책 개요
AI 최적화 VM 및 클러스터 배포
GKE 클러스터 만들기
기본 구성으로 AI에 최적화된 GKE 클러스터 만들기
A4X Max를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
A4X를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
A4 또는 A3 Ultra를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
A3 Mega 또는 A3 High를 사용하는 GKE Standard 클러스터 만들기
A3 Mega 또는 A3 High를 사용하는 GKE Autopilot 클러스터 만들기
Slurm 클러스터 만들기
완전 관리형 클러스터 만들기
자체 관리형 클러스터 만들기
인스턴스 만들기
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
인스턴스 일괄 생성
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
관리형 인스턴스 그룹(MIG) 만들기
A4X Max 만들기
A4X 만들기
A4 또는 A3 Ultra 만들기
A3 High 또는 A3 Mega 만들기
A3 Edge 만들기
A2 만들기
G4 만들기
G2 만들기
GPU가 포함된 N1 만들기
워크로드 실행
Cloud에서 Pathways로 워크로드 실행
Cloud의 학습 과정 소개
경로로 GKE 클러스터 만들기
Pathways로 일괄 워크로드 실행
경로를 사용하여 대화형 워크로드 실행
경로를 사용하여 멀티 호스트 추론 실행
학습 과정을 통한 탄력적인 학습
JAX 워크로드를 Pathways로 포팅
Pathways on Cloud 문제 해결
GKE 워크로드 예약
Topology Aware Scheduling (TAS)으로 워크로드 예약
노드 상태 예측 사용 설정
Kueue를 사용하여 워크로드 조정
AI 워크로드 튜토리얼
개요
GPU
GKE에서 vLLM으로 추론 실행
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3는
GPT-OSS
Llama 4
Qwen3
미세 조정 실행
GKE 클러스터의 Gemma 3
멀티 호스트 GKE 클러스터의 Gemma 3
Slurm 클러스터의 Gemma 3
GKE의 비전 작업을 위한 Gemma 3
Slurm 클러스터의 Llama 4
Slurm 클러스터의 Mixtral-8x7b
학습 실행
Slurm 클러스터의 Qwen2
TPU
워크로드 제공
TPU에서 vLLM으로 Qwen2-7B 서빙
TPU에서 vLLM으로 Qwen2-7B-Instruct 서빙
TPU에서 vLLM으로 Qwen3-8B-Base 서빙
TPU에서 vLLM으로 Llama-3.1-8B 서빙
미세 조정 실행
MaxText를 사용하여 TPU VM에서 지도 미세 조정 실행
MaxText를 사용하여 Qwen3-14b에서 멀티 호스트 지도 미세 조정 실행