기본 콘텐츠로 건너뛰기
Google Cloud Documentation
기술 영역
  • AI 및 ML
  • 애플리케이션 개발
  • 애플리케이션 호스팅
  • 컴퓨팅
  • 데이터 분석 및 파이프라인
  • 데이터베이스
  • 분산, 하이브리드, 멀티 클라우드
  • 업종별 솔루션
  • 이전
  • 네트워킹
  • 모니터링 가능성 및 모니터링
  • 보안
  • Storage
크로스 프로덕트 도구
  • 액세스 및 리소스 관리
  • 비용 및 사용량 관리
  • 코드형 인프라
  • SDK, 언어, 프레임워크, 도구
/
콘솔
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
로그인
  • AI Hypercomputer
무료로 시작하기
개요 가이드 리소스
Google Cloud Documentation
  • 기술 영역
    • 더보기
    • 개요
    • 가이드
    • 리소스
  • 크로스 프로덕트 도구
    • 더보기
  • 콘솔
  • Discover
  • 개요
  • 액셀러레이터 인프라 선택
  • 조정자 및 배포 옵션 선택
  • 가속기
    • GPU 가속기 정보
    • 일반 GPU
    • 클러스터링된 GPU
  • 성능 최적화 인프라
    • GPU 머신
    • 네트워킹 서비스
      • GPU 네트워킹 개요
      • 배포를 위한 네트워크 서비스
      • 네트워킹 권장사항
    • 스토리지 서비스
  • 오픈 소프트웨어
    • OS 및 Docker 이미지
  • 소비 옵션 선택
  • 클러스터 관리
    • 클러스터 관리 개요
    • 클러스터 관리 구성
  • 용어
  • 시작하기
  • AI 인프라 계획 및 만들기
  • 일반 GPU와 클러스터링된 GPU 중에서 선택
  • 용량 및 할당량 가져오기
    • 개요
    • 용량 예약
    • 예약된 용량 보기
  • 빠른 시작
    • A4 VM으로 완전 관리형 Slurm 클러스터 만들기
    • A4 VM으로 자체 관리형 Slurm 클러스터 만들기
  • 인프라 배포
  • 배포 옵션 개요
  • 압축 배치 정책 및 워크로드 정책 개요
  • AI 최적화 VM 및 클러스터 배포
    • GKE 클러스터 만들기
      • 기본 구성으로 AI에 최적화된 GKE 클러스터 만들기
      • A4X Max를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
      • A4X를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
      • A4 또는 A3 Ultra를 사용하는 맞춤 AI 최적화 GKE 클러스터 만들기
      • A3 Mega 또는 A3 High를 사용하는 GKE Standard 클러스터 만들기
      • A3 Mega 또는 A3 High를 사용하는 GKE Autopilot 클러스터 만들기
    • Slurm 클러스터 만들기
      • 완전 관리형 클러스터 만들기
      • 자체 관리형 클러스터 만들기
    • 인스턴스 만들기
      • A4X Max 만들기
      • A4X 만들기
      • A4 또는 A3 Ultra 만들기
      • A3 High 또는 A3 Mega 만들기
      • A3 Edge 만들기
      • A2 만들기
      • G4 만들기
      • G2 만들기
      • GPU가 포함된 N1 만들기
    • 인스턴스 일괄 생성
      • A4X Max 만들기
      • A4X 만들기
      • A4 또는 A3 Ultra 만들기
      • A3 High 또는 A3 Mega 만들기
      • A3 Edge 만들기
      • A2 만들기
      • G4 만들기
      • G2 만들기
      • GPU가 포함된 N1 만들기
    • 관리형 인스턴스 그룹(MIG) 만들기
      • A4X Max 만들기
      • A4X 만들기
      • A4 또는 A3 Ultra 만들기
      • A3 High 또는 A3 Mega 만들기
      • A3 Edge 만들기
      • A2 만들기
      • G4 만들기
      • G2 만들기
      • GPU가 포함된 N1 만들기
  • 워크로드 실행
  • Cloud에서 Pathways로 워크로드 실행
    • Cloud의 학습 과정 소개
    • 경로로 GKE 클러스터 만들기
    • Pathways로 일괄 워크로드 실행
    • 경로를 사용하여 대화형 워크로드 실행
    • 경로를 사용하여 멀티 호스트 추론 실행
    • 학습 과정을 통한 탄력적인 학습
    • JAX 워크로드를 Pathways로 포팅
    • Pathways on Cloud 문제 해결
  • GKE 워크로드 예약
    • Topology Aware Scheduling (TAS)으로 워크로드 예약
    • 노드 상태 예측 사용 설정
  • Kueue를 사용하여 워크로드 조정
  • AI 워크로드 튜토리얼
    • 개요
    • GPU
      • GKE에서 vLLM으로 추론 실행
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3는
        • GPT-OSS
        • Llama 4
        • Qwen3
      • 미세 조정 실행
        • GKE 클러스터의 Gemma 3
        • 멀티 호스트 GKE 클러스터의 Gemma 3
        • Slurm 클러스터의 Gemma 3
        • GKE의 비전 작업을 위한 Gemma 3
        • Slurm 클러스터의 Llama 4
        • Slurm 클러스터의 Mixtral-8x7b
      • 학습 실행
        • Slurm 클러스터의 Qwen2
    • TPU
      • 워크로드 제공
        • TPU에서 vLLM으로 Qwen2-7B 서빙
        • TPU에서 vLLM으로 Qwen2-7B-Instruct 서빙
        • TPU에서 vLLM으로 Qwen3-8B-Base 서빙
        • TPU에서 vLLM으로 Llama-3.1-8B 서빙
      • 미세 조정 실행
        • MaxText를 사용하여 TPU VM에서 지도 미세 조정 실행
        • MaxText를 사용하여 Qwen3-14b에서 멀티 호스트 지도 미세 조정 실행