דילוג לתוכן הראשי
Google Cloud Documentation
תחומים טכנולוגיים
  • ‫AI ו-ML
  • פיתוח אפליקציות
  • אירוח אפליקציות
  • Compute
  • ניתוח נתונים וצינורות עיבוד נתונים
  • מסדי נתונים
  • סביבות מבוזרות, היברידיות ומרובות עננים (multi-cloud)
  • פתרונות לתעשייה
  • העברה
  • קשרים מקצועיים
  • ניראות ומעקב
  • אבטחה
  • Storage
כלים למכפלה וקטורית (cross product)
  • ניהול גישה ומשאבים
  • ניהול עלויות ושימוש
  • תשתית כקוד
  • ‫SDK, שפות, frameworks וכלים
/
מסוף
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
היכנס
  • AI Hypercomputer
התחלת תקופת ניסיון בחינם
סקירה כללית מדריכים משאבים
Google Cloud Documentation
  • תחומים טכנולוגיים
    • עוד
    • סקירה כללית
    • מדריכים
    • משאבים
  • כלים למכפלה וקטורית (cross product)
    • עוד
  • מסוף
  • Discover
  • סקירה כללית
  • בחירת תשתית המאיץ
  • בחירת כלי תזמור ואפשרות פריסה
  • מאיצים
    • מידע על מאיצי GPU
    • יחידות GPU כלליות
    • קבוצות של יחידות GPU
  • תשתית שעברה אופטימיזציה לביצועים
    • מכונות GPU
    • שירותים ליצירת קשרים עסקיים
      • סקירה כללית על רשתות GPU
      • שירותי רשת לפריסות
      • שיטות מומלצות לשימוש ברשת
    • שירותי אחסון
  • תוכנה פתוחה
    • קובצי אימג' של מערכת ההפעלה ו-Docker
  • בחירת אפשרות צריכה
  • ניהול אשכולות
    • סקירה כללית בנושא ניהול אשכולות
    • הגדרות לניהול אשכולות
  • הסברים על המונחים
  • מתחילים
  • תכנון ויצירה של תשתית AI
  • בחירה בין יחידות GPU כלליות לבין יחידות GPU מקובצות
  • קבלת מידע על קיבולת ומכסה
    • סקירה כללית
    • קיבולת של מכונות שמורות
    • הצגת הקיבולת שהוזמנה
  • מדריכים למתחילים
    • יצירת אשכול Slurm מנוהל מלא עם מכונות וירטואליות מסוג A4
    • יצירת אשכול Slurm בניהול עצמי עם מכונות וירטואליות מסוג A4
  • פריסת התשתית
  • סקירה כללית של אפשרויות הפריסה
  • סקירה כללית של מדיניות למיקום קומפקטי ומדיניות עומס עבודה
  • פריסת מכונות וירטואליות ואשכולות שעברו אופטימיזציה ל-AI
    • יצירת אשכולות GKE
      • יצירת אשכול GKE שעבר אופטימיזציה ל-AI עם הגדרת ברירת מחדל
      • יצירת אשכול GKE מותאם אישית שעבר אופטימיזציה באמצעות AI ומשתמש ב-A4X Max
      • יצירת אשכול GKE מותאם אישית ל-AI שמשתמש ב-A4X
      • יצירת אשכול GKE מותאם אישית ל-AI שמשתמש ב-A4 או ב-A3 Ultra
      • יצירת אשכולות GKE Standard שמשתמשים ב-A3 Mega או ב-A3 High
      • יצירת אשכולות GKE Autopilot שמשתמשים ב-A3 Mega או ב-A3 High
    • יצירת אשכולות Slurm
      • יצירת אשכול בניהול מלא
      • יצירת אשכול בניהול עצמי
    • יצירת מופע
      • יצירת קמפיין A4X Max
      • יצירת A4X
      • יצירת הדפסה בגודל A4 או A3 Ultra
      • יצירת A3 High או A3 Mega
      • יצירת A3 Edge
      • יצירת A2
      • יצירת G4
      • יצירת G2
      • יצירת מכונת N1 עם מעבדי GPU
    • יצירת מכונות בכמות גדולה
      • יצירת קמפיין A4X Max
      • יצירת A4X
      • יצירת הדפסה בגודל A4 או A3 Ultra
      • יצירת A3 High או A3 Mega
      • יצירת A3 Edge
      • יצירת A2
      • יצירת G4
      • יצירת G2
      • יצירת מכונת N1 עם מעבדי GPU
    • יצירה של קבוצת מופעי מכונה מנוהלים (MIG)
      • יצירת קמפיין A4X Max
      • יצירת A4X
      • יצירת הדפסה בגודל A4 או A3 Ultra
      • יצירת A3 High או A3 Mega
      • יצירת A3 Edge
      • יצירת A2
      • יצירת G4
      • יצירת G2
      • יצירת מכונת N1 עם מעבדי GPU
  • הפעלת עומסי עבודה
  • הרצת עומסי עבודה באמצעות Pathways on Cloud
    • מבוא לתוכניות הלימודים ב-Cloud
    • יצירת אשכול GKE באמצעות Pathways
    • הרצת עומס עבודה של אצווה באמצעות Pathways
    • הפעלת עומס עבודה אינטראקטיבי באמצעות Pathways
    • ביצוע הסקה מרובת מארחים באמצעות Pathways
    • אימונים גמישים עם Pathways
    • העברת עומסי עבודה (workloads) של JAX ל-Pathways
    • פתרון בעיות בתוכניות הלימודים ב-Cloud
  • תזמון עומסי עבודה ב-GKE
    • תזמון עומסי עבודה באמצעות תזמון מודע לטופולוגיה (TAS)
    • הפעלת חיזוי של תקינות הצמתים
  • שימוש ב-Kueue לתזמור עומסי עבודה
  • מדריכים לעומסי עבודה של AI
    • סקירה כללית
    • GPU
      • הרצת היקש עם vLLM ב-GKE
        • DeepSeek V3.1
        • DeepSeek V3.2-Speciale
        • Gemma 3
        • GPT-OSS
        • Llama 4
        • Qwen3
      • הרצת כוונון עדין
        • ‫Gemma 3 באשכול GKE
        • ‫Gemma 3 באשכול GKE מרובה-מארחים
        • ‫Gemma 3 באשכול Slurm
        • ‫Gemma 3 למשימות ראייה ב-GKE
        • ‫Llama 4 באשכול Slurm
        • ‫Mixtral-8x7b באשכול Slurm
      • אימון ריצה
        • ‫Qwen2 באשכול Slurm
    • TPU
      • הצגת עומסי עבודה
        • מילוי בקשות של Qwen2-7B עם vLLM ב-TPU
        • הכניסו לשימוש בסביבת הייצור את Qwen2-7B-Instruct עם vLLM ב-TPU
        • מילו בקשות של Qwen3-8B-Base עם vLLM ב-TPU
        • מילו בקשות של Llama-3.1-8B עם vLLM במעבדי TPU
      • הרצת כוונון עדין
        • הרצת כוונון מפוקח (SFT) ב-TPU VM באמצעות MaxText
        • הרצת כוונון עדין מפוקח של Qwen3-14b בכמה מארחים באמצעות MaxText
        • הפעלת אימון RL במכונה וירטואלית של TPU v6e-8