דילוג לתוכן הראשי
תחומים טכנולוגיים
close
AI ו-ML
פיתוח אפליקציות
אירוח אפליקציות
Compute
ניתוח נתונים וצינורות עיבוד נתונים
מסדי נתונים
סביבות מבוזרות, היברידיות ומרובות עננים (multi-cloud)
פתרונות לתעשייה
העברה
קשרים מקצועיים
ניראות ומעקב
אבטחה
Storage
כלים למכפלה וקטורית (cross product)
close
ניהול גישה ומשאבים
ניהול עלויות ושימוש
תשתית כקוד
SDK, שפות, frameworks וכלים
/
מסוף
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
היכנס
AI Hypercomputer
התחלת תקופת ניסיון בחינם
סקירה כללית
מדריכים
משאבים
תחומים טכנולוגיים
עוד
סקירה כללית
מדריכים
משאבים
כלים למכפלה וקטורית (cross product)
עוד
מסוף
Discover
סקירה כללית
בחירת תשתית המאיץ
בחירת כלי תזמור ואפשרות פריסה
מאיצים
מידע על מאיצי GPU
יחידות GPU כלליות
קבוצות של יחידות GPU
תשתית שעברה אופטימיזציה לביצועים
מכונות GPU
שירותים ליצירת קשרים עסקיים
סקירה כללית על רשתות GPU
שירותי רשת לפריסות
שיטות מומלצות לשימוש ברשת
שירותי אחסון
תוכנה פתוחה
קובצי אימג' של מערכת ההפעלה ו-Docker
בחירת אפשרות צריכה
ניהול אשכולות
סקירה כללית בנושא ניהול אשכולות
הגדרות לניהול אשכולות
הסברים על המונחים
מתחילים
תכנון ויצירה של תשתית AI
בחירה בין יחידות GPU כלליות לבין יחידות GPU מקובצות
קבלת מידע על קיבולת ומכסה
סקירה כללית
קיבולת של מכונות שמורות
הצגת הקיבולת שהוזמנה
מדריכים למתחילים
יצירת אשכול Slurm מנוהל מלא עם מכונות וירטואליות מסוג A4
יצירת אשכול Slurm בניהול עצמי עם מכונות וירטואליות מסוג A4
פריסת התשתית
סקירה כללית של אפשרויות הפריסה
סקירה כללית של מדיניות למיקום קומפקטי ומדיניות עומס עבודה
פריסת מכונות וירטואליות ואשכולות שעברו אופטימיזציה ל-AI
יצירת אשכולות GKE
יצירת אשכול GKE שעבר אופטימיזציה ל-AI עם הגדרת ברירת מחדל
יצירת אשכול GKE מותאם אישית שעבר אופטימיזציה באמצעות AI ומשתמש ב-A4X Max
יצירת אשכול GKE מותאם אישית ל-AI שמשתמש ב-A4X
יצירת אשכול GKE מותאם אישית ל-AI שמשתמש ב-A4 או ב-A3 Ultra
יצירת אשכולות GKE Standard שמשתמשים ב-A3 Mega או ב-A3 High
יצירת אשכולות GKE Autopilot שמשתמשים ב-A3 Mega או ב-A3 High
יצירת אשכולות Slurm
יצירת אשכול בניהול מלא
יצירת אשכול בניהול עצמי
יצירת מופע
יצירת קמפיין A4X Max
יצירת A4X
יצירת הדפסה בגודל A4 או A3 Ultra
יצירת A3 High או A3 Mega
יצירת A3 Edge
יצירת A2
יצירת G4
יצירת G2
יצירת מכונת N1 עם מעבדי GPU
יצירת מכונות בכמות גדולה
יצירת קמפיין A4X Max
יצירת A4X
יצירת הדפסה בגודל A4 או A3 Ultra
יצירת A3 High או A3 Mega
יצירת A3 Edge
יצירת A2
יצירת G4
יצירת G2
יצירת מכונת N1 עם מעבדי GPU
יצירה של קבוצת מופעי מכונה מנוהלים (MIG)
יצירת קמפיין A4X Max
יצירת A4X
יצירת הדפסה בגודל A4 או A3 Ultra
יצירת A3 High או A3 Mega
יצירת A3 Edge
יצירת A2
יצירת G4
יצירת G2
יצירת מכונת N1 עם מעבדי GPU
הפעלת עומסי עבודה
הרצת עומסי עבודה באמצעות Pathways on Cloud
מבוא לתוכניות הלימודים ב-Cloud
יצירת אשכול GKE באמצעות Pathways
הרצת עומס עבודה של אצווה באמצעות Pathways
הפעלת עומס עבודה אינטראקטיבי באמצעות Pathways
ביצוע הסקה מרובת מארחים באמצעות Pathways
אימונים גמישים עם Pathways
העברת עומסי עבודה (workloads) של JAX ל-Pathways
פתרון בעיות בתוכניות הלימודים ב-Cloud
תזמון עומסי עבודה ב-GKE
תזמון עומסי עבודה באמצעות תזמון מודע לטופולוגיה (TAS)
הפעלת חיזוי של תקינות הצמתים
שימוש ב-Kueue לתזמור עומסי עבודה
מדריכים לעומסי עבודה של AI
סקירה כללית
GPU
הרצת היקש עם vLLM ב-GKE
DeepSeek V3.1
DeepSeek V3.2-Speciale
Gemma 3
GPT-OSS
Llama 4
Qwen3
הרצת כוונון עדין
Gemma 3 באשכול GKE
Gemma 3 באשכול GKE מרובה-מארחים
Gemma 3 באשכול Slurm
Gemma 3 למשימות ראייה ב-GKE
Llama 4 באשכול Slurm
Mixtral-8x7b באשכול Slurm
אימון ריצה
Qwen2 באשכול Slurm
TPU
הצגת עומסי עבודה
מילוי בקשות של Qwen2-7B עם vLLM ב-TPU
הכניסו לשימוש בסביבת הייצור את Qwen2-7B-Instruct עם vLLM ב-TPU
מילו בקשות של Qwen3-8B-Base עם vLLM ב-TPU
מילו בקשות של Llama-3.1-8B עם vLLM במעבדי TPU
הרצת כוונון עדין
הרצת כוונון מפוקח (SFT) ב-TPU VM באמצעות MaxText
הרצת כוונון עדין מפוקח של Qwen3-14b בכמה מארחים באמצעות MaxText
הפעלת אימון RL במכונה וירטואלית של TPU v6e-8