Passa ai contenuti principali
Google Cloud Documentation
Aree tecnologiche
  • AI e ML
  • Sviluppo di applicazioni
  • Hosting di applicazioni
  • Computing
  • Analisi dei dati e pipeline
  • Database
  • Distribuito, ibrido e multi-cloud
  • Soluzioni di settore
  • Migrazione
  • Networking
  • Osservabilità e monitoraggio
  • Sicurezza
  • Storage
Strumenti per più prodotti
  • Gestione di accessi e risorse
  • Gestione di costi e utilizzo
  • Infrastructure as Code (IaC)
  • SDK, linguaggi, framework e strumenti
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Accedi
  • Managed Service for Apache Spark
Inizia gratuitamente
Panoramica Guide Riferimento Esempi Risorse
Google Cloud Documentation
  • Aree tecnologiche
    • Altro
    • Panoramica
    • Guide
    • Riferimento
    • Esempi
    • Risorse
  • Strumenti per più prodotti
    • Altro
  • Console
  • Panoramica
  • Concetti chiave
  • Managed Service for Apache Spark serverless
    • Panoramica
    • Livelli serverless di Managed Service for Apache Spark
  • Managed Service for Apache Spark sui cluster
  • Confrontare i deployment serverless e dei cluster
  • Managed Service for Apache Spark su GKE
  • Per iniziare
  • Serverless
    • Crea un carico di lavoro batch Spark serverless
  • Cluster
    • Crea un cluster
    • Invia un job Spark a un cluster
    • Tutorial di Spark
      • Utilizzare Gemini per sviluppare applicazioni Spark
      • Analizzare set di dati pubblici con Spark
      • Analisi del sentiment con Spark MLlib
  • GKE
    • Esegui un job Spark su Kubernetes
  • Sviluppo
  • Serverless
    • Configura serverless
      • Utilizzo di container personalizzati
      • Utilizzare le GPU
      • Utilizzare Dynamic Workload Scheduler
      • Configurazione di rete
      • Versioni del runtime Spark
        • Panoramica
        • Versione runtime Spark 3.0
        • Versione runtime Spark 2.3
        • Versione runtime Spark 2.2
        • Versione runtime Spark 1.2
      • Service account
      • Proprietà Spark
      • Bucket di gestione temporanea
    • Crea batch di workload e sessioni
      • Crea un carico di lavoro batch Spark serverless
      • Crea sessioni interattive serverless e modelli di sessione
      • Utilizza il client Spark Connect serverless
      • Utilizza JupyterLab per sessioni batch e del notebook serverless
      • Utilizzare i modelli serverless
        • Panoramica
        • Da Cloud Spanner a Cloud Storage
        • Da Cloud Storage a BigQuery
        • Da Cloud Storage a Cloud Spanner
        • Da Cloud Storage a Cloud Storage
        • Cloud Storage to JDBC
        • Hive to BigQuery
        • Da Hive in Cloud Storage
        • JDBC to BigQuery
        • JDBC in Cloud Spanner
        • JDBC to Cloud Storage
        • Da JDBC a JDBC
        • Da Pub/Sub a Cloud Storage
    • Crea una tabella Apache Iceberg con metadati nel catalogo di runtime di Lakehouse
    • Utilizzo del connettore BigQuery con Spark
      • Panoramica
      • Esegui query sulle tabelle BigQuery
    • Esegui codice PySpark nei notebook BigQuery Studio
    • Ottimizza
      • Scalare automaticamente le risorse del workload
      • Ottimizzare automaticamente i workload Spark
      • Utilizzare Lightning Engine
        • Accelerare i workload e le sessioni batch con Lightning Engine
        • Esegui lo strumento di qualificazione dell'esecuzione di query native
      • Acceleratori di soluzioni Spark serverless
  • Cluster
    • Trattamento dati
      • Configura Spark
        • Gestire le dipendenze di Spark
        • Personalizzare l'ambiente Spark
        • Abilita scritture simultanee
        • Migliorare le prestazioni di Spark
        • Tune Spark
        • Utilizzare Lightning Engine
      • Esegui job Spark
        • Utilizza la console
        • Utilizza la riga di comando
        • Utilizza Explorer API REST
          • Crea un cluster
          • Esegui un job Spark
          • Aggiorna un cluster
          • Elimina un cluster
        • Utilizzo delle librerie client
      • Esegui job Hadoop
      • Scrittura ed esecuzione di job Spark Scala
      • Esegui Trino
      • Esegui Flink
      • Esecuzione di Run Hive
      • Run Pig
      • Esegui HBase
      • Esegui Python
        • Configura l'ambiente Python
        • Utilizzare le librerie client di Cloud per Python
      • Utilizzare i connettori dati
        • Utilizzare il connettore Spark BigQuery
          • Panoramica
          • Esempi di codice del connettore BigQuery
        • Utilizzare il connettore Cloud Storage
        • Utilizzare il connettore Spark Spanner
    • Data lake e lake house
      • Esplorare ed estrarre i dati
      • Trasformazione dei dati
      • Caricare dati in BigQuery
      • Crea un lake house con Spark e BigQuery
      • Configura i metastore
      • Crea una tabella Apache Iceberg con metadati in BigLake Metastore
      • Utilizzare Iceberg
      • Utilizza Delta
      • Utilizzare Hudi
    • Notebook e UI di data science
      • Utilizzare i notebook
        • Panoramica
        • Esecuzione di un notebook Jupyter su un cluster
        • Eseguire un'analisi genomica su un notebook
        • Utilizza l'estensione JupyterLab per sviluppare carichi di lavoro Spark serverless
      • Utilizzare il gateway dei componenti
    • Origini dati e archiviazione
      • Connettersi alle origini dati
      • Connettersi a Cloud Storage
      • Connessione a BigQuery
      • Connettere Hive a BigQuery
      • Connettiti a Bigtable
      • Connettersi a Pub/Sub Lite
    • Amministrazione e governance dei dati
      • Gestione del parco risorse
      • Derivazione
        • Abilitare la derivazione dei dati Spark
        • Abilita la derivazione dei dati Hive
    • Configura i cluster
      • Componenti
        • Panoramica
        • Delta Lake
        • Docker
        • Flink
        • HBase
        • Hive WebHCat
        • Hudi
        • Iceberg
        • Jupyter
        • Pig
        • Presto
        • Ranger
          • Installazione di Ranger
          • Utilizzare Ranger
            • Utilizzare Ranger con Kerberos
            • Utilizzare Ranger con la memorizzazione nella cache e la riduzione dell'ambito
            • Esegui il backup e ripristina uno schema Ranger
        • Solr
        • Trino
        • Zeppelin
        • Zookeeper
      • Immagini del cluster