メイン コンテンツにスキップ
Google Cloud Documentation
テクノロジー分野
  • AI と ML
  • アプリケーション開発
  • アプリケーションのホスティング
  • コンピューティング
  • データ分析とパイプライン
  • データベース
  • 分散型クラウド、ハイブリッド クラウド、マルチクラウド
  • 業種別ソリューション
  • 移行
  • ネットワーキング
  • オブザーバビリティとモニタリング
  • セキュリティ
  • Storage
プロダクト横断型のツール
  • アクセスとリソースの管理
  • 費用と使用量の管理
  • Infrastructure as code
  • SDK、言語、フレームワーク、ツール
/
コンソール
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
ログイン
  • Managed Service for Apache Spark
無料で利用開始
概要 ガイド リファレンス サンプル リソース
Google Cloud Documentation
  • テクノロジー分野
    • その他
    • 概要
    • ガイド
    • リファレンス
    • サンプル
    • リソース
  • プロダクト横断型のツール
    • その他
  • コンソール
  • 概要
  • 主な概念
  • Managed Service for Apache Spark サーバーレス
    • 概要
    • Managed Service for Apache Spark のサーバーレス階層
  • クラスタ上の Managed Service for Apache Spark
  • サーバーレス デプロイとクラスタ デプロイを比較する
  • GKE 上の Managed Service for Apache Spark
  • 使ってみる
  • サーバーレス
    • サーバーレス Spark バッチ ワークロードを作成する
  • クラスタ
    • クラスタを作成する
    • クラスタに Spark ジョブを送信する
    • Spark チュートリアル
      • Gemini を使用して Spark アプリケーションを開発する
      • Spark で一般公開データセットを分析する
      • Spark MLlib を使用した感情分析
  • GKE
    • Kubernetes で Spark ジョブを実行する
  • 開発
  • サーバーレス
    • サーバーレスを構成する
      • カスタム コンテナを使用する
      • GPU を使用する
      • Dynamic Workload Scheduler を使用する
      • ネットワークの構成
      • Spark ランタイム バージョン
        • 概要
        • Spark ランタイム バージョン 3.0
        • Spark ランタイム バージョン 2.3
        • Spark ランタイム バージョン 2.2
        • Spark ランタイム バージョン 1.2
      • サービス アカウント
      • Spark プロパティ
      • ステージング バケット
    • バッチ ワークロードとセッションを作成する
      • サーバーレス Spark バッチ ワークロードを作成する
      • サーバーレス インタラクティブ セッションとセッション テンプレートを作成する
      • サーバーレス Spark Connect クライアントを使用する
      • サーバーレスのバッチ セッションとノートブック セッションで JupyterLab を使用する
      • サーバーレス テンプレートを使用する
        • 概要
        • Cloud Spanner to Cloud Storage
        • Cloud Storage to BigQuery
        • Cloud Storage to Cloud Spanner
        • Cloud Storage から Cloud Storage
        • Cloud Storage から JDBC
        • Hive から BigQuery へ
        • Hive to Cloud Storage
        • JDBC to BigQuery
        • JDBC to Cloud Spanner
        • JDBC to Cloud Storage
        • JDBC から JDBC
        • Pub/Sub から Cloud Storage
    • Lakehouse ランタイム カタログでメタデータを使用して Apache Iceberg テーブルを作成する
    • BigQuery コネクタを Spark と使用する
      • 概要
      • BigQuery テーブルのクエリ
    • BigQuery Studio ノートブックで PySpark コードを実行する
    • 最適化する
      • ワークロード リソースを自動スケーリングする
      • Spark ワークロードを自動チューニングする
      • Lightning Engine を使用する
        • Lightning Engine でバッチ ワークロードとセッションを高速化する
        • ネイティブ クエリ実行の認定ツールを実行する
      • サーバーレス Spark ソリューション アクセラレータ
  • クラスタ
    • データ処理
      • Spark を構成する
        • Spark の依存関係を管理する
        • Spark 環境をカスタマイズする
        • 同時書き込みを有効にする
        • Spark のパフォーマンスを向上させる
        • Spark を調整する
        • Lightning Engine を使用する
      • Spark ジョブを実行する
        • コンソールを使用する
        • コマンドラインを使用する
        • REST API Explorer を使用する
          • クラスタを作成する
          • Spark ジョブを実行する
          • クラスタの更新
          • クラスタの削除
        • クライアント ライブラリを使用する
      • Hadoop ジョブを実行する
      • Spark Scala ジョブの作成と実行
      • Trino を実行する
      • Flink を実行する
      • Hive を実行する
      • Pig を実行する
      • HBase を実行する
      • Python を実行する
        • Python 環境を構成する
        • Python 用 Cloud クライアント ライブラリを使用する
      • データコネクタを使用する
        • Spark BigQuery コネクタを使用する
          • 概要
          • BigQuery コネクタのコードサンプル
        • Cloud Storage コネクタを使用する
        • Spark Spanner コネクタを使用する
    • データレイクとレイクハウス
      • データを探索して抽出する
      • データの変換
      • BigQuery へのデータの読み込み
      • Spark と BigQuery でレイクハウスを作成する
      • メタストアを構成する
      • BigLake metastore でメタデータを使用して Apache Iceberg テーブルを作成する
      • Iceberg を使用する
      • 差分を使用する
      • Hudi を使用する
    • データ サイエンス ノートブックと UI
      • ノートブックを使用する
        • 概要
        • クラスタで Jupyter ノートブックを実行する
        • ノートブックでゲノム解析を実行する
        • JupyterLab 拡張機能を使用してサーバーレス Spark ワークロードを開発する
      • コンポーネント ゲートウェイを使用する
    • データソースとストレージ
      • データソースに接続する
      • Cloud Storage への接続
      • BigQuery に接続する
      • Hive を BigQuery に接続する
      • Bigtable に接続する
      • Pub/Sub Lite に接続する
    • 管理とデータ ガバナンス
      • フリート管理
      • リネージ
        • Spark データリネージを有効にする
        • Hive データリネージを有効にする
    • クラスタの構成