メイン コンテンツにスキップ
テクノロジー分野
close
AI と ML
アプリケーション開発
アプリケーションのホスティング
コンピューティング
データ分析とパイプライン
データベース
分散型クラウド、ハイブリッド クラウド、マルチクラウド
業種別ソリューション
移行
ネットワーキング
オブザーバビリティとモニタリング
セキュリティ
Storage
プロダクト横断型のツール
close
アクセスとリソースの管理
費用と使用量の管理
Infrastructure as code
SDK、言語、フレームワーク、ツール
/
コンソール
English
Deutsch
Español – América Latina
Français
Indonesia
Italiano
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
ログイン
Managed Service for Apache Spark
無料で利用開始
概要
ガイド
リファレンス
サンプル
リソース
テクノロジー分野
その他
概要
ガイド
リファレンス
サンプル
リソース
プロダクト横断型のツール
その他
コンソール
概要
主な概念
Managed Service for Apache Spark サーバーレス
概要
Managed Service for Apache Spark のサーバーレス階層
クラスタ上の Managed Service for Apache Spark
サーバーレス デプロイとクラスタ デプロイを比較する
GKE 上の Managed Service for Apache Spark
使ってみる
サーバーレス
サーバーレス Spark バッチ ワークロードを作成する
クラスタ
クラスタを作成する
クラスタに Spark ジョブを送信する
Spark チュートリアル
Gemini を使用して Spark アプリケーションを開発する
Spark で一般公開データセットを分析する
Spark MLlib を使用した感情分析
GKE
Kubernetes で Spark ジョブを実行する
開発
サーバーレス
サーバーレスを構成する
カスタム コンテナを使用する
GPU を使用する
Dynamic Workload Scheduler を使用する
ネットワークの構成
Spark ランタイム バージョン
概要
Spark ランタイム バージョン 3.0
Spark ランタイム バージョン 2.3
Spark ランタイム バージョン 2.2
Spark ランタイム バージョン 1.2
サービス アカウント
Spark プロパティ
ステージング バケット
バッチ ワークロードとセッションを作成する
サーバーレス Spark バッチ ワークロードを作成する
サーバーレス インタラクティブ セッションとセッション テンプレートを作成する
サーバーレス Spark Connect クライアントを使用する
サーバーレスのバッチ セッションとノートブック セッションで JupyterLab を使用する
サーバーレス テンプレートを使用する
概要
Cloud Spanner to Cloud Storage
Cloud Storage to BigQuery
Cloud Storage to Cloud Spanner
Cloud Storage から Cloud Storage
Cloud Storage から JDBC
Hive から BigQuery へ
Hive to Cloud Storage
JDBC to BigQuery
JDBC to Cloud Spanner
JDBC to Cloud Storage
JDBC から JDBC
Pub/Sub から Cloud Storage
Lakehouse ランタイム カタログでメタデータを使用して Apache Iceberg テーブルを作成する
BigQuery コネクタを Spark と使用する
概要
BigQuery テーブルのクエリ
BigQuery Studio ノートブックで PySpark コードを実行する
最適化する
ワークロード リソースを自動スケーリングする
Spark ワークロードを自動チューニングする
Lightning Engine を使用する
Lightning Engine でバッチ ワークロードとセッションを高速化する
ネイティブ クエリ実行の認定ツールを実行する
サーバーレス Spark ソリューション アクセラレータ
クラスタ
データ処理
Spark を構成する
Spark の依存関係を管理する
Spark 環境をカスタマイズする
同時書き込みを有効にする
Spark のパフォーマンスを向上させる
Spark を調整する
Lightning Engine を使用する
Spark ジョブを実行する
コンソールを使用する
コマンドラインを使用する
REST API Explorer を使用する
クラスタを作成する
Spark ジョブを実行する
クラスタの更新
クラスタの削除
クライアント ライブラリを使用する
Hadoop ジョブを実行する
Spark Scala ジョブの作成と実行
Trino を実行する
Flink を実行する
Hive を実行する
Pig を実行する
HBase を実行する
Python を実行する
Python 環境を構成する
Python 用 Cloud クライアント ライブラリを使用する
データコネクタを使用する
Spark BigQuery コネクタを使用する
概要
BigQuery コネクタのコードサンプル
Cloud Storage コネクタを使用する
Spark Spanner コネクタを使用する
データレイクとレイクハウス
データを探索して抽出する
データの変換
BigQuery へのデータの読み込み
Spark と BigQuery でレイクハウスを作成する
メタストアを構成する
BigLake metastore でメタデータを使用して Apache Iceberg テーブルを作成する
Iceberg を使用する
差分を使用する
Hudi を使用する
データ サイエンス ノートブックと UI
ノートブックを使用する
概要
クラスタで Jupyter ノートブックを実行する
ノートブックでゲノム解析を実行する
JupyterLab 拡張機能を使用してサーバーレス Spark ワークロードを開発する
コンポーネント ゲートウェイを使用する
データソースとストレージ
データソースに接続する
Cloud Storage への接続
BigQuery に接続する
Hive を BigQuery に接続する
Bigtable に接続する
Pub/Sub Lite に接続する
管理とデータ ガバナンス
フリート管理
リネージ
Spark データリネージを有効にする
Hive データリネージを有効にする
クラスタの構成