メイン コンテンツにスキップ
Google Cloud Documentation
テクノロジー分野
  • AI と ML
  • アプリケーション開発
  • アプリケーションのホスティング
  • コンピューティング
  • データ分析とパイプライン
  • データベース
  • 分散型クラウド、ハイブリッド クラウド、マルチクラウド
  • 生成 AI
  • 業種別ソリューション
  • ネットワーキング
  • オブザーバビリティとモニタリング
  • セキュリティ
  • Storage
プロダクト横断型のツール
  • アクセスとリソースの管理
  • 費用と使用量の管理
  • Infrastructure as code
  • 移行
  • SDK、言語、フレームワーク、ツール
/
コンソール
  • English
  • Deutsch
  • Español
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
ログイン
  • Cloud Dataflow
無料で利用開始
概要 ガイド Dataflow ML リファレンス サンプル リソース
Google Cloud Documentation
  • テクノロジー分野
    • その他
    • 概要
    • ガイド
    • Dataflow ML
    • リファレンス
    • サンプル
    • リソース
  • プロダクト横断型のツール
    • その他
  • コンソール
  • Discover
  • サービスの概要
  • 使用例
  • Apache Beam のプログラミング モデル
  • 使ってみる
  • Dataflow を使ってみる
  • クイックスタート
    • ジョブビルダーを使用する
    • テンプレートを使用する
  • パイプラインを構築する
  • 概要
  • Apache Beam を使用する
    • 概要
    • Apache Beam SDK をインストール
    • Java パイプラインを作成する
    • Python パイプラインを作成する
    • Go パイプラインを作成する
  • ジョブビルダー UI を使用する
    • ジョブビルダー UI の概要
    • カスタムジョブを作成する
    • ジョブ YAML ファイルを読み込みで保存する
    • ジョブビルダーの YAML エディタを使用する
    • 変換のパッケージ化とインポート
  • テンプレートを使用する
    • テンプレートについて
    • サンプル テンプレートを実行する
    • Google 提供のテンプレート
      • 提供されたすべてのテンプレート
      • テンプレートにユーザー定義関数を作成する
      • テンプレートで SSL 証明書を使用する
      • テンプレート パラメータを暗号化する
    • Flex テンプレート
      • Flex テンプレートを使用してパイプラインをパッケージ化する
      • Flex テンプレートを実行する
      • サンプル Flex テンプレートをビルドして実行する
      • Flex テンプレートのベースイメージ
    • クラシック テンプレート
      • クラシック テンプレートを作成する
      • クラシック テンプレートを実行する
  • ノートブックを使用する
    • ノートブックを使ってみる
    • 高度なノートブック機能を使用する
  • Dataflow I/O
    • マネージド I/O
    • I/O のベスト プラクティス
    • Apache Iceberg
      • Managed I/O for Apache Iceberg
      • Apache Iceberg から読み取る
      • Apache Iceberg に書き込む
      • BigLake REST カタログを使用した Apache Iceberg へのストリーミング書き込み
      • BigLake REST カタログを使用した Apache Iceberg からの CDC 読み取り
    • Apache Kafka
      • Managed I/O for Apache Kafka
      • Apache Kafka から読み取る
      • Apache Kafka に書き込む
      • Managed Service for Apache Kafka を使用する
    • BigQuery
      • Managed I/O for BigQuery
      • BigQuery から読み取る
      • BigQuery への書き込み
    • Bigtable
      • Bigtable から読み取る
      • Bigtable に書き込む
    • Cloud Storage
      • Cloud Storage から読み取る
      • Cloud Storage への書き込み
    • Pub/Sub
      • Pub/Sub から読み取る
      • Pub/Sub に書き込む
  • データを拡充する
    • 拡充変換
    • Apache Beam と Bigtable を使用してデータを拡充する
    • Apache Beam と BigQuery を使用してデータを拡充する
    • Apache Beam と Vertex AI Feature Store を使用してデータを拡充する。
  • おすすめの方法
    • Dataflow のベスト プラクティス
    • 大規模バッチ パイプラインのベスト プラクティス
    • Pub/Sub から BigQuery への書き込みのベスト プラクティス
  • パイプラインを実行する
  • パイプラインをデプロイする
  • Dataflow Runner v2 を使用する
  • パイプライン オプションを構成する
    • パイプライン オプションを設定する
    • パイプライン オプションのリファレンス
    • Dataflow サービス オプション
    • ワーカー VM を構成する
    • Arm VM を使用する
  • パイプラインの依存関係を管理する
  • パイプライン ストリーミング モードを設定する
  • アクセラレータ(GPU / TPU)を使用する
    • GPU
      • GPU の概要
      • Dataflow での GPU のサポート
      • GPU のベスト プラクティス
      • GPU を使用してパイプラインを実行する
      • NVIDIA L4 GPU を使用する
      • NVIDIA マルチ プロセッシング サービスを使用する
      • GPU を使用して衛星画像を処理する
      • GPU のトラブルシューティング
    • TPU
      • Dataflow での TPU のサポート
      • TPU を使用してパイプラインを実行する
      • クイックスタート: TPU で Dataflow を実行する
      • TPU のトラブルシューティング
  • カスタム コンテナを使用する
    • 概要
    • カスタム コンテナ イメージをビルドする
    • マルチアーキテクチャ コンテナ イメージを構築する
    • カスタム コンテナで Dataflow ジョブを実行する
    • カスタム コンテナのトラブルシューティング
  • Regions
  • モニタリング
  • 概要
  • プロジェクト モニタリング ダッシュボード
  • モニタリング ダッシュボードをカスタマイズする
  • ジョブをモニタリングする
    • ジョブリスト
    • ジョブグラフ
    • ジョブステップ情報
    • 実行の詳細
    • ジョブの指標
    • 推定料金
    • 推奨事項
    • 自動スケーリング
    • Cloud Monitoring を使用する
    • Cloud Profiler を使用する
  • ロギング
    • Dataflow の監査ロギング
    • Data Pipelines の監査ロギング
    • パイプライン ログを操作する
    • ログの取り込みを制御する
    • パイプライン データの例
  • データリネージを表示する
  • 最適化する
  • ストリーミング ジョブに Streaming Engine を使用する
  • バッチジョブの Dataflow Shuffle
  • 自動スケーリングと再調整を使用する
    • 水平自動スケーリング
    • ストリーミングの水平自動スケーリングを調整する
    • Dynamic Thread Scaling
    • Right Fitting
    • 動的作業再調整について
    • Dataflow Prime を使用する
      • Dataflow Prime について
      • 垂直自動スケーリング
  • Dataflow 分析情報を使用する
  • 柔軟なリソース スケジューリングを使用する
  • Compute Engine 予約を使用する
  • 費用の最適化
  • 管理
  • パイプラインの更新
    • アップグレード ガイド
    • ストリーミング パイプラインを更新する
  • 実行中のパイプラインを停止する
  • リクエストの割り当て
  • プロジェクト間でジョブを移行する
  • Dataflow スナップショットを使用する
  • データ パイプラインを操作する
  • Eventarc を使用して Dataflow ジョブを管理する
  • アクセスを制御する
  • Authentication
  • Dataflow のロールと権限
  • セキュリティと権限
  • ネットワークを指定する
  • インターネット アクセスとファイアウォール ルールを構成する
  • 顧客管理の暗号鍵を使用する
  • カスタム制約を使用する
  • Dataflow 開発ガイド
  • データ パイプラインを計画する
  • パイプラインのライフサイクル
  • パイプラインを開発してテストする
  • パイプライン ワークフローを設計する
  • ストリーミング パイプラインでのデータ表現
  • exactly-once 処理
  • Dataflow ワークロードの例
  • 機械学習
    • Python ML チュートリアル
    • ストリーミング パイプラインで LLM を実行する
  • e コマース
    • e コマースのストリーミング パイプラインを作成する
    • Java タスクパターン
  • Apache Kafka から BigQuery にストリーミングする
  • Pub/Sub から BigQuery へのストリーミング
  • HPC の高度な並列処理のワークロード
    • 概要
    • Dataflow での HPC の高度な並列処理について
    • おすすめの方法
    • チュートリアル
  • リファレンス パターン
  • MapReduce から移行する
  • トラブルシューティング
  • パイプラインのトラブルシューティング
  • ストリーミング パイプラインのトラブルシューティング
    • ストリーミング ジョブの処理速度が遅い場合や停止している場合のトラブルシューティング
    • ストリーミング ジョブでのストラグラーのトラブルシューティング
    • ボトルネックのトラブルシューティング
    • ストリーミング パイプラインのアップグレードのトラブルシューティング
  • バッチ パイプラインのトラブルシューティング
    • バッチジョブの処理速度が遅い場合や停止している場合のトラブルシューティング
    • バッチジョブでのストラグラーのトラブルシューティング
  • メモリ不足エラーのトラブルシューティング
  • 権限のトラブルシューティング
  • ネットワークのトラブルシューティング
  • Flex テンプレートのトラブルシューティング
  • 水平自動スケーリングのトラブルシューティング
  • エラーとエラーコード
    • 入力と出力のエラーコード
    • 一般的な Dataflow エラー
  • AI と ML
  • アプリケーション開発
  • アプリケーションのホスティング
  • コンピューティング
  • データ分析とパイプライン
  • データベース
  • 分散型クラウド、ハイブリッド クラウド、マルチクラウド
  • 生成 AI
  • 業種別ソリューション
  • ネットワーキング
  • オブザーバビリティとモニタリング