Cas d'utilisation de Dataflow

Dataflow est conçu pour accepter les pipelines de traitement par lot et par flux à grande échelle. Dataflow est basé sur le framework Open Source Apache Beam.

Cette page contient des liens vers des tutoriels et des exemples de cas d'utilisation pour vous aider à démarrer.

Transfert de données

Découvrez comment utiliser le générateur de jobs Dataflow pour ingérer des données provenant de catalogues REST Apache Iceberg externes dans des tables gérées Lakehouse.
Découvrez comment utiliser le générateur de jobs Dataflow pour ajouter des fichiers Apache Parquet existants depuis le stockage cloud à une table Apache Iceberg dans Lakehouse.
Ce tutoriel explique comment exécuter un modèle Dataflow qui lit les données de Managed Service pour Apache Kafka et écrit les enregistrements dans une table BigQuery.
Ce tutoriel explique comment exécuter un modèle Dataflow qui lit les messages encodés en JSON à partir de Pub/Sub et les écrit dans une table BigQuery.

Dataflow ML