Cas d'utilisation de Dataflow
Dataflow est conçu pour accepter les pipelines de traitement par lot et par flux à grande échelle. Dataflow est basé sur le framework Open Source Apache Beam.
Cette page contient des liens vers des tutoriels et des exemples de cas d'utilisation pour vous aider à démarrer.
Transfert de données
Ingérer des données à partir de tables Apache Iceberg dans Lakehouse
Découvrez comment utiliser le générateur de jobs Dataflow pour ingérer des données provenant de catalogues REST Apache Iceberg externes dans des tables gérées Lakehouse.
Importer des fichiers Parquet depuis le stockage vers Lakehouse
Découvrez comment utiliser le générateur de jobs Dataflow pour ajouter des fichiers Apache Parquet existants depuis le stockage cloud à une table Apache Iceberg dans Lakehouse.
Traiter des données de Kafka vers BigQuery
Ce tutoriel explique comment exécuter un modèle Dataflow qui lit les données de Managed Service pour Apache Kafka et écrit les enregistrements dans une table BigQuery.
Traiter des données de Pub/Sub vers BigQuery
Ce tutoriel explique comment exécuter un modèle Dataflow qui lit les messages encodés en JSON à partir de Pub/Sub et les écrit dans une table BigQuery.