Ir al contenido principal
Google Cloud Documentation
Áreas tecnológicas
  • IA y aprendizaje automático
  • Desarrollo de aplicaciones
  • Alojamiento de aplicaciones
  • Computación
  • Analíticas y flujos de datos
  • Bases de datos
  • Tecnologías distribuidas, híbridas y multinube
  • IA generativa
  • Soluciones por sector
  • Redes
  • Observabilidad y monitorización
  • Seguridad
  • Storage
Herramientas para varios productos
  • Gestión de accesos y recursos
  • Gestión de costes y uso
  • Infraestructura como código
  • Migración
  • SDK, lenguajes, frameworks y herramientas
/
Consola
  • English
  • Deutsch
  • Español
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
Acceder
  • Data analytics
  • Cloud Dataflow
Empezar gratis
Introducción Guías Dataflow ML Referencia Ejemplos Recursos
Google Cloud Documentation
  • Áreas tecnológicas
    • Más
    • Introducción
    • Guías
    • Dataflow ML
    • Referencia
    • Ejemplos
    • Recursos
  • Herramientas para varios productos
    • Más
  • Consola
  • Descubrir
  • Descripción general del producto
  • Casos prácticos
  • Modelo de programación de Apache Beam
  • Empezar
  • Empezar a usar Dataflow
  • Guías de inicio rápido
    • Usar el creador de tareas
    • Utilizar una plantilla
  • Creación de flujos de procesamiento
  • Introducción
  • Usar Apache Beam
    • Introducción
    • Instalar el SDK de Apache Beam
    • Crear un flujo de procesamiento de Java
    • Crear un flujo de procesamiento de Python
    • Crear un flujo de procesamiento de Go
  • Usar la interfaz de usuario del creador de trabajos
    • Descripción general de la interfaz de usuario de Creador de tareas
    • Crear una tarea personalizada
    • Cargar y guardar archivos YAML de trabajos
    • Usar el editor YAML de creador de trabajos
    • Empaquetar e importar transformaciones
  • Usar plantillas
    • Acerca de las plantillas
    • Ejecutar una plantilla de ejemplo
    • Plantillas proporcionadas por Google
      • Todas las plantillas proporcionadas
      • Crear funciones definidas por el usuario para plantillas
      • Usar certificados SSL con plantillas
      • Cifrar parámetros de plantilla
    • Plantillas Flex
      • Usar plantillas Flex para empaquetar una canalización
      • Ejecutar plantillas Flex
      • Crear y ejecutar una plantilla Flex de ejemplo
      • Imágenes base de plantillas Flex
    • Plantillas clásicas
      • Crear plantillas clásicas
      • Ejecutar plantillas clásicas
  • Usar cuadernos
    • Empezar a usar cuadernos
    • Usar funciones avanzadas de cuaderno
  • Entrada/salida de Dataflow
    • E/S gestionada
    • Prácticas recomendadas de E/S
    • Apache Iceberg
      • Gestión de E/S para Apache Iceberg
      • Lectura de Apache Iceberg
      • Escribir en Apache Iceberg
      • Escritura de streaming en Apache Iceberg con el catálogo REST de BigLake
      • Lectura de CDC de Apache Iceberg con el catálogo REST de BigLake
    • Apache Kafka
      • E/S gestionada para Apache Kafka
      • Leer desde Apache Kafka
      • Escribir en Apache Kafka
      • Usar Managed Service para Apache Kafka
    • BigQuery
      • E/S gestionada para BigQuery
      • Leer desde BigQuery
      • Escribir en BigQuery
    • Bigtable
      • Leer desde Bigtable
      • Escribir en Bigtable
    • Cloud Storage
      • Leer de Cloud Storage
      • Escribir en Cloud Storage
    • Pub/Sub
      • Leer de Pub/Sub
      • Escribir en Pub/Sub
    • Comparativas de rendimiento: Pub/Sub a BigQuery
  • Enriquecer datos
    • Transformación de enriquecimiento
    • Usar Apache Beam y Bigtable para enriquecer datos
    • Usar Apache Beam y BigQuery para enriquecer datos
    • Usar Apache Beam y Vertex AI Feature Store para enriquecer datos
  • Prácticas recomendadas
    • Prácticas recomendadas de Dataflow
    • Prácticas recomendadas para las canalizaciones de lotes grandes
    • Prácticas recomendadas para Pub/Sub a BigQuery
  • Ejecutar flujos de procesamiento
  • Flujos de procesamiento de despliegue
  • Usar Dataflow Runner v2
  • Configurar las opciones del flujo de procesamiento
    • Definir opciones de flujo de procesamiento
    • Referencia de las opciones de flujo de procesamiento
    • Opciones del servicio Dataflow
    • Configurar VMs de trabajador
    • Usar VMs Arm
  • Gestionar dependencias de la canalización
  • Definir el modo de streaming de la canalización
  • Usar aceleradores (GPUs o TPUs)
    • GPUs
      • Información general sobre las GPUs
      • Compatibilidad de Dataflow con GPUs
      • Prácticas recomendadas para GPUs
      • Ejecutar una canalización con GPUs
      • Usar GPUs NVIDIA L4
      • Usar el servicio multiproceso de NVIDIA
      • Procesar imágenes de satélite con GPUs
      • Solucionar problemas con las GPUs
    • TPUs
      • Compatibilidad de Dataflow con las TPUs
      • Ejecutar un flujo de procesamiento con TPUs
      • Guía de inicio rápido: ejecutar Dataflow en TPUs
      • Solucionar problemas de TPUs
  • Usar contenedores personalizados
    • Introducción
    • Crear imágenes de contenedor personalizadas
    • Crear imágenes de contenedor de varias arquitecturas
    • Ejecutar un trabajo de Dataflow en un contenedor personalizado
    • Solucionar problemas con los contenedores personalizados
  • Zonas o países
  • Monitorizar
  • Introducción
  • Panel de control de monitorización de proyectos
  • Personalizar el panel de control de monitorización
  • Monitorizar tareas
    • Lista de tareas
    • Gráficos de tareas
    • Información sobre el paso de la tarea
    • Detalles de ejecución
    • Métricas de tareas
    • Coste estimado
    • Recomendaciones
    • Autoescalado
    • Usa Cloud Monitoring
    • Usar Cloud Profiler
  • Registros
    • Registros de auditoría de Dataflow
    • Registros de auditoría de Data Pipelines
    • Trabajar con registros de canalizaciones
    • Controlar la ingestión de registros
    • Datos de ejemplo de un flujo de procesamiento
  • Ver el linaje de datos
  • Optimizar
  • Usar Streaming Engine en tareas de streaming
  • Shuffle de Dataflow para tareas por lotes
  • Usar el escalado y el reequilibrio automáticos
    • Autoescalado horizontal
    • Ajustar el autoescalado horizontal de streaming
    • Escalado dinámico de hilos
    • Ajuste adecuado
    • Información sobre el restablecimiento dinámico del equilibrio de trabajos