|
所在平台: CourseraArchive 课程类别: 其他类别 大学或机构: CourseraNew |
课程主页: https://www.coursera.org/archive/batch-data-pipelines-gcp-es
课程评论:没有评论
Cómo ejecutar Spark en Cloud Dataproc
Resumen
Por lo general, la canalización de datos se clasifica en uno de los siguientes paradigmas: Extraer-cargar, Extraer-cargar-transformar o Extraer-transformar-cargar. En este curso, se describe cuál es el paradigma que se debe usar y en qué momento usarlo para los datos por lotes. Además, en este curso, se presentan diferentes tecnologías de Google Cloud Platform para la transformación de datos, entre las que se incluyen BigQuery, la ejecución de Spark en Cloud Dataproc, los gráficos de canalización en Cloud Data Fusion y el procesamiento de datos sin servidores mediante Cloud Dataflow. Los participantes obtendrán experiencia práctica sobre cómo compilar los componentes de la canalización de datos en Google Cloud Platform mediante QwikLabs.