Big Data y Spark: ingeniería de datos con Python y pyspark

所在平台: Udemy

课程主页: https://www.udemy.com/course/big-data-y-spark-ingenieria-de-datos-con-python-y-pyspark/

课程评论:没有评论

第一个写评论        关注课程

课程简介

**课程名称:** Big Data y Spark: ingeniería de datos con Python y pyspark **课程概述:** 本课程旨在教授学员如何使用Python的PySpark库在Google Colaboratory中操作Spark。Spark是一个分布式系统,专为高效、快速地处理海量数据而设计。课程将重点讲解Spark的核心抽象概念:RDDs(弹性分布式数据集)和DataFrames。 无论您是Spark新手还是希望巩固已有知识,本课程都将为您提供一个循序渐进的学习路径,帮助您掌握Spark RDDs和DataFrames的主要操作和核心技能。此外,课程还将深入探讨高级主题,助您优化Spark应用程序的性能。 课程内容从Big Data和Spark的入门介绍开始,随后指导学员在Google Colaboratory中安装和配置Spark环境,使您能够立即开始运行Spark Notebooks。接下来的部分将深入讲解Spark RDDs和DataFrames的理论知识并结合实践应用。 课程采用分模块、分章节的学习方式,便于学员快速定位所需内容。大多数章节都包含理论讲解和实践操作两部分。 **讲师:** José Miguel Moya,资深数据工程师,日常工作中使用Spark(Python和Scala)处理海量数据。 **讲师寄语:** 欢迎观看课程介绍视频和免费课程。期待在课程中与您相遇!

课程评论(0条)

课程详情

Bienvenidos al curso Big Data y Spark: ingeniería de datos con Python y pyspark.En este curso aprenderás a trabajar con Spark a través de la librería PySpark de Python en Google Colaboratory.Spark es esencialmente un sistema distribuido que fue diseñado para procesar un gran volumen de datos de manera eficiente y rápida. El objetivo de este curso es aprender a trabajar con las principales abstracciones de Spark, las cuales son los RDDs y los DataFrames.El material que proponemos en el curso está pensado para todas las personas que bien deseen iniciarse en el trabajo con Spark, o que por otro lado, deseen consolidar los conocimientos que ya poseen sobre los temas que se abordarán. El curso está diseñado de una forma progresiva y gradual que le permitirá al estudiante entender y desarrollar las principales habilidades para el trabajo con RDDs y DataFrames en Spark. Además, se abordarán temas avanzados que le permitirán optimizar las aplicaciones de Spark que pueda construir en un futuro, o bien, mejorar aquellas que ya se tengan implementadas.Empezamos el curso con una breve introducción al Big Data y a Spark. Posteriormente continuamos con una sección en donde los guiaremos para que instalen y configuren Spark en Google Colaboratory. Una vez hayan concluido esta sección, estarán en condiciones de ejecutar notebooks en Colaboratory utilizando Spark. Las siguientes secciones del curso están pensadas para entender y aplicar en la práctica las principales cuestiones sobre los RDDs y los DataFrames.El temario procura en todo momento analizar temas específicos por cada lección, permitiéndole así al estudiante localizar rápidamente cualquier contenido de una forma rápida. La mayoría de las lecciones están conformadas por una parte teórica y otra práctica.Mi nombre es José Miguel Moya y me desempeño actualmente como Ingeniero de Datos Senior. Como parte de mi trabajo diario utilizo Spark con Python y Scala para obtener y procesar enormes cantidades de datos.Te invito a que veas el video de presentación del curso y las lecciones gratuitas.Te espero en el curso, tenga usted un cordial saludo.

课程标签

0人关注该课程

主题相关的课程