|
所在平台: Udemy |
课程主页: https://www.udemy.com/course/apache-spark-y-scala-curso-intensivo-apache-spark/
课程评论:没有评论
课程名称:掌握Apache Spark 2.0与Scala,强化课程 课程概述: 本课程全面覆盖Apache Spark与Scala的基本知识,旨在教授开发Apache Spark应用程序所需的技能。完成该课程后,学员将深入了解Apache Spark与Scala,掌握大数据处理和分析的基本能力,帮助企业或项目利用Apache Spark与Scala构建大数据处理和分析应用程序的管道。 课程内容包括超过10个基于Apache Spark的大数据实践案例,涵盖解决数据分析问题的技巧,案例包括:分析NASA的网页记录、加利福尼亚房地产数据的房价趋势、通过Stack Overflow的调查数据计算不同国家开发者的平均薪资,以及研发系统以了解英国的共享工作空间分布等。 课程学习内容: - 了解Apache Spark架构 - 掌握Spark的核心抽象概念——弹性分布式数据集(RDD) - 使用RDD和Spark SQL开发应用程序 - 通过亚马逊的Elastic MapReduce服务将Spark应用程序扩展到Hadoop YARN集群 - 运用数据集和数据框架分析结构化和半结构化数据,深入理解Spark SQL的工作原理 - 在Apache Spark集群中通过广播变量和累加器共享信息 - 通过分区、缓存和持久化RDD优化和提升Apache Spark作业的性能 - 学习Apache Spark的工作最佳实践 学习Apache Spark的原因: Apache Spark是最新的大数据分析技术之一,其重要性在过去十年中显著提升。Spark允许在集群中进行内存计算,显著提高算法和交互式数据挖掘任务的迭代速度,是大数据处理的新一代引擎。许多公司正在采用Apache Spark来分析海量数据,提高收入和优化流程,因此,掌握Spark已成为大数据工程师和数据科学家的必要技能。 课程编程语言: 本课程基于Scala,Scala是现代功能编程语言中的佼佼者,已在行业内广泛应用于Apache Spark程序的开发。 立即学习如何利用Scala编写Apache Spark程序,解决大数据挑战吧!本课程提供30天无风险退款保证,如不满意可随时申请全额退款。 准备好提升你的大数据技能和职业发展吗?现在就参加本课程吧!
De qué trata este curso:Este curso cubre todos los aspectos fundamentales de Apache Spark con Scala, y te enseña todo lo que necesitas saber sobre el desarrollo de aplicaciones Apache Spark con Scala Spark.Al final de este curso, obtendrás un conocimiento profundo sobre Apache Spark con Scala, así como habilidades generales de manejo y análisis de big data para ayudar a tu empresa o proyecto a adaptar Apache Spark con Scala para la construcción de un pipeline de procesamiento de big data y aplicaciones de análisis de datos.Este curso incluye más de 10 ejemplos prácticos de big data con Apache Spark. Aprenderás a resolver problemas de análisis de datos con Scala Spark. Juntos veremos algunos ejemplos como la agregación de registros web de Apache NASA, desde diferentes fuentes; exploraremos la tendencia de los precios de viviendas analizando los datos de bienes raíces en California (USA); escribiremos aplicaciones Scala Spark para determinar el salario promedio de desarrolladores en diferentes países mediante el análisis de encuestas publicadas por Stack Overflow; también desarrollaremos un sistema que nos permita averiguar cómo los makerspaces o espacios colaborativos, están distribuidos en el Reino Unido, y mucho mucho más. ¿Qué aprenderás en estas clases?En particular, aprenderás:Sobre la arquitectura de Apache Spark.Serás capaz de trabajar con la abstracción principal de Apache Spark, RDDs o conjuntos de datos distribuidos y resilientes (RDD) para procesar y analizar grandes conjuntos de datos.Desarrollar aplicaciones Apache Spark 2.0, utilizando transformaciones y acciones en RDD y Spark SQL.Escalar aplicaciones Spark a un clúster Hadoop YARN a través del servicio Elastic MapReduce de Amazon. Analizar datos estructurados y semiestructurados utilizando conjuntos de datos (Datasets) y Dataframes, y entender a detalle el funcionamiento de Spark SQL.Compartir información a través de diferentes nodos en un clúster de Apache Spark, mediante variables de difusión y acumuladores.Técnicas avanzadas para optimizar y mejorar, trabajos de Apache Spark mediante el particionado, almacenamiento en caché y la persistencia de RDDs.Sobre buenas prácticas de trabajo con Apache Spark.Por qué debes aprender Apache Spark:Apache Spark es una de las últimas tecnologías en análisis de big data. Es también una de las tecnologías más atractivas de la última década debido a su gran impacto en el mundo de big data.Apache Scala Spark, nos permite realizar cálculos en memoria en clústeres, lo cual incrementa de manera significativa la velocidad de iteración de algoritmos y tareas interactivas de minería de datos.Apache Spark es la nueva generación de motores de procesamiento para big data.Muchas compañías están adaptando Apache Spark para interpretar una gran cantidad de datos, que les permite incrementar sus ingresos y mejorar sus procesos, hoy tú tienes está misma tecnología directamente en tu escritorio.Apache Spark es hoy en día una herramienta necesaria para ingenieros de big data y científicos de datos. En que lenguaje de programación se basa este curso?Este curso está basado en Scala. Scala es la nueva generación de lenguajes de programación para programación funcional que cada vez es más popular, y es un de los lenguajes más usados en la industria para escribir programas de Apache Spark.Aprendamos a escribir programas de Apache Spark con Scala para el manejo y solución de problemas de big data hoy!¡30 días de garantía de devolución de dinero! Obtendrás una garantía de devolución de dinero por 30 días de Udemy para este curso. Si no está satisfecho, simplemente solicite un reembolso dentro de los 30 días. Obtendrás un reembolso completo. Sin preguntas en absoluto.¿Estás listo para llevar tus habilidades y tu carrera en big data al siguiente nivel? ¡Toma este curso ahora!