Big Data - Processamento de dados com Spark e PySpark

所在平台: Udemy

课程主页: https://www.udemy.com/course/big-data-com-apache-spark-e-pyspark/

课程评论:没有评论

第一个写评论        关注课程

课程简介

Coursera 课程《大数据 - 使用 Spark 和 PySpark 进行数据处理》旨在帮助您轻松掌握大数据技术。课程从零开始,深入浅出地解释什么是大数据,以及如何对其进行分类。 课程将介绍 Hadoop 等大数据技术,并指导您在 Windows 系统上安装和配置 Apache Spark。无论您是 Windows 用户还是 Linux 用户,课程都会提供清晰的说明。 您将学习环境变量的作用,以及它们如何影响 Java 和 JVM 等软件的安装和配置。课程还将详细讲解 Spark 的核心概念,包括 MapReduce、RDD 和 DataFrame,并教授如何使用 Spark SQL 进行数据分析。 此外,课程会提供一个包含所有必要软件和脚本的专属驱动器,并附上官方下载链接。 通过本课程,您将能够自信地处理海量数据。

课程评论(0条)

课程详情

Não se assuste mais com as tecnologias de Big Data! Aprenda o essêncial para processar grandes quantidades de dados em memória com o melhor Framework do mercado: O Apache Spark!Iniciaremos do zero, explicando o que é Big Data e o que é necessário para que um dado seja categorizado como tal. Tudo de forma simples, com uma linguagem leve e agradável! Após nos situarmos entre as tecnologias explicadas, dentre elas, o Hadoop, criaremos um servidor Apache Spark em uma instalação Windows e então prosseguiremos o curso explicando todo o framework e analisando dados. Vale ressaltar que instalaremos o Spark no Windows para os usuários menos experientes. Caso você seja usuário Linux, não se preocupe: Os comandos são os mesmos!Explicaremos detalhadamente o que são as variáveis de ambiente e como elas influenciam na instalação e configuração de programas, como por exemplo o Java e a sua máquina virtual, a JVM.Aplicaremos Map Reduce e outras funções nativas do Spark, utilizaremos o Spark SQL, criaremos RDDs e os novos Dataframes! Tudo isso do zero, passo a passo, explicado com que você já conhece!Preocupado com os softwares? Você terá um drive com todos os programas e scripts do curso, exlusivo para o nosso material, além de, é claro, também ter os links oficiais, caso deseje baixar os programs direto do fabricante!E aí? Curtiu a ementa?Vem comigo aprender a processar Big Data!!

课程标签

0人关注该课程

主题相关的课程