Spark avec Scala - Pratique avec le Big Data pour Débutants

所在平台: Udemy

课程主页: https://www.udemy.com/course/spark-avec-scala-pratique-avec-le-big-data-pour-debutants/

课程评论:没有评论

第一个写评论        关注课程

课程简介

**课程名称:** Spark avec Scala - Pratique avec le Big Data pour Débutants (Spark与Scala - 大数据实践入门) **课程概述:** 本课程将教授Apache Spark,这是一个广泛应用于各大科技和工业巨头的开源框架,用于分析和处理海量结构化、半结构化和非结构化数据。Spark通过内存计算和分布式计算加速处理,并能在集群中利用多台机器进行工作。 **课程内容亮点:** * **环境搭建:** 仅需一台联网电脑,学习如何在虚拟机(Linux)中搭建本地环境,下载并配置Spark和Scala。 * **Spark与Scala基础:** 深入理解Spark核心原理,学习其主要编程语言Scala,并提供Scala编程语言的平滑过渡以及函数式编程入门。 * **RDD操作:** 轻松掌握Spark核心组件RDD(Resilient Distributed Datasets)及其对数据集的操作。 * **Spark SQL与DataFrame:** 学习使用DataFrame,可从数据集集合、CSV、JSON、Parquet文件以及PostgreSQL数据库中读取和操作数据。 * **Spark Streaming:** 详细介绍实时数据处理技术Spark Streaming,并通过实际案例提升学员技能。 **适用人群:** 大数据入门者,希望学习Spark框架和Scala编程以处理海量数据、进行实时数据分析的学员。

课程评论(0条)

课程详情

Sans aucun doute Apache Spark est le framework open source qui a montré sa réussite auprès de plusieurs géant de l'informatique et de l'industrie. Apache Spark nous permet d'analyser et traiter des données massives structurées, semi structurées et non structurées.Apache Spark fonctionne avec de la programmation distribuée et en mémoire (in-memory) afin d'accélérer les traitements et en s'appuyant sur plusieurs machines d'un réseau ( Cluster ).Dans cette formation vous aurez besoin uniquement d'un PC connecté à internet. Vous allez apprendre à mettre en place un environnement local avec une machine Virtuelle Linux (VM), télécharger Spark, télécharger Scala et la configuration de Spark en utilisant Scala.Vous allez vous familiariser avec les principes fondamentaux de Spark en utilisant le langage Scala. Apache Spark est écrit en Scala. Il fonctionne en Java virtuel machines (JVM). Vous aurez une mise à niveau en douceur avec le langage de programmation Scala avec une initiation à la programmation fonctionnelle.Manipuler un RDD (le caur moteur de Apache Spark) avec des collections de données sera un jeux d'enfant.Vous allez découvrir dans la partie Spark SQL les DataFrame à partir:d'une collection de données,des fichiers en entrée tel que csv, Json, Parquetde base de données PostgreSQLSurement vous avez entendu parler des traitements des données qui arrivent en temps réel, sous le nom Streaming. Une Partie de cette formation bien détaillée vous attend afin que vous puissiez monter en compétence rapidement avec Spark Streaming avec des cas pratiques.

课程标签

0人关注该课程

主题相关的课程