|
所在平台: Udemy |
课程主页: https://www.udemy.com/course/master-en-azure-synapse-analytics-para-data-engineers-a-z/
课程评论:没有评论
课程名称:Azure Synapse Analytics 数据工程师硕士课程 [A-Z] 课程概述: 本课程旨在全面教授 Azure Synapse Analytics,这是微软提供的统一数据分析解决方案,结合了数据集成、企业存储和实时分析的能力。通过课程,参与者将学习如何设计和开发端到端的分析解决方案,从数据的摄取和准备到使用 SQL、Spark 和 Power BI 等可视化工具生成洞察。 学习内容: 1. **Azure Synapse Analytics 基础及架构**:了解 Azure Synapse 的概念及其与其他数据分析解决方案的区别,学习数据存储、分布式处理及可视化工具是如何整合到一个平台中的。 2. **Dedicated SQL Pool、Spark Pool 和 Serverless SQL Pool 的创建与管理**:掌握如何使用 Dedicated SQL Pool 处理大型结构化工作负载,使用 Serverless SQL Pool 针对 CSV、TSV、JSON、Parquet 和 Delta 格式的按需查询,探索在 Synapse 中使用 Apache Spark 进行复杂数据处理。 3. **使用 Synapse Pipelines 的数据摄取、转化与调度**:学习如何利用管道和数据流活动从不同来源(如数据库、Azure Data Lake 中的文件、API 或云存储)集成数据,构建可扩展和可重复的数据清理与转化工作流。 4. **与 Power BI 的集成分析与可视化**:了解如何将 Azure Synapse 直接连接至 Power BI,创建基于 Synapse 处理数据的交互式仪表板和报告,构建具有实际价值的分析模型以支持决策。 5. **性能与成本的最佳实践**:学习优化查询性能的技术,有效管理资源使用(如自动扩展),并降低云计算的运营成本,同时掌握在 Synapse 中监控和调试工作负载的方法。 课程主题包括: - 在 Azure 上创建账户 - Azure Synapse Analytics 基础 - Azure Synapse Studio - 项目描述 - “电动汽车” - Serverless SQL Pool - 处理 CSV 和 JSON 文件 - 多文件处理 - 功能与联接 - 数据虚拟化 - 数据摄取与转化阶段 - Synapse Pipeline - Power BI - Spark Pool - Synapse Link (HTAP) - Dedicated SQL Pool - 将课程项目上传至 GitHub 课程强调实践,学员将通过编写代码和命令进行学习,整个过程中将处理多种数据。还将有测验帮助巩固所学知识,并进行各部分的练习。 无论你的知识水平或专业背景如何,这门课程都能帮助你获取新的知识,并在职业发展上有所提升。期待在课程中见到你!
Master en Azure Synapse Analytics para Data Engineers [A-Z]Este curso está diseñado para proporcionar una comprensión completa de Azure Synapse Analytics, la solución unificada de análisis de datos de Microsoft que combina capacidades de integración de datos, almacenamiento empresarial y análisis en tiempo real.A lo largo del curso, los participantes aprenderán a diseñar y desarrollar soluciones analíticas de extremo a extremo, desde la ingesta y preparación de datos hasta la generación de insights utilizando SQL, Spark y herramientas de visualización como Power BI.¿Qué aprenderás?Fundamentos de Azure Synapse Analytics y su arquitecturaComprenderás qué es Azure Synapse y cómo se diferencia de otras soluciones de análisis de datos. Verás cómo se integra el almacenamiento de datos, el procesamiento distribuido y las herramientas de visualización en una sola plataforma. Estudiarás los componentes principales: Synapse Studio, Serverless SQL Pool, Spark Pool y Dedicated SQL Pool, pipelines, y vínculos con servicios externos.Creación y administración de Dedicated SQL Pool, Spark Pool y Serverless SQL PoolAprenderás a trabajar con Dedicated SQL Pool, ideales para cargas de trabajo grandes y estructuradas, y con Serverless SQL Pool, perfectos para consultas bajo demanda en archivos como CSV, TSV, JSON, Parquet y Delta. Además, explorarás el uso de Apache Spark dentro de Synapse para procesamiento paralelo de datos, ideal para tareas de transformación o análisis más complejas.Ingesta, transformación y orquestación de datos con Synapse PipelinesDescubrirás cómo integrar datos desde diferentes fuentes (como bases de datos, archivos en Azure Data Lake, APIs o almacenamiento en la nube) utilizando pipelines y actividades de data flow. Aprenderás a construir flujos de trabajo automatizados para mover, limpiar y transformar datos de forma escalable y repetible.Integración con Power BI para análisis y visualizaciónVerás cómo conectar Azure Synapse directamente con Power BI para crear dashboards e informes interactivos que se alimentan de los datos procesados en Synapse. Aprenderás a construir modelos analíticos que aporten valor real a la toma de decisiones en tu organización.Mejores prácticas en rendimiento y costosAprenderás técnicas para optimizar el rendimiento de consultas, gestionar eficientemente el uso de recursos (como el escalado automático), y reducir costos operativos en la nube. También verás cómo monitorear y depurar cargas de trabajo en Synapse.Los temás que aprenderá en el curso son:Crear una cuenta en AzureAzure Synapse AnalyticsAzure Synapse StudioDescripción del Proyecto - "Vehículos Eléctricos"Serverless SQL PoolTrabajar con Archivos CSVTrabajar con Archivos JSONTrabajar con Múltiples ArchivosFunciones & JoinsData VirtualizationFase "Ingestion"Fase "Transformation"Synapse PipelinePower BISpark PoolSynapse Link (HTAP)Dedicated SQL PoolSubir proyecto del curso a GitHubEste curso es práctico y aprenderás escribiendo código/comandos. Trabajaras con una variedad de Datos a los largo de todo el curso, también se vas a poder realizar cuestionarios para poder reforzas tus conocimientos que vas a ir adquieriendo a lo largo del curso y podrás realizar ejercicios que se plantean en cada sección.Este curso es ideal para tí sin importar el conocimiento o perfil profesional que estes desarrollando, sin duda te ayudará a obtener nuevos conocimientos y crecer profesionalmente.¡Así que te espero en este curso, un fuerte abrazo!