|
所在平台: Udemy |
课程主页: https://www.udemy.com/course/aws-glue-studio/
课程评论:没有评论
课程名称:AWS Glue Studio - 无服务器 ETL 框架 概述:本课程专注于 AWS Glue Studio,这是一个无服务器的数据集成服务,使数据发现、准备和组合变得简单,以便进行分析、机器学习和应用开发。AWS Glue 提供了完成数据集成功能所需的一切,从而使您能够在几分钟内开始分析数据并投入使用,而不是几个月。 本课程适合以下人员: - ETL 开发人员 - 数据工程师 - ETL 架构师 - 数据迁移专家 - 数据库管理员 - 数据库开发人员 数据集成是为分析、机器学习和应用开发而准备和组合数据的过程。它涉及多个任务,如发现和提取来自各种源的数据;丰富、清理、标准化和组合数据;以及将数据加载和组织到数据库、数据仓库和数据湖中。这些任务通常由不同类型的用户处理,他们使用不同的产品。 AWS Glue 支持以下数据源: - 数据存储 - Amazon S3 - Amazon 关系数据库服务 (RDS) - 第三方 JDBC 可访问数据库 - Amazon DynamoDB - MongoDB 和与 MongoDB 兼容的 Amazon DocumentDB - 数据流 - Amazon Kinesis 数据流 - Apache Kafka AWS Glue Studio 是一个新的图形界面,使您可以轻松创建、运行和监控 AWS Glue 中的提取、转换和加载 (ETL) 作业。您可以直观地构建数据转换工作流,并在 AWS Glue 的基于 Apache Spark 的无服务器 ETL 引擎上无缝运行它们。您可以检查作业每个步骤中的架构和数据结果。
This course is about AWS Glue Studio - A Server less ETL Framework. AWS Glue is a server less data integration service that makes it easy to discover, prepare, and combine data for analytics, machine learning, and application development. AWS Glue provides all the capabilities needed for data integration so that you can start analyzing your data and putting it to use in minutes instead of months.This course is useful for,ETL DevelopersData EngineersETL ArchitectsData Migration SpecialistsDatabase AdministratorsDatabase Developers Data integration is the process of preparing and combining data for analytics, machine learning, and application development. It involves multiple tasks, such as discovering and extracting data from various sources; enriching, cleaning, normalizing, and combining data; and loading and organizing data in databases, data warehouses, and data lakes. These tasks are often handled by different types of users that each use different products.AWS Glue supports the following data sources:¤Data stores¤Amazon S3¤Amazon Relational Database Service (Amazon RDS)¤Third-party JDBC-accessible databases¤Amazon DynamoDB¤MongoDB and Amazon DocumentDB (with MongoDB compatibility)¤Data streams¤Amazon Kinesis Data Streams¤Apache Kafka AWS Glue Studio is a new graphical interface that makes it easy to create, run, and monitor extract, transform, and load (ETL) jobs in AWS Glue. You can visually compose data transformation workflows and seamlessly run them on AWS Glue's Apache Spark-based server less ETL engine. You can inspect the schema and data results in each step of the job.