|
所在平台: Udemy |
课程主页: https://www.udemy.com/course/python-web-scraping/
课程评论:没有评论
课程名称:Python网络爬虫 课程简介:本课程旨在教授使用Python进行网页抓取和爬行的技术,以便从网络上的任何来源和格式访问数据。课程内容包括编写Python脚本和使用API,同时收集和处理来自成千上万网页的数据。 学习要点: - 分析HTML页面,存储抓取的数据,追踪表单和登录信息,识别网站中的信息和技术。 - 理解和应用正则表达式。 - 学习使用辅助抓取的库,如BeautifulSoup、LXML和Scrapy。 - 编写程序读取多种文档格式,如CSV、PDF、DOCX、XLSX、JSON和ODT。 - 进行数据清洗。 - 使用Selenium WebDriver进行自动化任务。 注意:本课程正在进行中,将持续更新新课程内容!
AVISO: O CURSO ESTÁ EM ANDAMENTO, SEMPRE TEREMOS NOVAS AULAS!!!!Neste curso você aprenderá técnicas de web scraping e web crawling com Python para acessar dados à partir de qualquer fonte na Web e em qualquer formato.Aprenderá a criar scripts em Python e a usar APIs para coletar e processar dados de milhares de páginas Web ao mesmo tempo.Aprenderá a analisar páginas HTML, armazenar os dados coletados, rastrear formulários e logins, identificar informações e tecnologias utilizadas em um site.Aprenderá sobre expressões regulares.Aprenderá sobre bibliotecas que vão lhe auxiliar nas tarefas de scraping como BeautifulSoup, LXML e Scrapy.Aprenderá a criar programas para ler diversos tipos de documentos como CSV, PDF, DOCX, XLSX, JSON e ODT.Aprenderá a realizar limpeza dos dados.Aprenderá a utilizar o Selenium WebDriver.