|
所在平台: Udemy |
课程主页: https://www.udemy.com/course/scraping-python-selenium-heroku/
课程评论:没有评论
# Python网络爬虫入门:使用Selenium和Heroku实现Web自动化 本课程专为编程初学者设计,旨在教授如何使用Python、Selenium和Heroku构建一个能够在Web服务器上自动运行的网络爬虫。通过学习本课程,您将掌握如何在不依赖本地PC的情况下,定期执行网络爬虫任务。 **课程亮点:** * **Web服务器上的爬虫执行:** 学习如何将爬虫部署到Web服务器,实现定时自动运行,摆脱PC束缚。 * **Selenium基础:** 详细讲解Selenium的安装和配置,以及如何使用Selenium进行网页抓取。 * **模拟用户操作:** 掌握如何模拟用户输入,如填写登录表单,以及如何从网页中提取文本信息。 * **Heroku部署:** 学习Heroku的介绍、部署流程,以及如何将您的爬虫系统部署到Heroku平台上。 * **Heroku定时任务:** 了解如何在Heroku上设置定时执行任务,自动化您的爬虫。 **学习目标:** 本课程将涵盖以下关键技能: * 安装和使用Selenium。 * 使用Selenium进行网页内容的抓取。 * 实现自动化登录和数据输入。 * 提取网页中的文本信息。 * 设置和使用Heroku平台。 * 将Python爬虫项目部署到Heroku。 * 在Heroku上配置定时爬虫任务。 无论您是编程新手还是希望扩展您的技能集,本课程都将为您提供一个清晰、易懂的学习路径,帮助您成功构建一个自动化的Web爬虫系统。
WEBスクレイピングをPCではなくWEBサーバーで実行するようにすれば、PCを起動せずにスクレイピングを定期実行できる環境を構築することができます。スクレイピングだけでなくツールの導入や実行環境の設定など、プログラミング初心者でも分かるように解説しています。Seleniumの導入方法Seleniumでのスクレイピングの方法ログインフォームなどに値を入力するサイト内にある文字情報を取得するHerokuの導入方法Herokuへスクレイピングシステムをアップロードする方法Herokuの定期実行を行う方法