|
所在平台: Udemy |
课程主页: https://www.udemy.com/course/node-js-web-scraping/
课程评论:没有评论
## Coursera 课程总结:Node.js Web 抓取速成 本课程旨在通过 Node.js 和 JavaScript 教授 Web 抓取技术。课程涵盖了从 Node.js 环境搭建到高级抓取技巧的全面内容,并已于 2023 年 12 月更新至最新规范。 **核心内容概览:** * **Node.js 基础:** 掌握 Node.js 环境配置,以及 `node` 和 `npm` 等命令行工具的使用。学习 Node.js 程序编写、模块化开发和自定义模块的创建。 * **网络文件处理:** 利用 `node-fetch` 库学习下载网络文件。 * **HTML 解析:** 使用 `jsdom` 库解析 HTML 内容,为数据提取奠定基础。 * **Web 抓取实战:** 结合 `node-fetch` 和 `jsdom` 进行实际的 Web 抓取操作。 * **浏览器自动化抓取:** 学习使用 `Puppeteer` 对 Web 浏览器进行自动化控制,实现更复杂的抓取场景,如信息提取、表单操作和文件下载。 **课程结构:** 课程共分为 12 章,循序渐进地引导学习者掌握 Web 抓取技能: * **第一章:** 课程介绍 * **第二章:** 项目创建 * **第三章:** 网络文件下载 * **第四章:** `require` 与 `import` * **第五章:** `Path` 模块 * **第六章:** `Promise` * **第七章:** `File System` 模块 * **第八章:** HTML 解析 * **第九章:** `Puppeteer` 信息获取 * **第十章:** `Puppeteer` 表单操作 * **第十一章:** `Puppeteer` 文件下载 * **第十二章:** 自定义模块 * **结语** **课程特色:** * 所有课程代码均可作为示例代码下载。 * 详尽列出所有依赖模块,方便在其他项目中使用 `npm` 进行安装。 **学习目标:** 完成本课程后,您将能够: * 使用 Node.js 进行程序开发。 * 通过下载文件和解析 HTML 实现 Web 抓取。 * 运用 `Puppeteer` 的浏览器自动化功能进行 Web 抓取。
このコースでは、Node.jsを使い、JavaScriptでWebスクレイピングをする方法を学びます。(2023年12月に、最新の仕様の情報を追加しました) Node.jsの環境構築から始まり、nodeコマンドやnpmコマンドといった、CLI環境での操作方法を身に付けます。 また、Node.js向けのプログラムの書き方や、モジュールの利用の仕方、自作モジュールの作り方も学びます。 そして、「node-fetch」によるネット上のファイルのダウンロード、「jsdom」によるHTMLパース、それらを利用したWebスクレイピングを身に付けます。 また、「Puppeteer」を利用したWebブラウザの自動操縦を利用したWebスクレイピングも身に付けます。 コースで紹介するコードは、サンプルコードとして、全てダウンロードできます。 依存するモジュールは全て紹介しており、npmコマンドを利用して、別のプロジェクトでもインストールできます。 このコースを習得すれば、次のような事ができるようになります。Node.jsを利用したプログラムの開発。ファイルのダウンロードとHTMLのパースによるWebスクレイピング。Puppeteerを利用したブラウザ自動操縦によるWebスクレイピング。‥‥‥‥‥‥‥‥‥‥ このコースは、以下のように進みます。● 第1章 イントロダクション● 第2章 プロジェクトの作成● 第3章 ネットのファイルのダウンロード● 第4章 requireとimport● 第5章 Path● 第6章 Promise● 第7章 File System● 第8章 パース● 第9章 Puppeteerによる情報取得● 第10章 Puppeteerによるフォーム操作● 第11章 Puppeteerによるダウンロード● 第12章 自作モジュール● 終わりに‥‥‥‥‥‥‥‥‥‥