Aprendizaje por Refuerzo Profundo 2.0 en Python

所在平台: Udemy

课程主页: https://www.udemy.com/course/aprendizaje-por-refuerzo-profundo/

课程评论:没有评论

第一个写评论        关注课程

课程简介

课程名称:Python中的深度强化学习2.0 概述:欢迎参加Python中的深度强化学习2.0课程。在本课程中,我们将学习并实施一种新型的超智能人工智能模型,名为双延迟确定性策略梯度(Twin Delayed DDPG)。该模型融合了人工智能中的多种先进技术,包括双深度学习、策略梯度以及演员-评论员模型。这个模型的强大之处在于,我们将首次在我们的课程中成功解决虚拟AI应用中最具挑战性的任务,例如训练蚂蚁/蜘蛛及半人形机器人在地形上行走和奔跑。 为正确处理该模型,我们将课程分为三个部分: 第一部分:基础知识。在这一部分,我们将学习所有人工智能的基础知识,使你能够理解和掌握本课程的AI内容。这包括Q学习、深度Q学习、策略梯度、演员-评论员模型等。 第二部分:双延迟DDPG的理论。我们将深入研究这一模型背后的理论,通过一系列可视化幻灯片清晰展示AI的构建和训练过程。你将详细了解理论,还会理解AI如何学习和运作。第一部分的基础知识与第二部分详细的理论相结合,将使你能够接触并掌握这一高度先进的模型,成为少数能够深刻理解此模型的人之一。 第三部分:双延迟DDPG的实施。我们将从零开始一步步实施模型,通过互动环节让你实践许多编码练习。在执行这些任务时,你将不再是被动学习,而是积极参与,这将大幅提升你在编程和AI方面的技能。 最后,我们将全部实施在Colaboratory或Google Colab上,这是一个完全免费的开源AI平台,允许你编程并训练某些AI,而无需在自己的设备上安装任何软件。换句话说,你可以完全放心,只需点击运行按钮,AI便会开始训练,并最终获得蜘蛛和半人形机器人的奔跑视频。

课程评论(0条)

课程详情

Bienvenido al curso Aprendizaje por Refuerzo Profundo 2.0 en PythonEn este curso, aprenderemos e implementaremos un nuevo modelo de IA increíblemente inteligente, llamado el Gradiente de Política Determinista de doble retardo (Twin Delayed DDPG, en inglés), que combina las técnicas más avanzadas en Inteligencia Artificial, incluyendo el Aprendizaje de Doble Profundidad, Políticas de Gradiente y Actor-Crítico. El modelo es tan robusto que por primera vez en nuestros cursos, somos capaces de resolver las aplicaciones de IA virtual más desafiantes (entrenar a una hormiga/araña y medio humanoide a caminar y correr a través de un terreno).Para abordar este modelo de la manera correcta, estructuramos el curso en tres partes:Parte 1: Fundamentos.En esta parte estudiaremos todos los fundamentos de la Inteligencia Artificial que te permitirán entender y dominar la IA de este curso. Estos incluyen Q-Learning, Deep Q-Learning, Políticas de Gradiente, Actor-Crítico y mucho más.Parte 2: La teoría del DDPG de doble retardo.Estudiaremos a fondo toda la teoría que hay detrás del modelo. Verás claramente todo el proceso de construcción y entrenamiento de la IA a través de una serie de diapositivas de visualización. No sólo aprenderás la teoría en detalle, sino que también darás forma a toda la intuición para saber cómo aprende y trabaja la IA. Los fundamentos de la Parte 1, combinados con la muy detallada teoría de la Parte 2, harán que este modelo altamente avanzado sea accesible para ti, y con el tiempo serás una de las pocas personas que puede dominar y entender este modelo.Parte 3: La implementación del DDPG de doble retardo.Implementaremos el modelo desde cero, paso a paso, y a través de sesiones interactivas, una nueva característica de este curso que te hará practicar en muchos ejercicios de codificación mientras implementamos el modelo. Al hacerlos no seguirás el curso de forma pasiva sino muy activa, permitiéndote así mejorar eficazmente tus habilidades en programación e IA.Y por último, pero no menos importante, haremos toda la implementación en Colaboratory, o Google Colab, que es una plataforma de IA totalmente gratuita y de código abierto que te permitirá programar y entrenar algunas IA sin tener que instalar ningún paquete en tu equipo. En otras palabras, puedes estar 100% seguro de que al pulsar el botón de ejecución, la IA comenzará a entrenar y al final obtendrás los videos de la araña y el humanoide corriendo.

课程标签

0人关注该课程

主题相关的课程