Глубокое обучение с подкреплением. AlphaGo и другие технологии

16+
Нет отзывов

Купили 9 человек

Аннотация

Эта книга — подробное руководство по новейшим инструментам глубокого обучения с подкреплением и их ограничениям. Мы реализуем и проверим на практике методы кросс-энтропии и итерации по ценностям (Q-learning), а также градиенты по стратегиям.
Для экспериментов используются самые разные среды обучения с подкреплением (RL), начиная с классических CartPole и GridWorld и заканчивая эмуляторами Atari и средами непрерывного управления (на основе PyBullet и RoboSchool). Множество примеров основано на нестандартных средах, в которых мы с нуля разработаем модель окружения.
В этой книге:
• Вы узнаете, какое место в контексте глубокого обучения занимают методы RL, реализуете сложные модели глубокого обучения.
• Изучите основу RL: марковские процессы принятия решений.
• Рассмотрите примеры реализации методов RL: метод кросс-энтропии, DQN, A3C, TRPO, PPO, DDPG, D4PG и других.
• Узнаете, как работать с дискретными и непрерывными пространствами действий в различных средах.
• Увидите, как разработать систему, обучающуюся играм Atari, используя обучение с подкреплением.
• Создадите собственную среду по модели OpenAI Gym для обучения биржевого агента.
• Реализуете метод AlphaGo Zero для игры в Connect4.
• Познакомитесь с применением RL в обработке речи: узнаете, как обучить диалогового бота на фразах из кинофильмов.
СерияДля профессионалов
Издательство
ПереплетМягкий переплёт
Страниц496
Год, тираж2020, 700 экз.
1 739 ₽1 449 ₽-17%

Последний экземпляр

как получить заказ

Послезавтра, 27 сентября — бесплатно
  • Во вт, 29 сентября — от 247 ₽
  • КурьеромВ пн, 28 сентября — от 318 ₽
  • Почтой РоссииВо вт, 29 сентября — от 588 ₽

Получить сегодня

Нет в наличии, но есть в 1 магазине в других городах, 1 449 ₽

Отзывы

0

Уже читали эту книгу? Поделитесь вашим мнением!

Описание и характеристики

Эта книга — подробное руководство по новейшим инструментам глубокого обучения с подкреплением и их ограничениям. Мы реализуем и проверим на практике методы кросс-энтропии и итерации по ценностям (Q-learning), а также градиенты по стратегиям.
Для экспериментов используются самые разные среды обучения с подкреплением (RL), начиная с классических CartPole и GridWorld и заканчивая эмуляторами Atari и средами непрерывного управления (на основе PyBullet и RoboSchool). Множество примеров основано на нестандартных средах, в которых мы с нуля разработаем модель окружения.
В этой книге:
• Вы узнаете, какое место в контексте глубокого обучения занимают методы RL, реализуете сложные модели глубокого обучения.
• Изучите основу RL: марковские процессы принятия решений.
• Рассмотрите примеры реализации методов RL: метод кросс-энтропии, DQN, A3C, TRPO, PPO, DDPG, D4PG и других.
• Узнаете, как работать с дискретными и непрерывными пространствами действий в различных средах.
• Увидите, как разработать систему, обучающуюся играм Atari, используя обучение с подкреплением.
• Создадите собственную среду по модели OpenAI Gym для обучения биржевого агента.
• Реализуете метод AlphaGo Zero для игры в Connect4.
• Познакомитесь с применением RL в обработке речи: узнаете, как обучить диалогового бота на фразах из кинофильмов.
Код2798725
Издательство
СерияДля профессионалов
Автор
ПереводчикБелов С.
ПереплетМягкий переплёт
Кол-во страниц496
Год издания2020
Тираж700 экз.
ISBN978-5-4461-1079-7
РазделПрикладное программное обеспечение
Размеры2.3 см × 16.5 см × 23.3 см
Вес0.63 кг

Наличие в магазинах сети

Смотреть наличие на карте
В интернет-магазине «Буквоед» есть книга «Глубокое обучение с подкреплением. AlphaGo и другие технологии» от автора Лапань Максим . Сделать заказ можно из любого города России: от Санкт-Петербурга и Москвы до Казани и Краснодара. Получите «Глубокое обучение с подкреплением. AlphaGo и другие технологии» в магазине сети или закажите доставку. Мы и сами любим читать, поэтому делаем всё, чтобы вы могли купить понравившуюся историю по приятной цене. Например, организуем конкурсы и проводим акции. Оставайтесь с нами, чтобы не упустить выгоду!