18+
На сайте представлено только описание и выходные данные книги «Усиленное обучение Джеймс Девис». Сайт не является распространителем книги. Сайт не предоставляет возможности купить, читать онлайн или скачать бесплатно книгу «Усиленное обучение Джеймс Девис». Сайт предназначен для лиц старше 18 лет. Если вам не исполнилось 18 лет - незамедлительно покиньте сайт. Оставаясь на сайте вы подтверждаете, что вам исполнилось 18 лет.
Незаконное потребление наркотических средств, психотропных веществ, их аналогов причиняет вред здоровью, их незаконный оборот запрещен и влечет установленную законодательством ответственность
Данное руководство по усиленному обучению (Reinforcement Learning, RL), охватывает теоретические основы, практические применения и современные достижения. В начале дается определение RL, его исторический контекст и ключевые отличия от других видов машинного обучения. Примеры применения RL охватывают игры, робототехнику, финансовые рынки и управление ресурсами. Математические основы включают марковские процессы принятия решений, состояния, действия, награды и политики, а также Беллмановские уравнения и итерацию ценности.Основные алгоритмы RL, такие как метод Монте-Карло, Q-Learning, SARSA, методы градиента политики, REINFORCE и Actor-Critic, рассматриваются вместе с моделями на основе планирования и глубокого усиленного обучения (DQN, DDPG, A3C). Практическая часть книги включает использование OpenAI Gym и других сред, настройку и тестирование моделей, а также примеры кода на Python с использованием библиотек TensorFlow и PyTorch.
Перед выбором сравните язык, год, издательство и формат в сведениях ниже. У одной книги могут быть разные переводы и издания.
ISBN этого издания: 978-5-04-647602-6. По нему можно отличить издание от других версий книги.
Возрастная отметка из источника: 12.
Описание помогает оценить тему книги; отзывы читателей позволяют дополнить его личным опытом. Оценку и отзыв оставляйте после знакомства с книгой.