Passt nicht? Macht nichts! Sie können Artikel bis zu 30 Tage zurückgeben
Mit einem Geschenkgutschein können Sie nichts falsch machen. Der Beschenkte kann sich im Tausch gegen einen Geschenkgutschein etwas aus unserem Sortiment aussuchen.
Bis zu 30 Tage Rückgaberecht
Эта книга поможет читателю освоить алгоритмы искусственного интеллекта для обучения с подкреплением и научиться их реализовывать при создании самообучающихся агентов. В начале рассматриваются основные элементы обучения с подкреплением, марковские процессы принятия решений и методы Монте-Карло. Далее описываются классические алгоритмы, такие как Q-learning и SARSA, а также передовые методы глубокого обучения с подкреплением, включая DQN, DDPG, TRPO и PPO. На практических примерах показывается, как применять эти алгоритмы для решения различных задач, таких как прохождение игр Atari и непрерывное управление в моделируемых средах. Издание предназначено для специалистов по данным, инженеров машинного обучения и разработчиков, желающих изучить алгоритмы обучения с подкреплением и применять их в своих проектах. Для успешного усвоения материала требуются базовые знания языка программирования Python и понимание основ машинного обучения.
Hallo! Ich bin Libroamiko, dein Buchberater.
Wie kann ich dir helfen?