Відвідуючи наш сайт, ви погоджуєтеся з нашими політика конфіденційності щодо файлів cookie, статистики відстеження тощо.
Зареєструйтеся вже зараз на новий онлайн-курс у режимі реального часу «Геополітика цифрової інфраструктури»
Подайте заявку на курс «Геополітика цифрової інфраструктури» вже зараз
Подайте заявку на участь у новій європейській програмі прискореного навчання для аспірантів у галузі кібербезпеки. Кількість місць обмежена!
Подайте заявку на участь у новій європейській програмі прискореного навчання для аспірантів у галузі кібербезпеки
Читайте наш новий щомісячний дайджест про кібер та технології в Substack
Щомісячний дайджест з кібер-технологій тепер у Substack
Зверніться зараз за безкоштовною підтримкою до нашого Центру послуг з кібербезпеки
Подати заявку на безкоштовну підтримку з кібербезпеки
Підпишіться на безкоштовні вебінари з кібербезпеки
Підпишіться на безкоштовні вебінари з кібербезпеки
У цьому модулі розглядається навчання з підкріпленням - тип машинного навчання, де агенти вчаться приймати рішення, взаємодіючи з навколишнім середовищем, щоб максимізувати сукупну винагороду. Він охоплює такі ключові поняття, як процес прийняття рішень Маркова, оптимізація політики та методи, що базуються на цінності, а також застосування в таких сферах, як ігри, робототехніка та автономні системи...