Всем привет!
Третья лекция курса по Advanced RL пройдет в этот четверг (27.02) в 19:00
В ШАДе (ул. Тимура Фрунзе, 11к2)
Аудитория: Оксфорд
На лекции выступит Петр Кудеров
@pkuderovТема: Hierarchical Reinforcement Learning
В классическом РЛ агент вынужден выбирать действия из списка примитивных действий, данных ему сверху.
Мы, люди, при этом не ведем себя подобным образом: не думаем, какие импульсы послать мышцам, чтобы съесть торт (и получить +1 награды).
Иерархический РЛ - это спектр методов, нацеленных на обучение агента сложным составным последовательностям действий.
Об этом и поговорим. Разберем Option-Critic, FeUdal Networks и HIRO
Если вы хотите прийти, обязательно зарегистрируйтесь в форме по ссылке (для оформления пропуска)!
Зарегистрируйтесь, пожалуйста, до 19:00 сегодня (среда).
https://docs.google.com/forms/d/e/1FAIpQLSd18PGkZuOqkWThJhmNxnmiSVFicnH4YwLVTCOkEkVQV6ZIDg/viewformВнимание!
В силу ограниченной вместимости аудитории, я буду вынужден закрыть регистрацию при превышении порога в 90 человек. Очень надеюсь, что поместятся все желающие прийти.
Внимание! Просьба регистрироваться всем: и тем, у кого пропуск есть, и тем у кого его нет. Нам это нужно, чтобы считать людей.