Всем привет!
Вторая лекция нашего курса по Advanced RL пройдет в этот четверг (20.02) в 19:00
В ШАДе (ул. Тимура Фрунзе, 11к2)
Аудитория: Оксфорд
На лекции выступит Just Heuristic
@justHeuristic.
Тема: Imitation Learning and Inverse RL
Вы узнаете как научиться вести себя оптимально, не имея никакой функции награды, но имея доступ к примерам действий из оптимальной политики.
Разберем как базовые и простые алгоритмы, так и методы advanced level'a.
Если вы хотите прийти, обязательно зарегистрируйтесь в форме по ссылке (для оформления пропуска)!
https://docs.google.com/forms/d/e/1FAIpQLSd18PGkZuOqkWThJhmNxnmiSVFicnH4YwLVTCOkEkVQV6ZIDg/viewformВнимание! Поскольку встречаемся мы в не такой большой аудитории, как в первый раз, я буду вынужден закрыть регистрацию, когда зарегистрируется >80 человек.
Внимание! Просьба регистрироваться всем: и тем, у кого пропуск есть, и тем у кого его нет. Нам это нужно, чтобы считать людей.