Всем привет!
Несмотря на зомби-апокалипсис, разыгрывающийся прямо у нас на глазах, наша шестая лекция курса по Advanced RL все же состоится!
Проводить ее мы будем в режиме онлайн-трансляции.
Запись, как и обычно, затем выложим на youtube.
Запасайтесь гречкой, консервами и туалетной бумагой, и подключайтесь к трансляции.
В четверг (ЗАВТРА)
В 19:30 (обратите внимание на время!)
Ссылку на трансляцию мы выложим в чат чуть ближе к делу.
На завтрашней лекции выступит Тарас Хахулин
@vitaminotar.
Тема: RL for Combinatorial Optimization
Существует большой класс задач дискретной оптимизации, для которых очень сложно найти решение.
Одним из примеров является задача с которой курьерские службы сталкиваются ежедневно: нахождение выгодного маршрута через заданные пункты с различными ограничениями.
К сожалению, не так просто придумать метод, который находит даже приближенные решения хорошого качества. А зачем нам что-то придумывать, если мы можем выучить это напрямую из нашего общения со средой (задачей)? В такой постановке мы можем использовать традиционный RL для нахождения решений. Награда в таком случае уже задана самой структурой решаемой задачи.
На лекции мы разберем большое количество различных подходов, появившихся за последние 5 лет. Посмотрим на достоинства и недостатки различных методов. Вы узнаете, что уже можно решать с помощью RL, а до чего современные методы еще не дошли.
Подключайтесь, будет интересно!
И, пожалуйста, зарегистрируйтесь по ссылке.
Мы вас все-равно пустим, и вам все-равно рады, просто интересно 😌
https://docs.google.com/forms/d/e/1FAIpQLSd18PGkZuOqkWThJhmNxnmiSVFicnH4YwLVTCOkEkVQV6ZIDg/viewform