Size: a a a

RL reading group

2020 March 02

IR

Ivan Razvor in RL reading group
Cherry Pie
что такое HOOF?
источник
2020 March 04

c

cydoroga in RL reading group
Переслано от cydoroga
Всем привет!
Напоминаю про необходимость регистрации в форме, чтобы пройти на семинар!
Регистрация закроется через пол часа!
источник

c

cydoroga in RL reading group
Переслано от cydoroga
UPD
Лекция пройдет в аудитории Синий Кит!
Это не ШАД (это в Яндексе!)

Адрес:
ул. Льва Толстого, 16, БЦ Морозов

Вам нужен будет 3й подъезд
На скрине он отмечен зеленой стрелочкой (не красной, красных много, а зеленая одна)

Не забывайте с собой взять паспорт и хорошее настроение!
источник

W

Wyvern in RL reading group
А синим китом оно называться стало после одноименных событий или до?)))
источник
2020 March 05

DN

Dmitry Nikulin in RL reading group
Wyvern
А синим китом оно называться стало после одноименных событий или до?)))
Ты примерно 14723й, кто шутит на эту тему
источник

W

Wyvern in RL reading group
Ну вообще это не шутка, мне интересно

Я бы не удивился, если бы она реально в честь этого была названа
источник

SS

Sergey Slotin in RL reading group
Нет, её назвали вроде лет пять назад, имея в виду морское млекопитающее
источник

c

cydoroga in RL reading group
Переслано от cydoroga
Всем шалом!

Огромная просьба сегодня не опаздывать особо
До аудитории нас будет проводить человек с пропуском и будет не очень хорошо, если придётся ему бегать и каждого опоздавшего пропускать

Поэтому в 19:00 всех прошу быть в точке, указанной на карте!

Спасибо!
источник

c

cydoroga in RL reading group
Переслано от Евгения Елистратова...
источник
2020 March 06

AS

Artyom Sorokin in RL reading group
Переслано от Artyom Sorokin
Всем привет!
Третья лекция курса Advanced Topics in RL теперь онлайн!
(На самом деле еще со вчера, но не важно...)

Иерахическое обучение с подкрепллением - это подход при котором сложная RL задача разбивается на более простые подзадачи, и обучения агента происходит уже с учетом этой структуры подзадач. В этой лекции Петр Кудеров (@pkuderov) расскажет как можно выучить иерахию подзадач с нуля, или просто обучить агента с учетом уже заданной иерахии.

Лекцию можно посмотреть на youtube на любом из двух каналов:
DeepPavlov (https://youtu.be/igiu0eyxwjU)
И
RL Reading Group (https://youtu.be/sdBE3P6xL7E)

Cсылки на разобранные статьи:
A framework for temporal abstraction in reinforcement learning [http://www-anw.cs.umass.edu/~barto/courses/cs687/Sutton-Precup-Singh-AIJ99.pdf]
The Option-Critic Architecture [https://arxiv.org/abs/1609.05140]
FeUdal Networks for Hierarchical RL [https://arxiv.org/abs/1703.01161]
Data-Efficient Hierarchical RL [https://arxiv.org/abs/1805.08296]
Meta Learning Shared Hierarchies [https://arxiv.org/abs/1710.09767]

Слайды есть на страничке курса:
https://deeppavlov.ai/rl_course_2020
источник
2020 March 09

P

Pavel Shvechikov in RL reading group
источник

CP

Cherry Pie in RL reading group
Гайз, адски нужна помощь. Кто-то отправлял статью на NeurIPS postproceedings? Нужна помощь с latex шаблоном Proceeding of Machine Learning Research (PMLR)
источник

CP

Cherry Pie in RL reading group
Думаю это немножко релевантно каналу, потому что нужно переделать статью по RL в этот шаблон
источник

EZ

Evgenii Zheltonozhsk... in RL reading group
Cherry Pie
Гайз, адски нужна помощь. Кто-то отправлял статью на NeurIPS postproceedings? Нужна помощь с latex шаблоном Proceeding of Machine Learning Research (PMLR)
В чем вопрос
источник

EZ

Evgenii Zheltonozhsk... in RL reading group
Ну и @pro_latex
источник
2020 March 10

c

cydoroga in RL reading group
Всем привет!
Пятая лекция курса по Advanced RL пройдет в четверг (12.03) в 19:00
В ШАДе (ул. Тимура Фрунзе, 11к2)
Аудитория: Оксфорд

На лекции выступит Павел Швечиков @ipaulo
Тема: Distributional RL
В то время, как традиционный RL рассматривает награду и value функции как детерминированные значения (а точнее, точечные оценки), distributional методы учитывают их как случайные величины. В данном подходе явно рассматриваются плотности распределения этих случайных величин.
На лекции разберем целое семейство методов  Distributional RL, таких как:
- C51
- Quantile Regression DQN
- Implicit Quantile Networks
- Fully Parameterized Quantile Function for distributional RL

Если вы хотите прийти, обязательно зарегистрируйтесь в форме по ссылке (для оформления пропуска)!
Зарегистрируйтесь, пожалуйста, до 19:00 среды!!!

https://docs.google.com/forms/d/e/1FAIpQLSd18PGkZuOqkWThJhmNxnmiSVFicnH4YwLVTCOkEkVQV6ZIDg/viewform

Внимание! Просьба регистрироваться всем: и тем, у кого пропуск есть, и тем у кого его нет. Нам это нужно, чтобы считать людей.
источник
2020 March 11

P

Pavel Shvechikov in RL reading group
В качестве бонуса, если народ захочет, расскажу про новую SOTA в continuous control на основе distributional.
источник

SK

Sergey Kolesnikov in RL reading group
Pavel Shvechikov
В качестве бонуса, если народ захочет, расскажу про новую SOTA в continuous control на основе distributional.
а как называется?
источник

P

Pavel Shvechikov in RL reading group
TQC, truncated quantile critics.
На архив ещё на выложена, under review.
источник
2020 March 12

P

Pavel Shvechikov in RL reading group
Сегодняшняя лекция
источник