Size: a a a

RL reading group

2020 February 04

AB

Alexey Boyko in RL reading group
источник

MD

Michael Diskin in RL reading group
Gleb
Коллеги,
Ищу заинтересованных к себе в проект с топиком RL для AutoML-AutoAugment (CV) в Huawei. Рассматриваем уверенных мидлов на позицию постарше. Подробности в лс.
источник

DN

Dmitry Nikulin in RL reading group
👀
источник

GS

Gleb Sterkin in RL reading group
👀
источник

AK

Aleksey Kharlamov in RL reading group
Начальство не дремлет
источник

G

Gleb in RL reading group
😄😄
источник
2020 February 05

AY

Anastasia Yanina in RL reading group
На минуту показалось, что это самсунговский чат)
источник

АС

Артём С in RL reading group
Так и есть. Этот чат зохвачен
источник

LM

Larisa M in RL reading group
инфицирован
источник

AB

Alexey Boyko in RL reading group
донатьте на лечение маленького чата
источник
2020 February 08

c

cydoroga in RL reading group
Всем привет!
Обещанного ждут три года)
Мы таки запускаем курс лекций по Advanced RL

В рамках курса пройдет несколько докладов на разнообразные темы продвинутого RL, в их числе:
- Hierarchical RL
- Meta learning, Transfer and Multi-task RL
- Distributed RL
- Distributional RL
- Exploration in RL
- Memory in RL, POMDP
- Model-based RL
- Multi-Agent RL
- RL for combinatorial optimization
- Immitation and Inverse RL
- Genetic and Evolutionary RL
- Variational Inference in RL

Первая лекция состоится уже в следующий четверг (13го февраля).
На лекции выступит Сергей Иванов и расскажет про Exploration в RL.
Как обычно, встречаемся в ШАДе.
13е февраля, 19:00
Аудитория: Оксфорд

Если вы хотите прийти, обязательно зарегистрируйтесь в форме по ссылке!
https://docs.google.com/forms/d/e/1FAIpQLSd18PGkZuOqkWThJhmNxnmiSVFicnH4YwLVTCOkEkVQV6ZIDg/viewform

Сергей расскажет о том, что такое self-supervised режим в обучении с подкреплением и как с его помощью можно мотивировать агента исследовать окружающую среду. Обсудим преимущества введения такой "внутренней мотивации" (intrinsic motivation) RL-агентам и каких нежелательных эффектов мы при этом наоборот стремимся избежать на примере таких центральных подходов, как любопытство (Curiosity) и дистилляция случайной сетки (Random Network Distillation).


ПС !!!
Данный курс лекций будет проходить почти как нормальный университетский курс. Вы можете послушать лекции и сделать проект (про проекты расскажем позже).

Студенты ШАДа смогут зачесть успешно сданный курс как полусеместровый в ШАДе.
За подробностями пишите мне.

Студенты МФТИ могут зачесть данный курс лекций + проект как курс МФТИ.
За подробностями пишите @supergriver

Всем остальным за прохождение курса мы дадим красивые дипломы и может быть красивый мерч :)

Если вы хотите поучаствовать в выполнении проектов, пожалуйста, пройдите регистрацию в еще одной форме:
https://forms.gle/jpxWUSxfdCmqoGdY8

Также мы создали чат, в котором будет обсуждение только (!) деталей курса, проектов, лекций. Все, чем не стоило бы захламлять основной чат.
https://t.me/adv_topics_in_rl_ru_2020

ПСС
По всем вопросам пишите мне (@cydoroga), Артему Сорокину (@supergriver), Сергею Свиридову (@sergeysviridov) и Сергею Колесникову (@scitator).
источник

SA

See All in RL reading group
cydoroga
Всем привет!
Обещанного ждут три года)
Мы таки запускаем курс лекций по Advanced RL

В рамках курса пройдет несколько докладов на разнообразные темы продвинутого RL, в их числе:
- Hierarchical RL
- Meta learning, Transfer and Multi-task RL
- Distributed RL
- Distributional RL
- Exploration in RL
- Memory in RL, POMDP
- Model-based RL
- Multi-Agent RL
- RL for combinatorial optimization
- Immitation and Inverse RL
- Genetic and Evolutionary RL
- Variational Inference in RL

Первая лекция состоится уже в следующий четверг (13го февраля).
На лекции выступит Сергей Иванов и расскажет про Exploration в RL.
Как обычно, встречаемся в ШАДе.
13е февраля, 19:00
Аудитория: Оксфорд

Если вы хотите прийти, обязательно зарегистрируйтесь в форме по ссылке!
https://docs.google.com/forms/d/e/1FAIpQLSd18PGkZuOqkWThJhmNxnmiSVFicnH4YwLVTCOkEkVQV6ZIDg/viewform

Сергей расскажет о том, что такое self-supervised режим в обучении с подкреплением и как с его помощью можно мотивировать агента исследовать окружающую среду. Обсудим преимущества введения такой "внутренней мотивации" (intrinsic motivation) RL-агентам и каких нежелательных эффектов мы при этом наоборот стремимся избежать на примере таких центральных подходов, как любопытство (Curiosity) и дистилляция случайной сетки (Random Network Distillation).


ПС !!!
Данный курс лекций будет проходить почти как нормальный университетский курс. Вы можете послушать лекции и сделать проект (про проекты расскажем позже).

Студенты ШАДа смогут зачесть успешно сданный курс как полусеместровый в ШАДе.
За подробностями пишите мне.

Студенты МФТИ могут зачесть данный курс лекций + проект как курс МФТИ.
За подробностями пишите @supergriver

Всем остальным за прохождение курса мы дадим красивые дипломы и может быть красивый мерч :)

Если вы хотите поучаствовать в выполнении проектов, пожалуйста, пройдите регистрацию в еще одной форме:
https://forms.gle/jpxWUSxfdCmqoGdY8

Также мы создали чат, в котором будет обсуждение только (!) деталей курса, проектов, лекций. Все, чем не стоило бы захламлять основной чат.
https://t.me/adv_topics_in_rl_ru_2020

ПСС
По всем вопросам пишите мне (@cydoroga), Артему Сорокину (@supergriver), Сергею Свиридову (@sergeysviridov) и Сергею Колесникову (@scitator).
Какие пререквизиты для Advanced-уровня?
источник

P

Pavel Dmitrievskiy in RL reading group
Будут ли лекции записываться и где-нибудь выкладываться?
источник

c

cydoroga in RL reading group
See All
Какие пререквизиты для Advanced-уровня?
По части RL:
- MDP
- Q-learning
- DQN
- Policy Gradient (A3C)
- Basic Exploration (epsilon-greedy and Boltzman strategy)
По части ML:
- Базовый ML
- Нейросети, сверточные сети
- Рекуррентки, LSTM
Опционально:
- Комбинаторика немного
- Варвывод (вероятностные графические модели)

Можно глянуть лекции из курса @ipaulo и @justHeuristic:
https://www.coursera.org/learn/practical-rl

Или тут:
https://www.youtube.com/playlist?list=PL85HjOS213P3z2wzIyeRq9KuQthZLus0a
источник

c

cydoroga in RL reading group
Pavel Dmitrievskiy
Будут ли лекции записываться и где-нибудь выкладываться?
Да, запись обязательно будет!
Даже выложим
источник

P

Pavel Dmitrievskiy in RL reading group
cydoroga
Да, запись обязательно будет!
Даже выложим
Спасибо!
источник

SA

See All in RL reading group
спасиб
источник

АК

Андрей Квасов... in RL reading group
cydoroga
Да, запись обязательно будет!
Даже выложим
Это супер круто!) А без физического присутствия проекты или возможные домашки, можно сдавать/делать?
источник

S

Shmuma in RL reading group
🔥
источник
2020 February 10

p

pa_antya in RL reading group
Андрей Квасов
Это супер круто!) А без физического присутствия проекты или возможные домашки, можно сдавать/делать?
+
Интересует участие удалённо
я бы по максимому поучаствовал
источник