Size: a a a

RL reading group

2021 March 24

SA

See All in RL reading group
Google AI Blog: Recursive Classification: Replacing Rewards with Examples in RL
http://ai.googleblog.com/2021/03/recursive-classification-replacing.html
источник

SA

See All in RL reading group
Что мы об этом думаем
источник
2021 April 01

MB

Mikhail Burtsev in RL reading group
Отличная тема, давно такого ждали.
источник
2021 April 02

VL

Vadim Liventsev in RL reading group
Сегодня, в 14:00 МСК (! разница во времени изменилась на час)

Будет семинар про Model-based Reinforcement Learning, наш гость в этот раз Błażej Osiński из Lyft

einreise.tilda.ws // meet.jit.si/EindhovenReinforcementLearningSeminar
источник

VL

Vadim Liventsev in RL reading group
Vadim Liventsev
Сегодня, в 14:00 МСК (! разница во времени изменилась на час)

Будет семинар про Model-based Reinforcement Learning, наш гость в этот раз Błażej Osiński из Lyft

einreise.tilda.ws // meet.jit.si/EindhovenReinforcementLearningSeminar
через 5 минут!
источник

TL

Timur Leonidovich in RL reading group
Vadim Liventsev
через 5 минут!
а будет запись?
источник

p

pa_antya in RL reading group
Timur Leonidovich
а будет запись?
если ютуб не будет бухтеть)
https://www.youtube.com/watch?v=RNAid7isrUs
источник

TL

Timur Leonidovich in RL reading group
спасибо!
источник
2021 April 03

VL

Vadim Liventsev in RL reading group
источник

VL

Vadim Liventsev in RL reading group
источник

VL

Vadim Liventsev in RL reading group
Часть, где я пересказываю лекции Сергея Левина, я не стал выкладывать, потому что лучше посмотреть оригинал)
источник

VL

Vadim Liventsev in RL reading group
источник

NA

Narek Alvandyan in RL reading group
спасибо!
источник

SL

Sergey L in RL reading group
👍
источник
2021 April 08

GS

Garen Sharaph in RL reading group
Всем привет!
Мы в Armenian Code Academy срочно ищем замену нашему преподавателю по RL. В отличии от многих других школ, наша бизнес модель основана на финансировании студентов компаниями, с последующим наймом, что позволяет большинству студентов нашего курса по ML проходить его бесплатно. Занятия из-за пандемии проходят онлайн, лекции 3 раза в неделю по 2 часа , семинаристов можем предоставить. Уровень студентов достаточно высокий, много олимпиадников, есть люди с PhD (физика, математика), некоторые работают программистами. До этого был достаточно высокий уровень преподавателей, люди уровня senior из Гугла, так же был преподователь из академии.
Суммарно нужно провести 7 лекций. Ищем людей только с опытом преподования.
Примерные темы, но можно варьировать тоже
●Intro to RL
● Markov Decision Processes, dynamic
programming
● Model-free RL: from Monte Carlo to
temporal difference methods
● Policy gradient methods
● RL with function approximation
● Deep RL
Если интересно, был бы рад созвониться и обсудить финансовые и прочие детали. Пишите в личку 🙂
Заранее спасибо!
источник
2021 April 10

A

Alexandr Notchenko in RL reading group
Всем привет. Кто нибудь знает есть ли какие нибудь модификации для Proximal Policy Optimisation метода, позволяющие ускорить его? асинхронное или распределенной что нибудь?
Или лучшая стратегия это запусти кучу копий с разными сидами и ждать?
источник

TA

Timur Akhtyamov in RL reading group
Насколько я знаю, PPO параллелится хорошо, смотрите в сторону Distributed PPO, вроде бы так модификация называется
источник

SS

Sergey Sviridov in RL reading group
APPO тоже есть
источник

A

Alexandr Notchenko in RL reading group
Спасибо. А публичный код какой нибудь качественный не видел?
источник

SS

Sergey Sviridov in RL reading group
В RLlib это есть
источник