Size: a a a

RL reading group

2020 February 23

VL

Vlad Lialin in RL reading group
ID:313536899
там и такой есть. @dropout05 знает, какой именно.
источник

SA

See All in RL reading group
ето не тот, ща
источник

SA

See All in RL reading group
источник

SA

See All in RL reading group
вот так выглядеть будет, жмешь - и все ок + бот подтирает за собой
источник
2020 February 24

TA

Timur A. in RL reading group
Приветствую всех, я конечно не по теме, но мне негде спросить: можно ли статью или ссылку на ресурс про технику, которая заключается в использовании батча со случайным количеством семплов.
источник

TA

Timur A. in RL reading group
и вообще такое возможно? я от кого-то слышал, что такая техника повышала качество модели для сегментации, но детально расспросить про это не удалось.
источник

TA

Timur A. in RL reading group
У меня есть подозрения, что это ничего хорошего не сулит, ну у людей получилось улучшить качество сегментации
источник

TA

Timur A. in RL reading group
Буду благодарен если скинете статейки, ресурсы, а то найти чет не могу
источник

TA

Timur A. in RL reading group
нашел только вот это: https://arxiv.org/pdf/1104.2373v4.pdf
источник
2020 February 25

CT

Cookie Thief in RL reading group
Смотрите какую интересную штуку microsoft подвез
https://twitter.com/MSFTResearch/status/1232070448147509255?s=19
источник
2020 February 26

WL

Woudln't You Like to... in RL reading group
Товарищи! Прошу помощи! Хочу попробовать сделать самообучающуюся цифровую имитацию жизни (например когда штуковина виртуально эволюционирует чтобы ходить дальше). Подозреваю что этого можно достичь в игровых движках. Не могу найти информацию о том как к этому подступиться. Если кто-то поможет ссылкой или подсказкой что искать, буду благодарен.
источник

vd

v d in RL reading group
зачем?!!
источник

WL

Woudln't You Like to... in RL reading group
Для образовательного процесса. Может потом буду настоящих роботов делать на этой основе.
источник

WL

Woudln't You Like to... in RL reading group
Разве RL не этим занимается?
источник

B

Boris in RL reading group
Ну а почему бы не попробовать собственно эволюционные алгоритмы?
источник

📒

📒 in RL reading group
источник

WL

Woudln't You Like to... in RL reading group
Boris
Ну а почему бы не попробовать собственно эволюционные алгоритмы?
Почему бы и да! Есть ли какая-то доступная для понимания информация? Эволюционионные алгоритмы для чайников или что-то в этом роде?
источник

c

cydoroga in RL reading group
Всем привет!
Третья лекция курса по Advanced RL  пройдет в этот четверг (27.02) в 19:00
В ШАДе (ул. Тимура Фрунзе, 11к2)
Аудитория: Оксфорд

На лекции выступит Петр Кудеров @pkuderov
Тема: Hierarchical Reinforcement Learning
В классическом РЛ агент вынужден выбирать действия из списка примитивных действий, данных ему сверху.
Мы, люди, при этом не ведем себя подобным образом: не думаем, какие импульсы послать мышцам, чтобы съесть торт (и получить +1 награды).
Иерархический РЛ - это спектр методов, нацеленных на обучение агента сложным составным последовательностям действий.
Об этом и поговорим. Разберем Option-Critic, FeUdal Networks и HIRO

Если вы хотите прийти, обязательно зарегистрируйтесь в форме по ссылке (для оформления пропуска)!
Зарегистрируйтесь, пожалуйста, до 19:00 сегодня (среда).

https://docs.google.com/forms/d/e/1FAIpQLSd18PGkZuOqkWThJhmNxnmiSVFicnH4YwLVTCOkEkVQV6ZIDg/viewform

Внимание!
В силу ограниченной вместимости аудитории, я буду вынужден закрыть регистрацию при превышении порога в 90 человек. Очень надеюсь, что поместятся все желающие прийти.
Внимание! Просьба регистрироваться всем: и тем, у кого пропуск есть, и тем у кого его нет. Нам это нужно, чтобы считать людей.
источник

c

cydoroga in RL reading group
Запись прошлой лекции по Imitation Learning and Inverse RL появится сегодня!
источник

MB

Mikhail Burtsev in RL reading group
Что-то новенькое :)  https://arxiv.org/abs/2002.09571
источник