Size: a a a

RL reading group

2021 September 03

K

Kamoliddin in RL reading group
Типичный js разработчик
источник

B

Boris in RL reading group
Это шутка. Сейчас в моде мем "я календарь переверну и снова третье сентября" и различные вариации на эту тему))
источник

AG

Aleksey Grinchuk in RL reading group
источник

A

Anna in RL reading group
😂
источник

PC

Pika Chu in RL reading group
tf.transpose()
источник

AB

Alexey Boyko in RL reading group
Тогда гамма должна быть меньше 1.0 )
источник

SK

Serafim Korovin in RL reading group
В Shufutinsky decision process это необязательно)
источник

AB

Alexey Boyko in RL reading group
В петле бесконечный валью иначе накрутится
источник

АР

Александр Рябов... in RL reading group
что-то еще никто не пошутил про upside down rl )))
источник
2021 September 04

AP

Anton Pechenko in RL reading group
😂
источник
2021 September 05

IK

Ivan Konyushenko in RL reading group
Полезна ли теория игр при работе\ресерче в рл?
источник

MK

Max Kaledin in RL reading group
Теория игр немного про другое. RL решает разные задачи оптимального управления, а теория игр изучает взаимодействие игроков в заданной среде (равновесия разного рода и их характеристики). Есть, правда, эволюционная теория игр, которая изучает то, как игроки играют в бесконечные игры (типа дилеммы заключённого бесконечное число раз подряд) и занимается вопросами сходимости стратегий со временем при разных предположениях (например, что будет, если Q-Learning против Q-Learning будет играть в дилемму заключённого?). Большая теория и много разделов, всего не опишешь кратко.

В общем, могу сказать, что местами можно встретить какие-то намёки на теорию игр или техники оттуда, но не то чтобы сильно часто. В основном, в теоретических работах.

Если интересен вариант "для саморазвития", горячо рекомендую изучить, очень захватывающая вещь) Если нет, то ответ во многом зависит от того, что планируете исследовать.

Кстати, поделитесь, может, у кого-то другой опыт)
источник

АК

Андрей Квасов... in RL reading group
Спасибо за обширный комментарий.
источник

AB

Alexey Boyko in RL reading group
А вот Differential games theory это буквально теория непрерывного управления с двумя агентами
источник

KS

Konstantin Sozykin in RL reading group
ну да, если интересен именно MARL (мульти-агент) - то с теорией игр стоит ознакомится
источник
2021 September 07

RR

Rena Rena in RL reading group
Расскажите, плиз, зачем в популярных статьях про игры (в особенности ATARI) авторы стараются впихнуть стохастичность даже в детерминированные игры?
источник

SL

Stanislav Lukyanenko in RL reading group
что ты имеешь ввиду? state space exploration?
источник

RR

Rena Rena in RL reading group
Не обязательно. Но вот, например, в SIMPLE они делают специальную маску для входного кадра, чтобы добавить стохастичности (верхняя часть модели). не очень понятно для чего. только потому что там VAE?
источник

АС

Артём С in RL reading group
Иначе модель может просто запомнить для каждого кадра, какое действие в нём нужно сделать без понимания, что вообще происходит. То есть, найдёт, например, 100 пикселей на картинке и будет считать их значения хешом, а дальше выучит маппинг хеш → действие. И вроде работает, но на самом деле это результат брутфорса и оверфит под конкретную среду, никакого  понимания среды внутри агента не происходит
источник

MM

Michael Melnik in RL reading group
подскажите, это что за статья?
источник