Size: a a a

RL reading group

2020 January 25

SA

See All in RL reading group
источник

SI

Savva Ignatyev in RL reading group
Благодарю покорно!
источник

SA

See All in RL reading group
хотя пожи, там вроде не было про two-hot метку
источник

SI

Savva Ignatyev in RL reading group
the ground truth labels are also mixed proportionally to the area of the patches.
источник

SA

See All in RL reading group
там не 0,0.5,0,0.5, а просто 0.5,0.5, не оно?
источник

SI

Savva Ignatyev in RL reading group
ну, я представлял ситуацию когда классов много, а мы интерполируем между двумя какими-то
источник

SA

See All in RL reading group
источник

VM

Vladislav Myrov in RL reading group
ну точнее миксят не по 0.5, а по вероятностям из бета-распределения
источник

VM

Vladislav Myrov in RL reading group
весам, а не вероятностям*
источник
2020 January 30

P

Pavel Shvechikov in RL reading group
И ищу хорошую имплементацию PPO  / TRPO с желательно наиболее хорошими результатами.
Chainer выше видел, чутка не дотягивает до цифр, например в SAC.
Знает кто-нибудь хорошую имлементацию?
Может быть @scitator? поглядел в каталист, клеймов про репродьюс на mujoco не нашел.
источник

DN

Dmitry Nikulin in RL reading group
Pavel Shvechikov
И ищу хорошую имплементацию PPO  / TRPO с желательно наиболее хорошими результатами.
Chainer выше видел, чутка не дотягивает до цифр, например в SAC.
Знает кто-нибудь хорошую имлементацию?
Может быть @scitator? поглядел в каталист, клеймов про репродьюс на mujoco не нашел.
Чем Baselines не подходит?
источник
2020 January 31

AG

Aleksey Grinchuk in RL reading group
источник

DN

Dmitry Nikulin in RL reading group
🔥
источник

P

Pavel Shvechikov in RL reading group
Dmitry Nikulin
Чем Baselines не подходит?
Ссори, не увидел сразу.
Тем что даёт результаты плохие, хуже, чем в статьях репортятся
источник

DK

Dmitriy Krylov in RL reading group
Pavel Shvechikov
Ссори, не увидел сразу.
Тем что даёт результаты плохие, хуже, чем в статьях репортятся
Есть форк stable baselines
источник
2020 February 01

SK

Sergey Kolesnikov in RL reading group
Pavel Shvechikov
И ищу хорошую имплементацию PPO  / TRPO с желательно наиболее хорошими результатами.
Chainer выше видел, чутка не дотягивает до цифр, например в SAC.
Знает кто-нибудь хорошую имлементацию?
Может быть @scitator? поглядел в каталист, клеймов про репродьюс на mujoco не нашел.
в прошлом году была у нас article
https://github.com/catalyst-team/catalyst-rl-framework

но год прошел, сейчас пилю Catalyst.RL 2.0 - буду все опять перепроверять

so, прямо сейчас годноимплементации передать не могу, но...
источник

SK

Sergey Kolesnikov in RL reading group
если глянуть на лист
https://docs.google.com/spreadsheets/d/1EeFPd-XIQ3mq_9snTlAZSsFY7Hbnmd7P5bbT8LPuMn0/edit?usp=sharing

либо stable-baselines, либо SLM-lab,
если не TRPO, а PPO сойдет - то репа ikostrikov
источник

EK

Evgeny Kashin in RL reading group
Кажется в твоём списке не хватает https://github.com/astooke/rlpyt @scitator
источник
2020 February 02

S

Sebastian in RL reading group
GitHub - BY571/Upside-Down-Reinforcement-Learning
https://github.com/BY571/Upside-Down-Reinforcement-Learning
источник
2020 February 04

G

Gleb in RL reading group
Коллеги,
Ищу заинтересованных к себе в проект с топиком RL для AutoML-AutoAugment (CV) в Huawei. Рассматриваем уверенных мидлов на позицию постарше. Подробности в лс.
источник