Коллеги, подскажите какую-нибудь работу, где учат модель среды с использованием replay buffer. Пока нашёл replay buffer только в muzero, но хочется чего-то попроще
в библиотеке rlpyt несколько стандартных моделей используют replay buffer, но они не учат модель среды. Еще replay buffer использует dreamer, он похож на muzero но в плане кода намного проще.
Коллеги, подскажите какую-нибудь работу, где учат модель среды с использованием replay buffer. Пока нашёл replay buffer только в muzero, но хочется чего-то попроще
Добрый день, коллеги, кто-нибудь пробовал тренировать RL модели для торговли на бирже? Хотелось понять насколько эффективен RL в этой области где данных не очень много.