Обновить

Улучшение агента на основе Q-Learning, торгующего stocks, путем добавления рекуррентности и формирования наград

Время на прочтение7 мин
Охват и читатели4.9K
Всего голосов 17: ↑17 и ↓0+17
Комментарии0

Комментарии

Здесь пока нет ни одного комментария, вы можете стать первым!
Зарегистрируйтесь на Хабре, чтобы оставить комментарий

Публикации