начал делать локальную студию для RLя (потому что все должны рлить)
там добавлены сейчас 88 енвов, ерализованы многие популярные алгоритмы
также алгоритмов добавлена память на LSTM/GRU
есть селф-плей alphazero с несколькими средами
есть возможность запускать несколько параллельных сред для одного эксперимента
https://github.com/researchim-ai/reinforcement-studio
пока что просто показываю.
где-нибудь в конце этой недели или на следующей мб будет билд уже под linux/windows, чтобы можно было с кайфом потыкать
в общем-то оно и сейчас работает вроде бы но надо потестить еще + некоторые фичи допиливаются
вообще эта штука делается как ответвление моделек дома
https://github.com/researchim-ai/models-at-home чисто под rl
модельки дома тоже потихонечку переезжаются на свою прилу
https://github.com/researchim-ai/models-at-home-studio
я туда хотел запихнуть страницу с "маленьким рлем". но как будто тут отдельная штука нужна была ну и я решил делать