← к ленте

Запуск локальной студии для обучения RL-моделей

А@AGI_and_RLAI-инженер
3 дн

Разработчик представил Reinforcement Studio — локальный инструмент для обучения RL-моделей с поддержкой 88 сред, LSTM/GRU и self-play AlphaZero.

Инструмент упрощает локальную разработку и эксперименты с обучением моделей с подкреплением.

  • Позволяет запускать RL-эксперименты локально без сложной настройки инфраструктуры.
  • Поддерживает популярные архитектуры памяти и алгоритмы self-play.
  • Обеспечивает параллелизацию сред для ускорения обучения.
начал делать локальную студию для RLя (потому что все должны рлить) там добавлены сейчас 88 енвов, ерализованы многие популярные алгоритмы также алгоритмов добавлена память на LSTM/GRU есть селф-плей alphazero с несколькими средами есть возможность запускать несколько параллельных сред для одного эксперимента https://github.com/researchim-ai/reinforcement-studio пока что просто показываю. где-нибудь в конце этой недели или на следующей мб будет билд уже под linux/windows, чтобы можно было с кайфом потыкать в общем-то оно и сейчас работает вроде бы но надо потестить еще + некоторые фичи допиливаются вообще эта штука делается как ответвление моделек дома https://github.com/researchim-ai/models-at-home чисто под rl модельки дома тоже потихонечку переезжаются на свою прилу https://github.com/researchim-ai/models-at-home-studio я туда хотел запихнуть страницу с "маленьким рлем". но как будто тут отдельная штука нужна была ну и я решил делать
Запуск локальной студии для обучения RL-моделей

Кратко (AI)

Разработчик анонсировал создание локальной студии для обучения моделей с подкреплением (RL). Инструмент включает 88 сред, поддержку алгоритмов с памятью (LSTM/GRU) и self-play AlphaZero, а также возможность параллельного запуска сред.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖