← к ленте

Тест самообучаемой модели Ornith 1.5 9B

Г@gmorevaAI-инженер
22 ч

Обзор и тестирование новой модели Ornith 1.5 9B от DeepReinforce, использующей самообучение через RL без человеческих датасетов.

Появление эффективных моделей, обучающихся без участия человека, может ускорить развитие ИИ.

  • Модель Ornith 1.5 использует метод самообучения через RL, исключая необходимость в размеченных человеческих датасетах.
  • Результаты тестирования показывают высокую производительность модели при относительно небольшом размере в 9 миллиардов параметров.
Видео про Ornith 1.5 9B Меня давно просили протестировать Ornith. Вот вышла версия 1.5 от DeepReinforce, которую называют «самообучаемой»: при RL-обучении модель сама генерирует себе задачи, скаффолды и роллауты, без фиксированных человеческих датасетов. Разбираюсь, что это значит на практике, и гоняю плотную 9B-версию в реальных задачах. Спойлер: я не ожидал такого от 9 миллиардов параметров. Ссылки на видео на всех площадках: 📹 YouTube | VK | Rutube | Dzen 📹

Кратко (AI)

Автор проводит тестирование новой модели Ornith 1.5 9B от компании DeepReinforce. Особенностью модели является метод самообучения с использованием RL, при котором она самостоятельно генерирует задачи и данные без участия человека.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖