Т-Технологии представили Perseus: фреймворк для персонализации
Б@boris_againAI-инженер
1 месТ-Технологии выложили в открытый доступ Perseus — фреймворк для обучения моделей персонализации на основе истории пользовательских событий.
Снова релиз от Т-Технологий и снова опенсорс!
Т-Технологии выложили в открытый доступ Perseus - фреймворк для обучения моделей персонализации на историях пользовательских событий.
Главная идея: собрать все действия клиента в разных сервисах экосистемы в одну последовательность и построить поверх неё универсальный эмбеддинг пользователя, который переиспользуется в разных задачах. Кстати, в PLATA я успел позаниматься такой же задачей в банковской сфере. И даже доклад прочитал на DataFest (Салават, мы ждем записи!!!)
Perseus решает проблему холодного старта и разрозненности данных. Обычно модель учат на данных того сервиса, где она работает, но у новых сервисов истории почти нет, а схемы событий у всех разные. Perseus объединяет домены (транзакции, кэшбэки, шопинг, действия с банковскими продуктами) в единое хранилище и обрабатывает каждый домен своими обучаемыми энкодерами.
Архитектурно это выглядит так: берем историю событий, с помощью энкодеров получаем последовательность эмбеддингов, помещаем в миксер backbone, получаем эмбеддинг пользователя. В качестве backbone можно ставить разные sequence-модели — Transformer/BERT, ModernBERT, HSTU, LiGR, DA-Net, Mamba-варианты и свои реализации. Один и тот же пользовательский эмбеддинг используется сразу в четырех типах задач: retrieval, ranking, classification и regression.
По словам команды, подход дал прирост бизнес-метрик от 3% до 17%, а на предсказании корзины первого заказа в новом магазине — в среднем +10%, даже если пользователь там ещё ничего не покупал. Сейчас Perseus работает в Шопинге, повышенных кэшбэках и предиктивной поддержке.
Код на GitHub: https://github.com/perseus2026/perseus
Кратко (AI)
Компания Т-Технологии опубликовала в открытом доступе фреймворк Perseus, предназначенный для создания универсальных эмбеддингов пользователей на основе их истории действий в различных сервисах. Решение позволяет эффективно решать задачи персонализации, ранжирования и классификации, минимизируя проблему холодного старта для новых продуктов.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖