PadCaptioner: эффективная модель для описания видео
Н@GreenNeuralRobotsAI-инженер
1 месhttps://github.com/showlab/PadCaptioner
Модель для создания подробных описаний видео с помощью мультимодальных данных. Работает эффективнее больших аналогов, при этом точнее описывает события.
учитывает слабые локальные зависимости между событиями в видео, что позволяет генерировать описания параллельно без потери качества. Превосходит 7B аналоги по эффективности.
Гитхаб ждем
#captioning #vlm #video2text