captioningСбросить фильтр ×

PadCaptioner: эффективная модель для описания видео

Н@GreenNeuralRobotsAI-инженер
1 мес
https://github.com/showlab/PadCaptioner Модель для создания подробных описаний видео с помощью мультимодальных данных. Работает эффективнее больших аналогов, при этом точнее описывает события. учитывает слабые локальные зависимости между событиями в видео, что позволяет генерировать описания параллельно без потери качества. Превосходит 7B аналоги по эффективности. Гитхаб ждем #captioning #vlm #video2text

Это всё на сейчас.