← к ленте

PadCaptioner: эффективная модель для описания видео

Н@GreenNeuralRobotsAI-инженер
1 мес

Представлена модель PadCaptioner для генерации подробных описаний видео, превосходящая аналоги по эффективности и точности.

https://github.com/showlab/PadCaptioner Модель для создания подробных описаний видео с помощью мультимодальных данных. Работает эффективнее больших аналогов, при этом точнее описывает события. учитывает слабые локальные зависимости между событиями в видео, что позволяет генерировать описания параллельно без потери качества. Превосходит 7B аналоги по эффективности. Гитхаб ждем #captioning #vlm #video2text

Кратко (AI)

Представлена модель PadCaptioner, предназначенная для создания подробных описаний видео на основе мультимодальных данных. Разработчики заявляют, что модель эффективнее аналогов с 7B параметрами и лучше справляется с описанием событий за счет учета локальных зависимостей.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖