Релиз мультимодальной модели GLM-5.2-Vision-NVFP4
Н@GreenNeuralRobotsAI-инженер
1 месПредставлена модель GLM-5.2-Vision-NVFP4 с визуальным энкодером MoonViT от Kimi-K2.6, поддержкой высокого разрешения и контекстом 1М токенов.
GLM-5.2-Vision-NVFP4
Версия GLM-5.2 с видением
тянет текст и картинки, отвечает на вопросы, описывает, руссуждает по изображениям
Прикрутили визуальный энкодер MoonViT от Kimi-K2.6
• работа с высоким разрешением без сильного падения скорости
• оптимизация под NVFP4
• мультимодальные эмбеддинги, лучше стыкует текст и визуал
• до 4096 токенов на картинку, контекст 1М
#vlm #nfvp4 #vqa #qa
Кратко (AI)
Вышла новая версия модели GLM-5.2-Vision-NVFP4, получившая визуальный энкодер MoonViT от Kimi-K2.6. Модель поддерживает работу с изображениями высокого разрешения, оптимизирована под NVFP4 и обладает контекстным окном в 1 миллион токенов.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖