← к ленте

Анонс мультимодальной модели MiniMax H3

Н@GreenNeuralRobotsAI-инженер
4 нед

Китайская компания MiniMax представила мультимодальную модель H3 с поддержкой видео, аудио и текста, которая будет выпущена в open source.

Появление новой мощной open source модели для генерации видео усиливает конкуренцию на рынке ИИ-инструментов.

  • Снижение стоимости генерации видео делает технологию доступнее для разработчиков и бизнеса.
  • Открытый исходный код позволяет интегрировать возможности модели в сторонние продукты.
  • Поддержка нативного стереозвука и V2V-редактирования расширяет возможности для создания контента.
MiniMax H3 Мультимодальная генеративная модель, объединяет текст, изображения, видео и аудио в едином контексте. • генерирует видео с нативным стереозвуком • выполняет редактирование по изображениям, видео, аудио • справляется с переносом движения V2V • работает с точными инструкциями • разрешение видео 2K по умолчанию • длительность генерируемого видео до 15 секунд • цена за секунду при 2K меньше трети от цены аналогов • при 768p цена меньше половины от цены 720p у аналогов Главное, его выпустят в опенсорс #multimodal

Кратко (AI)

Компания MiniMax анонсировала мультимодальную модель H3, способную работать с текстом, изображениями, видео и аудио в едином контексте. Модель поддерживает генерацию видео в разрешении 2K с нативным стереозвуком и будет доступна в формате open source.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖