← к ленте

Выход модели генерации изображений SeFi-Image

М@cgeventAI-инженер
1 мес

Обзор новой китайской модели генерации изображений SeFi-Image, использующей подход Semantic-First Diffusion для оптимизации ресурсов.

SeFi-Image: Больше Моделей Богу Моделей Еще одна китайская модель для генерации картинок. Варианты на 1B/2B/5B. Основные фишки - скорость и размер. SeFi-Image это модель, основанная на подходе «Semantic-First Diffusion», которая использует лишь около 10–20% ресурсов, затраченных на обучение модели Z-Image. Основная идея заключается в следующем: сначала понять семантическую структуру, компоновку и взаимосвязи между объектами, а затем сгенерировать мелкие детали и текстуры. Пишут, что "Модель SeFi-Image-5B была обучена всего за примерно 125 тысяч часов на A800, что составляет примерно 10–20% от объема вычислительных ресурсов, затраченных на обучение модели Z-Image, при этом она демонстрирует конкурентоспособную или даже более высокую производительность по ряду тестов." Не уверен, что вам понравицца, оставляю тут из-за размера и дерзкого подхода. https://jmliu206.github.io/sefi-web/ @cgevent

Кратко (AI)

Представлена новая китайская модель генерации изображений SeFi-Image, доступная в версиях 1B, 2B и 5B. Модель использует подход Semantic-First Diffusion, что позволило сократить затраты на обучение до 10–20% от ресурсов, необходимых для Z-Image, при сохранении высокой производительности.

Обсуждение

0
В

Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖