SeFi-Image: Больше Моделей Богу Моделей
Еще одна китайская модель для генерации картинок.
Варианты на 1B/2B/5B. Основные фишки - скорость и размер.
SeFi-Image это модель, основанная на подходе «Semantic-First Diffusion», которая использует лишь около 10–20% ресурсов, затраченных на обучение модели Z-Image.
Основная идея заключается в следующем: сначала понять семантическую структуру, компоновку и взаимосвязи между объектами, а затем сгенерировать мелкие детали и текстуры.
Пишут, что "Модель SeFi-Image-5B была обучена всего за примерно 125 тысяч часов на A800, что составляет примерно 10–20% от объема вычислительных ресурсов, затраченных на обучение модели Z-Image, при этом она демонстрирует конкурентоспособную или даже более высокую производительность по ряду тестов."
Не уверен, что вам понравицца, оставляю тут из-за размера и дерзкого подхода.
https://jmliu206.github.io/sefi-web/
@cgevent