Данная модель представляет собой компонент UNet, используемый в составе модели Stable Diffusion для генерации изображений. UNet отвечает за декодирование шума и получение финального изображения из латентного пространства.
Модель была обучена с использованием библиотеки 🤗 Hugging Face Diffusers и поддерживает генерацию изображений на основе текстовых запросов.
Состав модели
UNet: Основной компонент, отвечающий за обработку и генерацию изображения.
VAE: Вариационный автокодировщик для кодирования/декодирования изображений.
Tokenizer и Text Encoder: Используются для преобразования текстовых запросов в эмбеддинги.
Примеры сгенерированных изображений
Ниже приведены примеры изображений, созданных с использованием данной модели:
dog1.jpeg
dog.jpeg
Cat Britan.jpeg
Russia.jpeg
doges.jpeg
Использование
Для использования модели необходимо установить библиотеку diffusers и загрузить модель: