Reddit
3-миллиардная модель, генерирующая изображение пиксель в пиксель без использования VAE
Описывается новая архитектура генеративной модели с 3 миллиардами параметров, способная напрямую создавать изображения на уровне пикселей. В отличие от традиционных подходов, решение обходится без вариационного автокодировщика (VAE), что может означать более высокое качество или иную структуру вывода.
score 40r/StableDiffusion