Назад к дайджесту
Reddit

CLSS: генерация длинных аудио-видео последовательностей с помощью H3

Разработчик представил обновление для CLSS (Closed-Loop Streaming Synthesis) — метода потоковой генерации произвольно длинных аудио-видео фрагментов с использованием модели H3. Система использует перекрывающиеся чанки, калиброванное пере-зашумление контекста и коррекцию статистики для управления дрейфом при стыковке сегментов без изменения весов.

score 40r/StableDiffusion