Назад к дайджесту
Reddit

Tencent опубликовала код модели Hunyuan Prism для генерации видео и аудио

Tencent официально выпустила исходный код и веса модели Hunyuan Prism на GitHub и Hugging Face. Это модель для совместной генерации видео и аудио в разрешении 2K, использующая метод динамического разреженного внимания (Dynamic Sparse Attention). Ранее существовали сомнения в подлинности проекта, но теперь подтверждено, что демонстрационные ролики действительно созданы этой нейросетью.

score 55r/StableDiffusion