Reddit
Tencent опубликовала код модели Hunyuan Prism для генерации видео и аудио
Tencent официально выпустила исходный код и веса модели Hunyuan Prism на GitHub и Hugging Face. Это модель для совместной генерации видео и аудио в разрешении 2K, использующая метод динамического разреженного внимания (Dynamic Sparse Attention). Ранее существовали сомнения в подлинности проекта, но теперь подтверждено, что демонстрационные ролики действительно созданы этой нейросетью.
score 55r/StableDiffusion