Назад к дайджесту
Reddit

MiniMax H3 научился клонировать голос в референсном видео-workflow

Пользователь продемонстрировал работу клонирования голоса в workflow MiniMax H3 ref2vid через ComfyUI: модель использует аудио-референс для синтеза речи в генерируемом видео. Это показывает развитие мультимодальных возможностей генеративного ИИ для создания видео с синхронизированным голосом.

score 40r/StableDiffusion