Reddit
Я обучил интерактивную модель мира Hollow Knight на базе диффузии с нуля, используя 400 тысяч кадров своего геймплея
Автор обучил с нуля диффузионную модель мира для Hollow Knight, используя 400 тысяч кадров своего геймплея без предобученных весов. Модель способна генерировать видео в ответ на действия игрока, реагируя на движения и атаки, а не просто воспроизводя запись. Проект демонстрирует потенциал action-conditioned video generation и world models на небольших датасетах.
score 40r/StableDiffusion