Назад к дайджесту
Reddit

Я обучил интерактивную модель мира Hollow Knight на базе диффузии с нуля, используя 400 тысяч кадров своего геймплея

Автор обучил с нуля диффузионную модель мира для Hollow Knight, используя 400 тысяч кадров своего геймплея без предобученных весов. Модель способна генерировать видео в ответ на действия игрока, реагируя на движения и атаки, а не просто воспроизводя запись. Проект демонстрирует потенциал action-conditioned video generation и world models на небольших датасетах.

score 40r/StableDiffusion