Reddit
Автономная генерация Bad Apple из единственного начального состояния с помощью крошечной рекуррентной динамической системы (417 тыс. параметров) [P]
Автор описывает подход к генерации полного видео Bad Apple (~6500 кадров) без подачи временных меток на вход: небольшая рекуррентная сеть (LSTM-подобная, 417 тыс. параметров) обучается воспроизводить непрерывный поток в скрытом пространстве и генерирует видео автономно из одного начального состояния (h_0, c_0). На этапе вывода система работает в замкнутом цикле, декодируя кадры 384x512 через апскейлинг с depthwise-separable свертками, достигая >200 FPS на RTX 4080. Для стабильного обучения на длинных последовательностях используются обучаемые таблицы скрытых состояний, которые отбрасываются при инференсе.
score 40r/MachineLearning