Назад к дайджесту
Новость

Можно ли обучить маленькую LLM без увеличения количества параметров?

Авторы исследуют возможность повышения компетентности небольших языковых моделей без роста числа весов. Метод основан на использовании верифицированной памяти и локального обучения с ограничением ресурсов на уровне бытовых GPU с 12 ГБ видеопамяти.