Назад к дайджесту
Новость

Дообучил ruGPT3 XL 1.3B до уровня современной LLM: сравнение с Gemma3 1B 2025 года

Статья описывает эксперимент по дообучению старой модели ruGPT3 XL 1.3B методами SFT и DPO для добавления чат-функционала. Результат сравнивается с современной Gemma3 1B и HabrGPT 0.5B. Материал демонстрирует, как современные техники могут оживить устаревшие архитектуры.