Назад к дайджесту
Новость

Своя GPT-подобная LLM по вселенной Warhammer 40K с нуля. Часть 4: SFT на данных вопрос-ответ

Автор продолжает цикл материалов по созданию собственной decoder-only LLM архитектуры с нуля. В этой части рассматривается этап SFT (Supervised Fine-Tuning) для настройки модели на ведение диалога с помощью датасета «вопрос-ответ». Статья содержит практические детали дообучения нейросети.