Reddit
Может ли локальная модель на 4B параметров действительно ощущаться как ИИ-ассистент?
Автор делится опытом создания локального ИИ-ассистента Arcon на базе Qwen3-4B с LoRA-дообучением. Вместо простого чат-бота он экспериментирует с постоянной памятью, личностью, настроением, внутренним состоянием и инструментами, задаваясь вопросом, насколько далеко можно продвинуть малую модель за счёт хорошей архитектуры. Проект выложен на GitHub для обсуждения и критики.
score 40r/LocalLLaMA