Назад к дайджесту
Reddit

Настройка Gemma 4 для работы с SWEBench: решение ошибок LimitExceeded

Автор делится опытом запуска модели Gemma 4 31B через SWEBench Verified, сталкиваясь с ошибками LimitExceeded при использовании стандартных и альтернативных шаблонов чата. В посте анализируется сравнение с моделью Qwen 2.5 27B, демонстрирующей лучшую производительность, и приводится конфигурация llama-server с параметрами квантования и Jinja-шаблонами для агентного кодирования.

score 40r/LocalLLaMA