Reddit
Настройка Gemma 4 для работы с SWEBench: решение ошибок LimitExceeded
Автор делится опытом запуска модели Gemma 4 31B через SWEBench Verified, сталкиваясь с ошибками LimitExceeded при использовании стандартных и альтернативных шаблонов чата. В посте анализируется сравнение с моделью Qwen 2.5 27B, демонстрирующей лучшую производительность, и приводится конфигурация llama-server с параметрами квантования и Jinja-шаблонами для агентного кодирования.
score 40r/LocalLLaMA