Reddit
Jev своими руками (DIY)
Автор описывает простую Jev-подобную схему инференса на обычных открытых LLM без NLI-дообучения и классификатора. Вместо генерации он оценивает true/false логиты для каждого кандидата, вычитает их и применяет softmax. На бенчмарке из 32 235 примеров Qwen3-4B показывает 65% точности, Qwen3-27B — 75.3%, Qwen3.6-35B-A3B — 75.5%. Репозиторий с реализацией выложен на GitHub.
score 40r/LocalLLaMA