Reddit
Шум при temperature=0: почему жёсткие пороги ломают классификацию LLM
Автор экспериментально выявил, что даже при temperature=0 модель gpt-4.1-mini демонстрирует недетерминированность, способную менять категорию риска на границе порогов. Эксперимент показал нестабильность решений в продакшн-сценариях с жёсткой бинарной логикой. Это критично для разработчиков, внедряющих LLM в системы безопасности или классификации.
score 40r/OpenAI