Назад к дайджесту
Reddit

Лучшие практики запуска бенчмарков на онлайн-моделях

Автор разрабатывает бенчмарк для языка с низким ресурсом и опасается, что данные для тестирования могут попасть в обучающие выборки провайдеров API. Вопрос заключается в поиске надежных методов оценки онлайн-моделей без риска утечки входных данных и доверии к заявлениям компаний о запрете использования запросов для обучения.

score 40r/MachineLearning