Назад к дайджесту
Reddit

CausalVLBench: Оценка причинно-следственного рассуждения в больших визуальных языковых моделях

Представлен новый бенчмарк CausalVLBench для тестирования способности больших визуальных языковых моделей (VLM) к причинно-следственному анализу. Исследование фокусируется на выявлении ограничений нейросетей в понимании логики событий на изображениях.

score 40r/MachineLearning