Reddit
CausalVLBench: Оценка причинно-следственного рассуждения в больших визуальных языковых моделях
Представлен новый бенчмарк CausalVLBench для тестирования способности больших визуальных языковых моделей (VLM) к причинно-следственному анализу. Исследование фокусируется на выявлении ограничений нейросетей в понимании логики событий на изображениях.
score 40r/MachineLearning