Назад к дайджесту
Reddit

Представляем ASCIITermDraw Bench: тестируем способность VLM рисовать ASCII-схемы

Представлен новый бенчмарк ASCIITermDraw-Bench для оценки способности мультимодальных моделей создавать и редактировать ASCII-диаграммы. Тест включает 80 задач на построение схем с раздельной оценкой структурной точности и семантики. В текущем лидерборде лидируют модели Gemma-4-31B-IT и Qwen3.7-Plus.

score 40r/MachineLearning