Reddit
Представляем ASCIITermDraw Bench: тестируем способность VLM рисовать ASCII-схемы
Представлен новый бенчмарк ASCIITermDraw-Bench для оценки способности мультимодальных моделей создавать и редактировать ASCII-диаграммы. Тест включает 80 задач на построение схем с раздельной оценкой структурной точности и семантики. В текущем лидерборде лидируют модели Gemma-4-31B-IT и Qwen3.7-Plus.
score 40r/MachineLearning