Назад к дайджесту
Reddit

Ищем пайплайн для конвертации иллюстраций из учебников в редактируемые активы [R]

Разработчик ищет оптимальный Computer Vision пайплайн для обработки сканов учебников: детекция фигур, удаление встроенных подписей и подготовка геометрии для интерактивного отображения. Акцент на снижении затрат на инференс и использовании человеческой верификации вместо полностью автоматического решения. Обсуждаются методы детекции текста и контуров в сравнении с тяжёлыми мультимодальными моделями.

score 40r/MachineLearning