Новость
Как сэкономить на обработке PDF для нейросетей: почему текст дешевле изображений
Автоматическая обработка отсканированных PDF-файлов в моделях вроде Claude воспринимает страницы как изображения, что значительно увеличивает расход токенов и стоимость запросов. Извлечение текстового слоя из документов позволяет сократить потребление токенов в 3-6 раз, существенно снижая затраты на использование LLM.