Назад к дайджесту
Reddit

Пошаговая конвертация моделей fp16 в int8 с использованием convrot в Google Colab

Инструкция по использованию утилиты ctq для квантования нейросетевых моделей из формата fp16 в int8 с поддержкой convrot. Процесс описан для Google Colab с интеграцией в ComfyUI, что позволяет оптимизировать потребление памяти и ускорить инференс.

score 55r/StableDiffusion