Новость
Подключил локальную Gemma к Codex для экономии лимита — на простой задаче расход вырос вдвое
Автор эксперимента на MacBook с локальными моделями gemma3:4b и gemma2:2b сделал MCP-сервер и подключил его к облачному Codex, чтобы перекладывать простые задачи на локальную модель. Однако замеры показали, что на простой задаче маршрут через локальную модель потребовал примерно вдвое больше облачного input, чем прямой ответ Codex. В материале — разбор ошибок в гипотезе и выводы, для каких задач маленькая локальная модель всё же полезна.