Новость
Оптимизация кодинг-агентов: как сократить расход токенов вдвое без смены модели
Исследователи из NVIDIA, MIT и NTU использовали ИИ-агент для оптимизации harness кодинг-ассистента на базе модели Pi. Четыре найденных приема позволили сократить потребление токенов почти в два раза и снизить стоимость API на треть, при этом качество ответов на EdgeBench упло всего на 6%.