Назад к дайджесту
Reddit

2.6B-модель с вызовом функций и 128K контекстом работает на смартфоне со скоростью 30 токенов в секунду

Liquid AI выпустила LFM2.5-2.6B — компактную модель на 2.69B параметров с поддержкой 128K контекста и вызова инструментов, оптимизированную для многошаговых агентских рабочих процессов. Модель весит ~1.67 ГБ в формате GGUF, работает на телефоне со скоростью 30 токенов/сек и конкурирует с Qwen3.5-9B в бенчмарках на инструменты, позиционируясь как дешёвый локальный агент для рутинных задач.

score 40r/LocalLLaMA