Назад к дайджесту
Reddit

Meituan выпустила LongCat-Flash-Lite-Sparse

Китайская компания Meituan представила новую MoE-модель с 3 млрд активных параметров и 30 млрд n-грамм в таблице поиска. Архитектура позволяет обрабатывать контекст до 256k токенов на видеокарте с 24 ГБ памяти, используя выгрузку данных в RAM. Первые тесты показывают, что модель пока уступает более крупным аналогам.

score 40r/LocalLLaMA