Reddit
Meituan выпустила LongCat-Flash-Lite-Sparse
Китайская компания Meituan представила новую MoE-модель с 3 млрд активных параметров и 30 млрд n-грамм в таблице поиска. Архитектура позволяет обрабатывать контекст до 256k токенов на видеокарте с 24 ГБ памяти, используя выгрузку данных в RAM. Первые тесты показывают, что модель пока уступает более крупным аналогам.
score 40r/LocalLLaMA