Reddit
Утечка данных о GPT-6.1 намекает на архитектуру с вложенными моделями
Обсуждение в сообществе связывает снижение скорости генерации токенов в GPT-6.1-Sol с использованием циклической архитектуры (looped transformer), требующей нескольких проходов для вывода одного токена. Предполагается, что различные версии моделей (Astra, Sol, Luna) могут базироваться на единых весах с разной степенью рекуррентности для оптимизации вычислений.
score 40r/LocalLLaMA