Новость
Меньше шума, больше смысла: опыт SESAME для улучшения речи
Студенты НИУ ВШЭ и VK представили модель SESAME для улучшения качества речи (Speech Enhancement) на базе разреженной смеси экспертов (sparse MoE). Архитектура адаптирует популярный в LLM подход MoE для аудио-задач, исследуя какие трюки из мира языковых моделей работают в обработке звука, а какие нет.