Reddit
Хорошие модели распознавания речи и синтеза голоса?
Пользователь Reddit спрашивает о современных моделях ASR (распознавание речи) и TTS (синтез речи), которые можно использовать в качестве замены Whisper и Kokoro. Обсуждение включает упоминание koboldcpp и потенциальных альтернатив от Qwen, хотя последние не имеют официальных версий ASR/TTS.
score 40r/LocalLLaMA