Назад к дайджесту
Reddit

Хорошие модели распознавания речи и синтеза голоса?

Пользователь Reddit спрашивает о современных моделях ASR (распознавание речи) и TTS (синтез речи), которые можно использовать в качестве замены Whisper и Kokoro. Обсуждение включает упоминание koboldcpp и потенциальных альтернатив от Qwen, хотя последние не имеют официальных версий ASR/TTS.

score 40r/LocalLLaMA