Reddit
Кастомный голосовой стек или платформа? Всё зависит от контроля над распознаванием речи (STT)
Автор рассуждает о выборе между готовыми платформами и кастомной инфраструктурой для голосовых агентов. Платформы подходят для валидации гипотез, но при проблемах с распознаванием речи, задержками или необходимостью тонкой настройки прерываний и редакции транскриптов лучше строить свой стек. Приводится пример архитектуры на базе Pipecat и Supabase для полного контроля над событиями и латентностью.
score 40r/AI_Agents