ended8월 22일· 1 sources

Huggingface Speech To Speech - 오픈소스 모델로 로컬 음성 에이전트를 만드는 파이프라인

Why it matters

<ul> <li>사용자가 말하면 이를 감지하고(VAD) → 음성을 텍스트로 바꾸고(STT) → LLM이 질문을 이해하고 답변 생성 → 생성된 답변을 다시 음성으로 읽어주는(TTS) <strong>완전한 음성 대화 파이프라인</strong>을 로컬에서 구성할 수 있음</li> <li>각 단계는 각각 별도 스레드에서 동작하고 큐로 연결돼, 한 단계가...</p...

1
Sources
+0
24h
Growth
30d
Active

Sources

Related Issues