speech-to-speech huggingface
Build local voice agents with open-source models
- Lenguaje principal
- Python
- Stars
- 12,039
- Forks
- 1,475
Etiquetas
- Librería/SDK
- Herramienta CLI
- Agentes de IA
- Reconocimiento de voz
- Tiempo real
- Despliegue local
- Python
- Alternativa de código abierto
Resumen
Speech-to-Speech es un pipeline modular de baja latencia para construir agentes de voz (VAD → STT → LLM → TTS), expuesto mediante una API WebSocket compatible con OpenAI Realtime. Cada componente es intercambiable y admite backends tanto de proveedores en la nube como servidores 100% locales con mo…
README
<div align="center"> <div> </div> <img src="https://raw.githubusercontent.com/huggingface/speech-to-speech/main/logo.png" width="600"/> # Speech To Speech: crea agentes de voz con modelos de código abierto [](https://pypi.org/project/speec…