speech-to-speech huggingface

Build local voice agents with open-source models

Lenguaje principal
Python
Stars
12,039
Forks
1,475

Etiquetas

  • Librería/SDK
  • Herramienta CLI
  • Agentes de IA
  • Reconocimiento de voz
  • Tiempo real
  • Despliegue local
  • Python
  • Alternativa de código abierto

Resumen

Speech-to-Speech es un pipeline modular de baja latencia para construir agentes de voz (VAD → STT → LLM → TTS), expuesto mediante una API WebSocket compatible con OpenAI Realtime. Cada componente es intercambiable y admite backends tanto de proveedores en la nube como servidores 100% locales con mo…

README

<div align="center"> <div>&nbsp;</div> <img src="https://raw.githubusercontent.com/huggingface/speech-to-speech/main/logo.png" width="600"/> # Speech To Speech: crea agentes de voz con modelos de código abierto [![PyPI](https://img.shields.io/pypi/v/speech-to-speech)](https://pypi.org/project/speec…

查看完整页面