speech-to-speech huggingface

Build local voice agents with open-source models

主要语言
Python
Stars
12,039
Forks
1,475

标签

  • 框架
  • AI工作流
  • 本地部署
  • 实时
  • 多模态
  • 库/SDK

摘要

这个项目是HuggingFace开发的语音对话智能体流水线,实现了VAD→STT→LLM→TTS的完整链路,支持低延迟本地部署。它提供与OpenAI Realtime API兼容的WebSocket服务,所有组件均可替换,LLM后端支持对接托管服务商、HF推理接口或本地vLLM/llama.cpp服务器。适用于需要构建完全本地化、开源化语音交互助手的场景,已在数千台Reachy Mini机器人上作为对话后端投入生产使用。

README

<div align="center"> <div>&nbsp;</div> <img src="https://raw.githubusercontent.com/huggingface/speech-to-speech/main/logo.png" width="600"/> # Speech To Speech:使用开源模型构建语音代理 [![PyPI](https://img.shields.io/pypi/v/speech-to-speech)](https://pypi.org/project/speech-to-speech/) [![Python](https://img.s…

查看完整页面