personaplex-7b-v1 nvidia

类型
model
任务
audio-to-audio
框架
moshi
下载量
229,427
点赞
2,667
访问
gated
文件
0

标签

  • 多模态
  • 语音合成
  • 语音识别
  • 对话数据
  • 音频生成
  • 大语言模型
  • 深度学习

摘要

Personaplex-7B-v1 是 NVIDIA 推出的 70 亿参数语音对话模型,采用 Moshi 框架,支持 audio-to-audio 的端到端语音交互。该模型能够直接以语音输入并生成语音回复,实现自然人机对话,适用于语音助手、实时语音对话等场景。

查看完整页面 · 查看原文