语音与数字人 · 开源项目事实卡

PaddleSpeech

GitHubApache-2.0Python

PaddleSpeech 属于语音与数字人方向,主要用于语音识别、合成、复刻和数字人口播。

12.7kstar3 天前更新维护状态Apache-2.0 · 可评估商用商用提醒
在 GitHub 查看官方项目
适合解决完成语音识别、合成、复刻和数字人口播
更适合内容营销、客服、培训与直播团队
投入判断上手门槛:需评估。需要音色、肖像与内容版权授权
一分钟看懂

这个项目值得继续研究吗?

基于项目分类与公开字段整理

PaddleSpeech 属于语音与数字人方向,主要用于语音识别、合成、复刻和数字人口播。

本项目暂无 AI 中文解读:上游可读取的资料还不足以支撑一次可靠的解读, 我们不会据此编写项目价值判断。下面三答来自该项目所属的能力分类通用说明, 仅供快速定位方向;项目本身的可核验信息见下方「可核对的事实层」。

解决什么问题
完成语音识别、合成、复刻和数字人口播
适合什么团队
内容营销、客服、培训与直播团队
使用前注意
需要音色、肖像与内容版权授权;Apache-2.0 · 可评估商用。

本页用于缩短初步筛选时间,不构成技术、采购或法律结论。 正式使用前请在真实业务数据上验证,并以官方说明与许可证为准。

可核对的事实层

官方资料与来源

  • asr
  • code-switch
  • conformer
  • kws
  • punctuation-restoration
  • self-supervised-learning
  • sound-classification
  • speech-alignment
  • speech-recognition
  • speech-synthesis
  • speech-translation
  • streaming-asr
核对上游原始说明

Easy-to-use Speech Toolkit including Self-Supervised Learning model, SOTA/Streaming ASR with punctuation, Streaming TTS with text frontend, Speaker Verification System, End-to-End Speech Translation and Keyword Spotting. Won NAACL2022 Best Demo Award.