进阶Python、PyTorch、Conda + pip

CosyVoice基于大语言模型的开源文本转语音系统

CosyVoice 是 FunAudioLLM 推出的开源文本转语音系统,基于大语言模型,支持九种主要语言和十八种以上中文方言,具备零样本声音克隆和跨语言说话人迁移能力。流式推理首音频延迟约150毫秒,可通过指令调整语言、情感、语速和音量。采用 Apache 2.0许可证,可在 ModelScope 和 HuggingFace 获取。

21.4K 星标
2.5K 分叉
799 问题
147 浏览
Python、PyTorch、Conda + pip
Apache-2.0
收录日期
更新日期

项目概述

CosyVoice 是 FunAudioLLM 推出的开源文本转语音系统,基于大语言模型,支持九种主要语言和十八种以上中文方言,具备零样本声音克隆和跨语言说话人迁移能力。流式推理首音频延迟约150毫秒,可通过指令调整语言、情感、语速和音量。采用 Apache 2.0许可证,可在 ModelScope 和 HuggingFace 获取。

项目简介

CosyVoice 是 FunAudioLLM 开发的开源文本转语音系统,基于大语言模型构建,旨在生成自然、高保真的语音。

核心功能

  • 支持九种主要语言和十八种以上中文方言。
  • 零样本声音克隆,可跨语言转移说话人。
  • 流式推理,首音频延迟约150毫秒。
  • 通过指令提示,开发者可调整语言、情感、速度和音量。

技术栈与许可证

主要使用 Python 和 PyTorch,通过 Conda 和 pip 管理依赖。项目采用 Apache 2.0许可证。

获取方式

CosyVoice 可在 ModelScope 和 HuggingFace 平台获取。

多语言语音生成TTS(Text-to-Speech)语音克隆实时语音合成低延迟语音模型PyTorch 语音模型开源语音合成AI 语音 API 能力Docker 部署 TTSLLM 语音集成

项目评分

0.0 (0 评价)

分享

常见问题

CosyVoice:基于大语言模型的开源文本转语音系统 是什么?

CosyVoice 是 FunAudioLLM 推出的开源文本转语音系统,基于大语言模型,支持九种主要语言和十八种以上中文方言,具备零样本声音克隆和跨语言说话人迁移能力。流式推理首音频延迟约150毫秒,可通过指令调整语言、情感、语速和音量。采用 Apache 2.0许可证,可在 ModelScope 和 HuggingFace 获取。

CosyVoice:基于大语言模型的开源文本转语音系统 用什么语言开发?

CosyVoice:基于大语言模型的开源文本转语音系统 主要使用 Python、PyTorch、Conda + pip 开发。

CosyVoice:基于大语言模型的开源文本转语音系统 使用什么开源协议?

CosyVoice:基于大语言模型的开源文本转语音系统 基于 Apache-2.0 协议开源。

相关项目

暂无结果

探索更多

评论

评论

0
0/500 字符

暂无评论

成为第一个评论的人

开源项目

探索、学习并参与开源 AI 项目,推动人工智能技术发展

查看全部