進階Python、PyTorch、Conda + pip

CosyVoice基於大語言模型的開源文本轉語音系統

CosyVoice是FunAudioLLM推出的開源文本轉語音系統,基於大語言模型,支持九種主要語言和十八種以上中文方言,具備零樣本聲音克隆和跨語言說話人遷移能力。流式推理首音頻延遲約150毫秒,可通過指令調整語言、情感、語速和音量。採用Apache 2.0許可證,可在ModelScope和HuggingFace獲取。

21.4K 星標
2.5K 分叉
799 問題
147 流覽
Python、PyTorch、Conda + pip
Apache-2.0
收錄日期
更新日期

專案概述

CosyVoice是FunAudioLLM推出的開源文本轉語音系統,基於大語言模型,支持九種主要語言和十八種以上中文方言,具備零樣本聲音克隆和跨語言說話人遷移能力。流式推理首音頻延遲約150毫秒,可通過指令調整語言、情感、語速和音量。採用Apache 2.0許可證,可在ModelScope和HuggingFace獲取。

項目簡介

CosyVoice是FunAudioLLM開發的開源文本轉語音系統,基於大語言模型構建,旨在生成自然、高保真的語音。

核心功能

  • 支持九種主要語言和十八種以上中文方言。
  • 零樣本聲音克隆,可跨語言轉移說話人。
  • 流式推理,首音頻延遲約150毫秒。
  • 通過指令提示,開發者可調整語言、情感、速度和音量。

技術棧與許可證

主要使用Python和PyTorch,通過Conda和pip管理依賴。項目採用Apache 2.0許可證。

獲取方式

CosyVoice可在ModelScope和HuggingFace平臺獲取。

多語言語音生成TTS(Text-to-Speech)語音克隆實時語音合成低延遲語音模型PyTorch 語音模型開源語音合成AI 語音 API 能力Docker 部署 TTSLLM 語音整合

項目評分

0.0 (0 評價)

分享

常見問題

CosyVoice: 基於大語言模型的開源文本轉語音系統 是什麼?

CosyVoice是FunAudioLLM推出的開源文本轉語音系統,基於大語言模型,支持九種主要語言和十八種以上中文方言,具備零樣本聲音克隆和跨語言說話人遷移能力。流式推理首音頻延遲約150毫秒,可通過指令調整語言、情感、語速和音量。採用Apache 2.0許可證,可在ModelScope和HuggingFace獲取。

CosyVoice: 基於大語言模型的開源文本轉語音系統 用什麼語言開發?

CosyVoice: 基於大語言模型的開源文本轉語音系統 主要使用 Python、PyTorch、Conda + pip 開發。

CosyVoice: 基於大語言模型的開源文本轉語音系統 使用什麼開源授權?

CosyVoice: 基於大語言模型的開源文本轉語音系統 基於 Apache-2.0 授權開源。

相關專案

暫無結果

探索更多

評論

評論

0
0/500 字元

暫無評論

成為第一個評論的人

開源專案

探索、學習和貢獻開源 AI 專案,推動人工智慧技術的發展

查看全部