본문으로 건너뛰기

지원되는 언어

일부 음성 모델은 또한 여러 화자를 지원하며, 이는 사용 가능한 음성의 다양성을 크게 증가시킵니다 - 예를 들어, English LibriTTS만 해도 900명의 서로 다른 화자 이상을 포함합니다.

이것은 즉시 사용 가능한 지원 언어의 전체 목록이며, 다운로드할 수 있는 모델이 미리 포함되어 있습니다:

  • 영어 (미국) – 43개 음성 모델, 3가지 품질, 1895명 화자 (Kokoro 모델 포함)
  • 영어 (영국) – 19개 음성 모델, 3가지 품질, 143명 화자 (Kokoro 모델 포함)
  • 중국어 간체 (简体中文) – 109개 음성 모델, 2가지 품질, 110명 화자 (Kokoro 모델 포함)
  • 스페인어 멕시코 (Español Mexicano) – 2개 음성 모델, 2가지 품질, 2명 화자
  • 스페인어 유럽 (Español Europeo) – 10개 음성 모델, 2가지 품질, 11명 화자 (Kokoro 모델 포함)
  • 스페인어 아르헨티나 (Español Argentino) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 스페인어 콜롬비아 (Español Colombiano) – 2개 음성 모델, 1가지 품질, 2명 화자
  • 한국어 (한국어) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 러시아어 (Русский) – 4개 음성 모델, 1가지 품질, 4명 화자
  • 포르투갈어 브라질 (Português do Brasil) – 9개 음성 모델, 2가지 품질, 9명 화자 (Kokoro 모델 포함)
  • 포르투갈어 포르투갈 (Português de Portugal) – 3개 음성 모델, 1가지 품질, 2명 화자
  • 힌디어 (हिन्दी) – 7개 음성 모델, 1가지 품질, 7명 화자 (Kokoro 모델 포함)
  • 우르두어 (اردو) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 텔루구어 (తెలుగు) – 3개 음성 모델, 1가지 품질, 3명 화자
  • 말라얄람어 (മലയാളം) – 2개 음성 모델, 1가지 품질, 2명 화자
  • 독일어 (Deutsch) – 10개 음성 모델, 3가지 품질, 254명 화자
  • 프랑스어 (Français) – 8개 음성 모델, 2가지 품질, 134명 화자 (Kokoro 모델 포함)
  • 아랍어 (العربية) – 4개 음성 모델, 1가지 품질, 4명 화자
  • 터키어 (Türkçe) – 3개 음성 모델, 1가지 품질, 3명 화자
  • 폴란드어 (Polski) – 5개 음성 모델, 3가지 품질, 5명 화자
  • 이탈리아어 (Italiano) – 6개 음성 모델, 2가지 품질, 6명 화자 (Kokoro 모델 포함)
  • 우크라이나어 (Украї́нська мо́ва) – 5개 음성 모델, 3가지 품질, 7명 화자
  • 카탈루냐어 (Català) – 2개 음성 모델, 2가지 품질, 3명 화자
  • 불가리아어 (Български) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 체코어 (Čeština) – 1개 음성 모델, 2가지 품질, 2명 화자
  • 웨일스어 (Cymraeg) – 2개 음성 모델, 1가지 품질, 8명 화자
  • 덴마크어 (Dansk) – 2개 음성 모델, 1가지 품질, 2명 화자
  • 그리스어 (Ελληνικά) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 페르시아어 (فارسی) – 5개 음성 모델, 1가지 품질, 5명 화자
  • 핀란드어 (Suomi) – 1개 음성 모델, 2가지 품질, 2명 화자
  • 헝가리어 (Magyar) – 3개 음성 모델, 1가지 품질, 3명 화자
  • 바스크어 (Euskara) – 4개 음성 모델, 1가지 품질, 4명 화자
  • 아이슬란드어 (Íslenska) – 4개 음성 모델, 1가지 품질, 4명 화자
  • 인도네시아어 (Bahasa Indonesia) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 조지아어 (ქართული ენა) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 카자흐어 (Қазақша) – 3개 음성 모델, 2가지 품질, 8명 화자
  • 룩셈부르크어 (Lëtzebuergesch) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 라트비아어 (Latviešu) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 네팔어 (नेपाली) – 2개 음성 모델, 2가지 품질, 37명 화자
  • 네덜란드어 벨기에 (Vlaams) – 2개 음성 모델, 2가지 품질, 4명 화자
  • 네덜란드어 네덜란드 (Nederlands) – 8개 음성 모델, 2가지 품질, 59명 화자
  • 노르웨이어 (Bokmål / Nynorsk) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 루마니아어 (Română) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 슬로바키아어 (Slovenčina) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 슬로베니아어 (Slovenščina) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 세르비아어 (Srpski) – 1개 음성 모델, 1가지 품질, 2명 화자
  • 스웨덴어 (Svenska) – 4개 음성 모델, 1가지 품질, 4명 화자
  • 알바니아어 (Shqip) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 스와힐리어 (Kiswahili) – 1개 음성 모델, 1가지 품질, 1명 화자
  • 쿠르드어 쿠르만지 (Kurdî) – 1개 음성 모델, 1가지 품질, 2명 화자
  • 베트남어 (Tiếng Việt) – 3개 음성 모델, 2가지 품질, 67명 화자

기본적으로 이 플러그인은 51개 언어용 사전 탑재 모델을 제공하며, 317개의 음성 모델, 75가지 품질, 2834명의 화자를 지원합니다. 그 중 151개의 Kokoro 모델도 이용할 수 있습니다. 추가 언어는 사용자 정의 음성 모델을 가져와서 추가할 수 있습니다(아래 참조).

사용자 정의 모델로 더 많은 음성과 언어 추가하기

위 목록은 사전 포함되어 바로 다운로드할 수 있는 모델과 함께 제공되는 음성 및 언어만을 다루고 있습니다. 이것은 플러그인이 말할 수 있는 것에 대한 엄격한 제한이 아닙니다.

또한 커뮤니티에서 만든 것을 다운로드하거나 직접 학습시킨 것에 관계없이 어떤 Piper 호환 음성 모델이든 가져올 수 있습니다. 이를 통해 이미 지원되는 언어에 새로운 음성을 추가하거나, 기본 제공되지 않는 완전히 새로운 언어를 도입할 수 있습니다. 전체 안내는 사용자 정의 음성 모델 가져오기를 참조하세요.

위에 나열된 언어 외에도, 호환되는 음성 모델을 제공하는 경우 플러그인은 다음 언어로도 음성을 합성할 수 있습니다:

아프리칸스어, 알바니아어, 암하라어, 아라곤어, 아르메니아어, 아삼어, 아제르바이잔어, 바시키르어, 벨라루스어, 벵골어, 비슈누프리야마니푸르어, 보스니아어, 버마어, 추바시어, 크로아티아어, 에스토니아어, 게일어 (아일랜드 & 스코틀랜드), 그린란드어, 과라니어, 구자라트어, 아이티 크리올어, 하와이어, 히브리어, 칸나다어, 콘칸어, 키르기스어, 라트갈리아어, 리투아니아어, 룰레 사미어, 마케도니아어, 말레이어, 몰타어, 마오리어, 마라티어, 나와틀어 (고전), 노가이어, 오리야어, 오로모어, 파피아멘토어, 펀자브어, 케추아어, 츠와나어, 샨어 (타이야이), 신디어, 신할라어, 타밀어, 타타르어, 태국어, 투르크멘어, 위구르어, 및 우즈베크어.

이들 중 어떤 것도 플러그인에 사전 훈련된 모델이 포함되어 있지 않으므로, 직접 훈련하거나 예를 들어 Hugging Face에서 커뮤니티가 훈련한 모델을 찾은 다음 같은 방식으로 가져와야 합니다.