Ana içeriğe geç

Ses modelleri nasıl kullanılır?

Modelleri Seçme, İndirme ve Paketleme

Eklenti birden çok dili, sesi ve kaliteyi destekler. İhtiyacınız olan ses modellerini editördeki eklenti ayarları aracılığıyla kolayca indirip yönetebilirsiniz. Ses modellerini seçmek, indirmek ve hazırlamak için bu adımları izleyin:

  1. Editörde proje ayarlarını açın ve Eklentiler -> Runtime Text To Speech yoluna gidin.
  2. İndirilebilecek Ses Modelleri listesinde, indirmek istediğiniz ses modelinin yanındaki İndir düğmesine tıklayın. Aynı anda birden fazla ses modeli indirebilirsiniz.
  3. İndirme tamamlandıktan sonra, modeller listenin en üstündeki İndirilen Ses Modelleri bölümünde görünecek ve projenizde kullanıma hazır olacak.
  4. İsteğe bağlı olarak, metin alanına metin girip Oynat düğmesine tıklayarak indirilen ses modellerini ön izleyebilirsiniz. Bu, seçili ses modelini kullanarak metni sentezler ve çalar. Bu özellik, ses modelinin beklendiği gibi ses vermesini sağlamak için editör içinde test yapmak için kullanışlıdır.

İndirilen ses modellerini silmek için, kaldırmak istediğiniz modelin yanındaki Delete düğmesine tıklayın.

İndirilen tüm ses modelleri projenizle birlikte paketlenecektir, bu yüzden proje boyutunu azaltmak için artık ihtiyacınız olmayan ses modellerini silin.

Önceden dahil edilmiş modellerle birlikte gelen dillerin tam listesi için Desteklenen Diller sayfasına bakın.

Özel Ses Modellerini İçe Aktarma

Önceden yapılandırılmış ses modellerine ek olarak, kendi özel ses modellerinizi içe aktarabilirsiniz. Bu, önceden yapılandırılmış listede bulunmayan bir ses kullanmak istediğinizde veya kutu dışında sunulmayan bir dile destek eklemek istediğinizde kullanışlıdır (altta yatan sesbirim ayrıştırıcı tarafından desteklenen ek dillerin listesi için desteklenen ek dillerin listesine bakın).

Eklenti hem Piper hem de Kokoro ses modeli formatlarını destekler:

  1. Eklenti ayarlarında, ekranın üst kısmındaki Özel Ses Modelini İçe Aktar düğmesine tıklayın.
  2. Açılan iletişim kutusunda model türünü seçin (Piper veya Kokoro).
  3. Model dosyanıza gözatın ve seçin:
    • Piper için: Bir ONNX formatında model dosyası seçin (*.onnx)
    • Kokoro için: Bir BIN formatında stil dosyası seçin (*.bin)
  4. İlgili yapılandırma dosyasını (*.json) göz atarak seçin:
    • Piper için: Bu, örnekleme hızı, fonelem eşlemeleri ve çıkarım parametreleri gibi ayarları içerir
    • Kokoro için: Bu, sembolleştirici yapılandırmasını içerir
  5. Kokoro modelleri için dil kodunu belirtin (örn. en-us, en-gb-x-rp, fr, es, vb.)
  6. Projenize özel ses modelini eklemek için Import düğmesine tıklayın.

Özel Ses Modelleri Hakkında Notlar

  • Piper Modelleri: Eşleşen JSON yapılandırma dosyasıyla birlikte herhangi bir Piper uyumlu ONNX modelini kullanabilirsiniz. Bu, önceden yapılandırılmış listede bulunmayan sesler veya özel eğitilmiş sesler için kullanışlıdır. Topluluk tarafından eğitilmiş Piper modellerini Hugging Face üzerinde bulabilir veya bu kılavuzu kullanarak kendi modelinizi eğitebilirsiniz.

  • Kokoro Models: Bu modeller iki parçalı bir sistem kullanır: stil dosyaları (BIN formatı) ve paylaşılan bir ONNX modeli. Bir Kokoro stil dosyasını ilk kez içe aktardığınızda, eklenti gerekli ONNX modelini otomatik olarak indirmeyi teklif edecektir.

  • Dil Kodları: Kokoro modelleri için dil kodu, doğru fonem dönüşümü için önemlidir. Yaygın kodlar şunları içerir:

    • İngilizce (ABD): en-us
    • İngilizce (BK): en-gb-x-rp
    • İspanyolca: es
    • Fransızca: fr
    • İtalyanca: it
    • Portekizce (Brezilya): pt-br
    • Çince (Mandarin): cmn
    • Hintçe: hi
    • Almanca: de

Özel ses modelleri, indirilen modellerle aynı şekilde ele alınır ve projenizle birlikte paketlenir.