Como usar modelos de voz
Selecionando, Baixando e Empacotando Modelos
O plugin oferece suporte a vários idiomas, vozes e qualidades. Você pode baixar e gerenciar facilmente os modelos de voz necessários por meio das configurações do plugin no editor. Siga estas etapas para selecionar, baixar e preparar os modelos de voz:
- Abra as configurações do projeto no editor e navegue até Plugins -> Runtime Text To Speech.
- Na lista Modelos de Voz Disponíveis para Download, clique no botão Baixar ao lado do modelo de voz que deseja baixar. Você pode baixar vários modelos de voz simultaneamente.
- Após a conclusão do download, os modelos aparecerão na seção Modelos de Voz Baixados no topo da lista e estarão disponíveis para uso no seu projeto.
- Opcionalmente, você pode pré-visualizar os modelos de voz baixados digitando texto no campo de texto e clicando no botão Reproduzir. Isso sintetizará e reproduzirá o texto usando o modelo de voz selecionado. Esse recurso é útil para testar no editor e garantir que o modelo de voz soe conforme esperado.
Para excluir quaisquer modelos de voz baixados, clique no botão Excluir ao lado do modelo que você deseja remover.

Todos os modelos de voz baixados serão incluídos no pacote do seu projeto, portanto, para reduzir o tamanho do projeto, exclua quaisquer modelos de voz que você não precise mais.
Para uma lista completa de idiomas que vêm com modelos pré-incluídos, consulte Idiomas suportados.
Importando Modelos de Voz Personalizados
Além dos modelos de voz pré-configurados, você pode importar seus próprios modelos de voz personalizados. Isso é útil se você deseja usar uma voz que não está disponível na lista pré-configurada, ou se quiser adicionar suporte a um idioma que não vem incluído por padrão (consulte a lista de idiomas adicionais suportados para ver a lista de idiomas adicionais suportados pelo phonemizer subjacente).
O plugin suporta ambos os formatos de modelo de voz Piper e Kokoro:
- Nas configurações do plugin, clique no botão Importar Modelo de Voz Personalizado no topo da tela.
- Na caixa de diálogo que aparecer, selecione o tipo de modelo (Piper ou Kokoro).
- Navegue e selecione seu arquivo de modelo:
- Para o Piper: selecione um arquivo de modelo no formato ONNX (*.onnx)
- Para o Kokoro: selecione um arquivo de estilo no formato BIN (*.bin)
- Navegue e selecione o arquivo de configuração correspondente (*.json):
- Para Piper: Isso contém configurações como taxa de amostragem, mapeamentos de fonemas e parâmetros de inferência
- Para Kokoro: Isso contém a configuração do tokenizador
- Para modelos Kokoro, especifique o código de idioma (por exemplo, en-us, en-gb-x-rp, fr, es, etc.)
- Clique em Importar para adicionar o modelo de voz personalizado ao seu projeto.

Notas sobre Modelos de Voz Personalizados
-
Modelos Piper: Você pode usar qualquer modelo ONNX compatível com Piper com seu arquivo de configuração JSON correspondente. Isso é útil para vozes não disponíveis na lista pré-configurada ou para vozes treinadas sob medida. Você pode encontrar modelos Piper treinados pela comunidade no Hugging Face ou treinar seus próprios usando este guia.
-
Kokoro Models: Esses modelos usam um sistema de duas partes: arquivos de estilo (formato BIN) e um modelo ONNX compartilhado. Ao importar um arquivo de estilo Kokoro pela primeira vez, o plugin oferecerá o download automático do modelo ONNX necessário.
-
Códigos de Idioma: Para modelos Kokoro, o código de idioma é importante para a conversão adequada de fonemas. Códigos comuns incluem:
- Inglês (EUA):
en-us - Inglês (Reino Unido):
en-gb-x-rp - Espanhol:
es - Francês:
fr - Italiano:
it - Português (Brasil):
pt-br - Chinês (Mandarim):
cmn - Hindi:
hi - Alemão:
de
- Inglês (EUA):
Modelos de voz personalizados são tratados da mesma forma que os modelos baixados e serão empacotados com o seu projeto.