Provedores de Tradução
O AI Localization Automator suporta cinco provedores de IA diferentes, cada um com pontos fortes e opções de configuração exclusivos. Escolha o provedor que melhor atende às necessidades, orçamento e requisitos de qualidade do seu projeto.
Ollama (IA Local)
Melhor para: projetos sensíveis à privacidade, tradução offline, uso ilimitado
Ollama executa modelos de IA localmente na sua máquina, oferecendo privacidade e controle completos sem custos de API ou requisitos de internet.
Modelos Populares
- translategemma:12b (Modelo de tradução especializado baseado no Gemma 3)
- llama3.2 (Recomendado para uso geral)
- mistral (Alternativa eficiente)
- codellama (Traduções com conhecimento de código)
- E muitos outros modelos da comunidade

Opções de Configuração
- URL Base: Servidor Ollama local (padrão:
http://localhost:11434) - Modelo: Nome do modelo instalado localmente (obrigatório)
- Usar API de Chat: Ativar para melhor manipulação de conversas
- Temperatura: 0,0–2,0 (0,3 recomendado)
- Máx. de Tokens: 1–8.192 tokens
- Tamanho do Contexto: 512–32.768 tokens
- Tempo Limite da Solicitação: 10–300 segundos (modelos locais podem ser mais lentos)
- Habilitar Streaming: Para processamento de resposta em tempo real
Pontos fortes
- ✅ Privacidade completa (nenhum dado sai da sua máquina)
- ✅ Sem custos de API ou limites de uso
- ✅ Funciona offline
- ✅ Controle total sobre os parâmetros do modelo
- ✅ Grande variedade de modelos da comunidade
- ✅ Sem dependência de fornecedor
Considerações
- 💻 Requer configuração local e hardware adequado
- ⚡ Geralmente mais lento que provedores de nuvem
- 🔧 Requer configuração mais técnica
- 📊 A qualidade da tradução varia significativamente por modelo (alguns podem superar provedores de nuvem)
- 💾 Grandes requisitos de armazenamento para modelos
Configurando o Ollama
- Instale o Ollama: Baixe de ollama.ai e instale no seu sistema
- Baixe Modelos: Use
ollama pull translategemma:12bpara baixar o modelo escolhido - Inicie o Servidor: O Ollama roda automaticamente, ou inicie com
ollama serve - Configure o Plugin: Defina a URL base e o nome do modelo nas configurações do plugin
- Teste a Conexão: O plugin verificará a conectividade quando você aplicar a configuração
OpenAI
Melhor para: A mais alta qualidade geral de tradução, extensa seleção de modelos.
A OpenAI oferece modelos de linguagem líderes do setor por meio de sua API Chat Completions, incluindo os modelos GPT mais recentes, modelos de raciocínio e modelos habilitados para pesquisa na web.
Modelos Disponíveis
Família GPT-5 (modelos principais)
- gpt-5, gpt-5-mini, gpt-5-nano
- gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
- gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
- gpt-5.5, gpt-5.6-sol, gpt-5.6-luna
GPT-4.1 Family (Alto desempenho)
- gpt-4.1, gpt-4.1-mini, gpt-4.1-nano
Família GPT-4o (Multimodal)
- gpt-4o, gpt-4o-mini, chatgpt-4o-latest
O-Series (Modelos de raciocínio — temperature/top_p não suportado)
- o1, o1-pro, o3, o3-mini, o4-mini
Modelos de Pesquisa da Web (Temperature/top_p não suportado)
- gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview
Legado / Pré-visualização
- gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

Opções de Configuração
- Chave da API: Sua chave da API OpenAI (obrigatório)
- URL Base: Endpoint da API (padrão:
https://api.openai.com/v1/chat/completions) - Modelo: Escolha entre os modelos disponíveis listados acima
- Usar Temperatura: Ativar/desativar o parâmetro de temperatura (ignorado automaticamente para modelos de raciocínio da série o e de pesquisa na web)
- Temperatura: 0.0–2.0 (0.3 recomendado para consistência na tradução)
- Top P: 0.0–1.0 parâmetro de amostragem nuclear (ignorado para modelos de raciocínio da série o e de pesquisa na web)
- Máx. Tokens de Conclusão: 1–128.000 tokens (inclui tokens de saída e de raciocínio)
- Tempo Limite de Requisição: 5–300 segundos
Pontos fortes
- ✅ Traduções consistentemente de alta qualidade
- ✅ Excelente compreensão de contexto
- ✅ Forte preservação de formato
- ✅ Amplo suporte a idiomas
- ✅ Tempo de atividade confiável da API
Considerações
- 💰 Custo mais alto por requisição
- 🌐 Requer conexão com a internet
- ⏱️ Limites de uso baseados no nível
Anthropic Claude
Melhor para: Traduções com nuances, conteúdo criativo, aplicações focadas em segurança
Os modelos Claude se destacam em entender contexto e nuances, tornando-os ideais para jogos com foco narrativo e cenários complexos de localização.
Modelos Disponíveis
Família Claude 5
- claude-opus-5, claude-sonnet-5, claude-fable-5
Família Claude 4.8
- claude-opus-4-8
Família Claude 4.7
- claude-opus-4-7
Claude 4.6 Family
- claude-opus-4-6, claude-sonnet-4-6
Família Claude 4.5
- claude-haiku-4-5 (Rápido e eficiente)
- claude-sonnet-4-5, claude-opus-4-5
Claude 4.x Família
- claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0
Família Claude 3.x (Legado)
- claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

Opções de Configuração
- Chave da API: Sua chave da API Anthropic (obrigatória)
- URL Base: Endpoint da API Claude
- Modelo: Selecione da família de modelos Claude
- Temperatura: 0.0–1.0 (0.3 recomendado)
- Top K: Parâmetro de amostragem Top-K (0 = não definido)
- Máximo de Tokens: 1–64.000 tokens
- Tempo Limite da Requisição: 5–300 segundos
- Versão da Anthropic: Cabeçalho de versão da API
Pontos fortes
- ✅ Consciência de contexto excepcional
- ✅ Ótimo para conteúdo criativo/narrativo
- ✅ Fortes recursos de segurança
- ✅ Capacidades detalhadas de raciocínio (pensamento estendido em modelos 3.7+)
- ✅ Excelente seguimento de instruções
Considerações
- 💰 Modelo de preço premium
- 🌐 Conexão com a internet necessária
- 📏 Limites de token variam por modelo
DeepSeek
Melhor para: tradução com bom custo-benefício, alto rendimento, projetos conscientes do orçamento
DeepSeek oferece qualidade de tradução competitiva por uma fração do custo de outros provedores, tornando-o ideal para projetos de localização em larga escala.
Modelos Disponíveis
- deepseek-v4-pro
- deepseek-v4-flash

Opções de Configuração
- API Key: Sua chave de API DeepSeek (obrigatória)
- Base URL: Endpoint da API DeepSeek
- Model: Escolha entre modelos chat e reasoner
- Temperature: 0.0-2.0 (0.3 recomendado)
- Max Tokens: 1-8.192 tokens
- Request Timeout: 5-300 segundos
Forças
- ✅ Excelente custo-benefício
- ✅ Boa qualidade de tradução
- ✅ Tempos de resposta rápidos
- ✅ Configuração simples
- ✅ Altos limites de taxa
Considerações
- 📏 Limites de token mais baixos
- 🆕 Provedor mais novo (menos histórico)
- 🌐 Requer conexão com a internet
Google Gemini
Melhor para: Projetos multilíngues, tradução com bom custo-benefício, integração com o ecossistema Google.
Os modelos Gemini oferecem fortes capacidades multilíngues com preços competitivos e recursos exclusivos, como o modo de raciocínio para um raciocínio aprimorado.
Modelos Disponíveis
Família Gemini 3.x (Prévia)
- gemini-3.1-pro, gemini-3.1-flash-light, gemini-3.5-flash, gemini-3.6-flash
Gemini 2.5 Family (Com suporte a pensamento)
- gemini-2.5-pro (Principal com raciocínio)
- gemini-2.5-flash (Rápido, com suporte a raciocínio)
- gemini-2.5-flash-lite (Variante leve)
Gemini 2.0 Família
- gemini-2.0-flash, gemini-2.0-flash-lite
Últimos Apelidos
- gemini-flash-latest, gemini-flash-lite-latest

Opções de Configuração
- Chave de API: Sua chave de API do Google AI (obrigatório)
- URL Base: Endpoint da API Gemini
- Modelo: Selecione da família de modelos Gemini
- Temperatura: 0.0–2.0 (0.3 recomendado)
- Máximo de Tokens de Saída: 1–8,192 tokens
- Tempo Limite da Solicitação: 5–300 segundos
- Ativar Pensamento: Ative o raciocínio aprimorado para modelos 2.5+
- Orçamento de Pensamento: Controle a alocação de tokens de pensamento (0 = sem pensamento)
Pontos fortes
- ✅ Suporte multilíngue robusto
- ✅ Preços competitivos
- ✅ Raciocínio avançado (modo de pensamento)
- ✅ Integração com o ecossistema Google
- ✅ Atualizações regulares de modelos com acesso de pré-visualização aos modelos mais recentes
Considerações
- 🧠 Modo de pensamento aumenta o uso de tokens
- 📏 Limites variáveis de token por modelo
- 🌐 Conexão com a internet necessária
Escolhendo o Provedor Certo
| Provedor | Melhor para | Qualidade | Cost | Configuração | Privacidade |
|---|---|---|---|---|---|
| Ollama | Privacidade/offline | Variável* | Free | Avançado | Local |
| OpenAI | Qualidade máxima | ⭐⭐⭐⭐⭐ | 💰💰💰 | Easy | Nuvem |
| Claude | Conteúdo criativo | ⭐⭐⭐⭐⭐ | 💰💰💰💰 | Easy | Nuvem |
| DeepSeek | Projetos com orçamento limitado | ⭐⭐⭐⭐ | 💰 | Easy | Nuvem |
| Gemini | Multilíngue | ⭐⭐⭐⭐ | 💰 | Easy | Nuvem |
*A qualidade do Ollama varia significativamente com base no modelo local usado - alguns modelos locais modernos podem igualar ou superar provedores de nuvem.
Dicas de Configuração do Provedor
Para Todos os Provedores de Nuvem:
- Armazene as chaves de API de forma segura e não as envie para o controle de versão
- Comece com configurações conservadoras de temperatura (0.3) para traduções consistentes
- Monitore o uso e os custos da sua API
- Teste com pequenos lotes antes de grandes execuções de tradução
Para Ollama:
- Garanta RAM adequada (recomendado 8GB+ para modelos maiores)
- Use armazenamento SSD para melhor desempenho no carregamento de modelos
- Considere aceleração GPU para inferência mais rápida
- Teste localmente antes de confiar nele para traduções em produção