Pular para o conteúdo principal

Provedores de Tradução

O AI Localization Automator suporta cinco provedores de IA diferentes, cada um com pontos fortes e opções de configuração exclusivos. Escolha o provedor que melhor atende às necessidades, orçamento e requisitos de qualidade do seu projeto.

Ollama (IA Local)

Melhor para: projetos sensíveis à privacidade, tradução offline, uso ilimitado

Ollama executa modelos de IA localmente na sua máquina, oferecendo privacidade e controle completos sem custos de API ou requisitos de internet.

  • translategemma:12b (Modelo de tradução especializado baseado no Gemma 3)
  • llama3.2 (Recomendado para uso geral)
  • mistral (Alternativa eficiente)
  • codellama (Traduções com conhecimento de código)
  • E muitos outros modelos da comunidade

Opções de Configuração

  • URL Base: Servidor Ollama local (padrão: http://localhost:11434)
  • Modelo: Nome do modelo instalado localmente (obrigatório)
  • Usar API de Chat: Ativar para melhor manipulação de conversas
  • Temperatura: 0,0–2,0 (0,3 recomendado)
  • Máx. de Tokens: 1–8.192 tokens
  • Tamanho do Contexto: 512–32.768 tokens
  • Tempo Limite da Solicitação: 10–300 segundos (modelos locais podem ser mais lentos)
  • Habilitar Streaming: Para processamento de resposta em tempo real

Pontos fortes

  • ✅ Privacidade completa (nenhum dado sai da sua máquina)
  • ✅ Sem custos de API ou limites de uso
  • ✅ Funciona offline
  • ✅ Controle total sobre os parâmetros do modelo
  • ✅ Grande variedade de modelos da comunidade
  • ✅ Sem dependência de fornecedor

Considerações

  • 💻 Requer configuração local e hardware adequado
  • ⚡ Geralmente mais lento que provedores de nuvem
  • 🔧 Requer configuração mais técnica
  • 📊 A qualidade da tradução varia significativamente por modelo (alguns podem superar provedores de nuvem)
  • 💾 Grandes requisitos de armazenamento para modelos

Configurando o Ollama

  1. Instale o Ollama: Baixe de ollama.ai e instale no seu sistema
  2. Baixe Modelos: Use ollama pull translategemma:12b para baixar o modelo escolhido
  3. Inicie o Servidor: O Ollama roda automaticamente, ou inicie com ollama serve
  4. Configure o Plugin: Defina a URL base e o nome do modelo nas configurações do plugin
  5. Teste a Conexão: O plugin verificará a conectividade quando você aplicar a configuração

OpenAI

Melhor para: A mais alta qualidade geral de tradução, extensa seleção de modelos.

A OpenAI oferece modelos de linguagem líderes do setor por meio de sua API Chat Completions, incluindo os modelos GPT mais recentes, modelos de raciocínio e modelos habilitados para pesquisa na web.

Modelos Disponíveis

Família GPT-5 (modelos principais)

  • gpt-5, gpt-5-mini, gpt-5-nano
  • gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
  • gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
  • gpt-5.5, gpt-5.6-sol, gpt-5.6-luna

GPT-4.1 Family (Alto desempenho)

  • gpt-4.1, gpt-4.1-mini, gpt-4.1-nano

Família GPT-4o (Multimodal)

  • gpt-4o, gpt-4o-mini, chatgpt-4o-latest

O-Series (Modelos de raciocínio — temperature/top_p não suportado)

  • o1, o1-pro, o3, o3-mini, o4-mini

Modelos de Pesquisa da Web (Temperature/top_p não suportado)

  • gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview

Legado / Pré-visualização

  • gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

Opções de Configuração

  • Chave da API: Sua chave da API OpenAI (obrigatório)
  • URL Base: Endpoint da API (padrão: https://api.openai.com/v1/chat/completions)
  • Modelo: Escolha entre os modelos disponíveis listados acima
  • Usar Temperatura: Ativar/desativar o parâmetro de temperatura (ignorado automaticamente para modelos de raciocínio da série o e de pesquisa na web)
  • Temperatura: 0.0–2.0 (0.3 recomendado para consistência na tradução)
  • Top P: 0.0–1.0 parâmetro de amostragem nuclear (ignorado para modelos de raciocínio da série o e de pesquisa na web)
  • Máx. Tokens de Conclusão: 1–128.000 tokens (inclui tokens de saída e de raciocínio)
  • Tempo Limite de Requisição: 5–300 segundos

Pontos fortes

  • ✅ Traduções consistentemente de alta qualidade
  • ✅ Excelente compreensão de contexto
  • ✅ Forte preservação de formato
  • ✅ Amplo suporte a idiomas
  • ✅ Tempo de atividade confiável da API

Considerações

  • 💰 Custo mais alto por requisição
  • 🌐 Requer conexão com a internet
  • ⏱️ Limites de uso baseados no nível

Anthropic Claude

Melhor para: Traduções com nuances, conteúdo criativo, aplicações focadas em segurança

Os modelos Claude se destacam em entender contexto e nuances, tornando-os ideais para jogos com foco narrativo e cenários complexos de localização.

Modelos Disponíveis

Família Claude 5

  • claude-opus-5, claude-sonnet-5, claude-fable-5

Família Claude 4.8

  • claude-opus-4-8

Família Claude 4.7

  • claude-opus-4-7

Claude 4.6 Family

  • claude-opus-4-6, claude-sonnet-4-6

Família Claude 4.5

  • claude-haiku-4-5 (Rápido e eficiente)
  • claude-sonnet-4-5, claude-opus-4-5

Claude 4.x Família

  • claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0

Família Claude 3.x (Legado)

  • claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

Opções de Configuração

  • Chave da API: Sua chave da API Anthropic (obrigatória)
  • URL Base: Endpoint da API Claude
  • Modelo: Selecione da família de modelos Claude
  • Temperatura: 0.0–1.0 (0.3 recomendado)
  • Top K: Parâmetro de amostragem Top-K (0 = não definido)
  • Máximo de Tokens: 1–64.000 tokens
  • Tempo Limite da Requisição: 5–300 segundos
  • Versão da Anthropic: Cabeçalho de versão da API

Pontos fortes

  • ✅ Consciência de contexto excepcional
  • ✅ Ótimo para conteúdo criativo/narrativo
  • ✅ Fortes recursos de segurança
  • ✅ Capacidades detalhadas de raciocínio (pensamento estendido em modelos 3.7+)
  • ✅ Excelente seguimento de instruções

Considerações

  • 💰 Modelo de preço premium
  • 🌐 Conexão com a internet necessária
  • 📏 Limites de token variam por modelo

DeepSeek

Melhor para: tradução com bom custo-benefício, alto rendimento, projetos conscientes do orçamento

DeepSeek oferece qualidade de tradução competitiva por uma fração do custo de outros provedores, tornando-o ideal para projetos de localização em larga escala.

Modelos Disponíveis

  • deepseek-v4-pro
  • deepseek-v4-flash

Opções de Configuração

  • API Key: Sua chave de API DeepSeek (obrigatória)
  • Base URL: Endpoint da API DeepSeek
  • Model: Escolha entre modelos chat e reasoner
  • Temperature: 0.0-2.0 (0.3 recomendado)
  • Max Tokens: 1-8.192 tokens
  • Request Timeout: 5-300 segundos

Forças

  • ✅ Excelente custo-benefício
  • ✅ Boa qualidade de tradução
  • ✅ Tempos de resposta rápidos
  • ✅ Configuração simples
  • ✅ Altos limites de taxa

Considerações

  • 📏 Limites de token mais baixos
  • 🆕 Provedor mais novo (menos histórico)
  • 🌐 Requer conexão com a internet

Google Gemini

Melhor para: Projetos multilíngues, tradução com bom custo-benefício, integração com o ecossistema Google.

Os modelos Gemini oferecem fortes capacidades multilíngues com preços competitivos e recursos exclusivos, como o modo de raciocínio para um raciocínio aprimorado.

Modelos Disponíveis

Família Gemini 3.x (Prévia)

  • gemini-3.1-pro, gemini-3.1-flash-light, gemini-3.5-flash, gemini-3.6-flash

Gemini 2.5 Family (Com suporte a pensamento)

  • gemini-2.5-pro (Principal com raciocínio)
  • gemini-2.5-flash (Rápido, com suporte a raciocínio)
  • gemini-2.5-flash-lite (Variante leve)

Gemini 2.0 Família

  • gemini-2.0-flash, gemini-2.0-flash-lite

Últimos Apelidos

  • gemini-flash-latest, gemini-flash-lite-latest

Opções de Configuração

  • Chave de API: Sua chave de API do Google AI (obrigatório)
  • URL Base: Endpoint da API Gemini
  • Modelo: Selecione da família de modelos Gemini
  • Temperatura: 0.0–2.0 (0.3 recomendado)
  • Máximo de Tokens de Saída: 1–8,192 tokens
  • Tempo Limite da Solicitação: 5–300 segundos
  • Ativar Pensamento: Ative o raciocínio aprimorado para modelos 2.5+
  • Orçamento de Pensamento: Controle a alocação de tokens de pensamento (0 = sem pensamento)

Pontos fortes

  • ✅ Suporte multilíngue robusto
  • ✅ Preços competitivos
  • ✅ Raciocínio avançado (modo de pensamento)
  • ✅ Integração com o ecossistema Google
  • ✅ Atualizações regulares de modelos com acesso de pré-visualização aos modelos mais recentes

Considerações

  • 🧠 Modo de pensamento aumenta o uso de tokens
  • 📏 Limites variáveis de token por modelo
  • 🌐 Conexão com a internet necessária

Escolhendo o Provedor Certo

ProvedorMelhor paraQualidadeCostConfiguraçãoPrivacidade
OllamaPrivacidade/offlineVariável*FreeAvançadoLocal
OpenAIQualidade máxima⭐⭐⭐⭐⭐💰💰💰EasyNuvem
ClaudeConteúdo criativo⭐⭐⭐⭐⭐💰💰💰💰EasyNuvem
DeepSeekProjetos com orçamento limitado⭐⭐⭐⭐💰EasyNuvem
GeminiMultilíngue⭐⭐⭐⭐💰EasyNuvem

*A qualidade do Ollama varia significativamente com base no modelo local usado - alguns modelos locais modernos podem igualar ou superar provedores de nuvem.

Dicas de Configuração do Provedor

Para Todos os Provedores de Nuvem:

  • Armazene as chaves de API de forma segura e não as envie para o controle de versão
  • Comece com configurações conservadoras de temperatura (0.3) para traduções consistentes
  • Monitore o uso e os custos da sua API
  • Teste com pequenos lotes antes de grandes execuções de tradução

Para Ollama:

  • Garanta RAM adequada (recomendado 8GB+ para modelos maiores)
  • Use armazenamento SSD para melhor desempenho no carregamento de modelos
  • Considere aceleração GPU para inferência mais rápida
  • Teste localmente antes de confiar nele para traduções em produção