Proveedores de traducción
El AI Localization Automator admite cinco proveedores de IA diferentes, cada uno con sus propias fortalezas y opciones de configuración. Elija el proveedor que mejor se adapte a las necesidades, presupuesto y requisitos de calidad de su proyecto.
Ollama (IA local)
Mejor para: Proyectos sensibles a la privacidad, traducción sin conexión, uso ilimitado
Ollama ejecuta modelos de IA localmente en tu máquina, proporcionando total privacidad y control sin costos de API ni requisitos de internet.
Modelos populares
- translategemma:12b (Modelo de traducción especializado basado en Gemma 3)
- llama3.2 (Propósito general recomendado)
- mistral (Alternativa eficiente)
- codellama (Traducciones conscientes del código)
- Y muchos más modelos de la comunidad

Opciones de configuración
- URL base: Servidor local de Ollama (por defecto:
http://localhost:11434) - Modelo: Nombre del modelo instalado localmente (obligatorio)
- Usar Chat API: Activar para un mejor manejo de conversaciones
- Temperatura: 0.0-2.0 (0.3 recomendado)
- Máximo de tokens: 1-8,192 tokens
- Tamaño de contexto: 512-32,768 tokens
- Tiempo de espera de solicitud: 10-300 segundos (los modelos locales pueden ser más lentos)
- Habilitar Streaming: Para procesamiento de respuestas en tiempo real
Fortalezas
- ✅ Privacidad completa (ningún dato sale de tu máquina)
- ✅ Sin costos de API ni límites de uso
- ✅ Funciona sin conexión
- ✅ Control total sobre los parámetros del modelo
- ✅ Gran variedad de modelos de la comunidad
- ✅ Sin dependencia de proveedor
Consideraciones
- 💻 Requiere configuración local y hardware potente
- ⚡ Generalmente más lento que los proveedores en la nube
- 🔧 Se requiere una configuración más técnica
- 📊 La calidad de traducción varía significativamente según el modelo (algunos pueden superar a los proveedores en la nube)
- 💾 Grandes requisitos de almacenamiento para los modelos
Configuración de Ollama
- Instalar Ollama: Descárgalo desde ollama.ai e instálalo en tu sistema
- Descargar modelos: Usa
ollama pull translategemma:12bpara descargar el modelo elegido - Iniciar servidor: Ollama se ejecuta automáticamente, o inícialo con
ollama serve - Configurar plugin: Establece la URL base y el nombre del modelo en la configuración del plugin
- Probar conexión: El plugin verificará la conectividad cuando apliques la configuración
OpenAI
Ideal para: la más alta calidad de traducción general, amplia selección de modelos
OpenAI proporciona modelos de lenguaje líderes en la industria a través de su Chat Completions API, incluidos los últimos modelos GPT, modelos de razonamiento y modelos habilitados para búsqueda web.
Modelos disponibles
Familia GPT-5 (modelos insignia)
- gpt-5, gpt-5-mini, gpt-5-nano
- gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
- gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
- gpt-5.5, gpt-5.6-sol, gpt-5.6-luna
Familia GPT-4.1 (Alto rendimiento)
- gpt-4.1, gpt-4.1-mini, gpt-4.1-nano
GPT-4o Family (Multimodal)
- gpt-4o, gpt-4o-mini, chatgpt-4o-latest
O-Series (Modelos de razonamiento — temperature/top_p no compatible)
- o1, o1-pro, o3, o3-mini, o4-mini
Modelos de Búsqueda Web (Temperature/top_p no compatible)
- gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview
Legado / Vista previa
- gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

Opciones de configuración
- Clave de API: Tu clave de API de OpenAI (obligatorio)
- URL base: Punto final de API (por defecto:
https://api.openai.com/v1/chat/completions) - Modelo: Elige entre los modelos disponibles listados arriba
- Usar Temperatura: Alterna el parámetro de temperatura activado/desactivado (ignorado automáticamente para modelos de razonamiento de la serie o y modelos de búsqueda web)
- Temperatura: 0.0–2.0 (se recomienda 0.3 para consistencia en la traducción)
- Top P: 0.0–1.0 parámetro de muestreo de núcleo (ignorado para modelos de razonamiento de la serie o y modelos de búsqueda web)
- Máximo de tokens de finalización: 1–128,000 tokens (incluye tanto tokens de salida como de razonamiento)
- Tiempo de espera de solicitud: 5–300 segundos
Fortalezas
- ✅ Traducciones consistentemente de alta calidad
- ✅ Excelente comprensión del contexto
- ✅ Fuerte preservación del formato
- ✅ Amplio soporte de idiomas
- ✅ Tiempo de actividad confiable de la API
Consideraciones
- 💰 Mayor costo por solicitud
- 🌐 Requiere conexión a internet
- ⏱️ Límites de uso según el nivel
Anthropic Claude
Mejor para: Traducciones matizadas, contenido creativo, aplicaciones centradas en la seguridad
Los modelos Claude sobresalen en entender el contexto y los matices, lo que los hace ideales para juegos con carga narrativa y escenarios complejos de localización.
Modelos Disponibles
Claude 5 Familia
- claude-opus-5, claude-sonnet-5, claude-fable-5
Familia Claude 4.8
- claude-opus-4-8
Familia Claude 4.7
- claude-opus-4-7
Claude 4.6 Familia
- claude-opus-4-6, claude-sonnet-4-6
Claude 4.5 Family
- claude-haiku-4-5 (Rápido y eficiente)
- claude-sonnet-4-5, claude-opus-4-5
Familia Claude 4.x
- claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0
Familia Claude 3.x (Legado)
- claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

Opciones de Configuración
- Clave de API: Tu clave de API de Anthropic (obligatorio)
- URL Base: Punto de conexión de la API de Claude
- Modelo: Seleccionar de la familia de modelos Claude
- Temperatura: 0.0–1.0 (0.3 recomendado)
- Top K: Parámetro de muestreo Top-K (0 = no establecido)
- Máximo de Tokens: 1–64,000 tokens
- Tiempo de Espera de Solicitud: 5–300 segundos
- Versión de Anthropic: Encabezado de versión de API
Fortalezas
- ✅ Conciencia contextual excepcional
- ✅ Excelente para contenido creativo/narrativo
- ✅ Funciones de seguridad sólidas
- ✅ Capacidades de razonamiento detalladas (pensamiento extendido en modelos 3.7+)
- ✅ Seguimiento de instrucciones excelente
Consideraciones
- 💰 Modelo de precios Premium
- 🌐 Se requiere conexión a Internet
- 📏 Los límites de tokens varían según el modelo
DeepSeek
Mejor para: Traducción rentable, alto rendimiento, proyectos con presupuesto ajustado
DeepSeek ofrece una calidad de traducción competitiva a una fracción del costo de otros proveedores, lo que lo hace ideal para proyectos de localización a gran escala.
Modelos disponibles
- deepseek-v4-pro
- deepseek-v4-flash

Opciones de configuración
- Clave de API: Tu clave de API de DeepSeek (requerida)
- URL base: Punto final de la API de DeepSeek
- Modelo: Elige entre modelos de chat y razonamiento
- Temperatura: 0.0-2.0 (se recomienda 0.3)
- Máximo de tokens: 1-8,192 tokens
- Tiempo de espera de solicitud: 5-300 segundos
Fortalezas
- ✅ Muy rentable
- ✅ Buena calidad de traducción
- ✅ Tiempos de respuesta rápidos
- ✅ Configuración sencilla
- ✅ Límites de frecuencia altos
Consideraciones
- 📏 Límites de tokens más bajos
- 🆕 Proveedor más nuevo (menos historial)
- 🌐 Requiere conexión a internet
Google Gemini
Mejor para: Proyectos multilingües, traducción rentable, integración con el ecosistema de Google
Los modelos Gemini ofrecen sólidas capacidades multilingües con precios competitivos y características únicas como el modo de pensamiento para un razonamiento mejorado.
Modelos disponibles
Familia Gemini 3.x (Vista previa)
- gemini-3.1-pro, gemini-3.1-flash-light, gemini-3.5-flash, gemini-3.6-flash
Gemini 2.5 Family (con soporte de razonamiento)
- gemini-2.5-pro (Buque insignia con razonamiento)
- gemini-2.5-flash (Rápido, con soporte de razonamiento)
- gemini-2.5-flash-lite (Variante ligera)
Familia Gemini 2.0
- gemini-2.0-flash, gemini-2.0-flash-lite
Últimos alias
- gemini-flash-latest, gemini-flash-lite-latest

Opciones de configuración
- Clave de API: Tu clave de API de Google AI (obligatorio)
- URL base: Punto de conexión de la API de Gemini
- Modelo: Selecciona de la familia de modelos Gemini
- Temperatura: 0.0–2.0 (0.3 recomendado)
- Máximo de tokens de salida: 1–8,192 tokens
- Tiempo de espera de solicitud: 5–300 segundos
- Habilitar razonamiento: Activa el razonamiento mejorado para modelos 2.5+
- Presupuesto de razonamiento: Controla la asignación de tokens de razonamiento (0 = sin razonamiento)
Fortalezas
- ✅ Soporte multilingüe sólido
- ✅ Precios competitivos
- ✅ Razonamiento avanzado (modo de pensamiento)
- ✅ Integración con el ecosistema de Google
- ✅ Actualizaciones periódicas del modelo con acceso anticipado a los modelos más recientes
Consideraciones
- 🧠 El modo de pensamiento aumenta el uso de tokens
- 📏 Límites de tokens variables por modelo
- 🌐 Se requiere conexión a Internet
Elegir el Proveedor Adecuado
| Proveedor | Mejor para | Calidad | Cost | Configuración | Privacidad |
|---|---|---|---|---|---|
| Ollama | Privacidad/sin conexión | Variable* | Free | Avanzado | local |
| OpenAI | Máxima calidad | ⭐⭐⭐⭐⭐ | 💰💰💰 | Easy | Nube |
| Claude | Contenido creativo | ⭐⭐⭐⭐⭐ | 💰💰💰💰 | Easy | Nube |
| DeepSeek | Proyectos de bajo presupuesto | ⭐⭐⭐⭐ | 💰 | Easy | Nube |
| Gemini | Multilingüe | ⭐⭐⭐⭐ | 💰 | Easy | Nube |
*La calidad para Ollama varía significativamente según el modelo local utilizado: algunos modelos locales modernos pueden igualar o superar a los proveedores en la nube.
Consejos de configuración del proveedor
Para todos los proveedores de nube:
- Almacena las claves API de forma segura y no las subas al control de versiones
- Comienza con configuraciones de temperatura conservadoras (0.3) para traducciones consistentes
- Supervisa tu uso de API y costos
- Prueba con lotes pequeños antes de realizar traducciones grandes
Para Ollama:
- Asegúrese de tener suficiente RAM (se recomienda 8GB+ para modelos más grandes)
- Utilice almacenamiento SSD para un mejor rendimiento de carga de modelos
- Considere la aceleración por GPU para una inferencia más rápida
- Pruebe localmente antes de confiar en él para traducciones en producción