Saltar al contenido principal

Proveedores de traducción

El AI Localization Automator admite cinco proveedores de IA diferentes, cada uno con sus propias fortalezas y opciones de configuración. Elija el proveedor que mejor se adapte a las necesidades, presupuesto y requisitos de calidad de su proyecto.

Ollama (IA local)

Mejor para: Proyectos sensibles a la privacidad, traducción sin conexión, uso ilimitado

Ollama ejecuta modelos de IA localmente en tu máquina, proporcionando total privacidad y control sin costos de API ni requisitos de internet.

  • translategemma:12b (Modelo de traducción especializado basado en Gemma 3)
  • llama3.2 (Propósito general recomendado)
  • mistral (Alternativa eficiente)
  • codellama (Traducciones conscientes del código)
  • Y muchos más modelos de la comunidad

Opciones de configuración

  • URL base: Servidor local de Ollama (por defecto: http://localhost:11434)
  • Modelo: Nombre del modelo instalado localmente (obligatorio)
  • Usar Chat API: Activar para un mejor manejo de conversaciones
  • Temperatura: 0.0-2.0 (0.3 recomendado)
  • Máximo de tokens: 1-8,192 tokens
  • Tamaño de contexto: 512-32,768 tokens
  • Tiempo de espera de solicitud: 10-300 segundos (los modelos locales pueden ser más lentos)
  • Habilitar Streaming: Para procesamiento de respuestas en tiempo real

Fortalezas

  • ✅ Privacidad completa (ningún dato sale de tu máquina)
  • ✅ Sin costos de API ni límites de uso
  • ✅ Funciona sin conexión
  • ✅ Control total sobre los parámetros del modelo
  • ✅ Gran variedad de modelos de la comunidad
  • ✅ Sin dependencia de proveedor

Consideraciones

  • 💻 Requiere configuración local y hardware potente
  • ⚡ Generalmente más lento que los proveedores en la nube
  • 🔧 Se requiere una configuración más técnica
  • 📊 La calidad de traducción varía significativamente según el modelo (algunos pueden superar a los proveedores en la nube)
  • 💾 Grandes requisitos de almacenamiento para los modelos

Configuración de Ollama

  1. Instalar Ollama: Descárgalo desde ollama.ai e instálalo en tu sistema
  2. Descargar modelos: Usa ollama pull translategemma:12b para descargar el modelo elegido
  3. Iniciar servidor: Ollama se ejecuta automáticamente, o inícialo con ollama serve
  4. Configurar plugin: Establece la URL base y el nombre del modelo en la configuración del plugin
  5. Probar conexión: El plugin verificará la conectividad cuando apliques la configuración

OpenAI

Ideal para: la más alta calidad de traducción general, amplia selección de modelos

OpenAI proporciona modelos de lenguaje líderes en la industria a través de su Chat Completions API, incluidos los últimos modelos GPT, modelos de razonamiento y modelos habilitados para búsqueda web.

Modelos disponibles

Familia GPT-5 (modelos insignia)

  • gpt-5, gpt-5-mini, gpt-5-nano
  • gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
  • gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
  • gpt-5.5, gpt-5.6-sol, gpt-5.6-luna

Familia GPT-4.1 (Alto rendimiento)

  • gpt-4.1, gpt-4.1-mini, gpt-4.1-nano

GPT-4o Family (Multimodal)

  • gpt-4o, gpt-4o-mini, chatgpt-4o-latest

O-Series (Modelos de razonamiento — temperature/top_p no compatible)

  • o1, o1-pro, o3, o3-mini, o4-mini

Modelos de Búsqueda Web (Temperature/top_p no compatible)

  • gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview

Legado / Vista previa

  • gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

Opciones de configuración

  • Clave de API: Tu clave de API de OpenAI (obligatorio)
  • URL base: Punto final de API (por defecto: https://api.openai.com/v1/chat/completions)
  • Modelo: Elige entre los modelos disponibles listados arriba
  • Usar Temperatura: Alterna el parámetro de temperatura activado/desactivado (ignorado automáticamente para modelos de razonamiento de la serie o y modelos de búsqueda web)
  • Temperatura: 0.0–2.0 (se recomienda 0.3 para consistencia en la traducción)
  • Top P: 0.0–1.0 parámetro de muestreo de núcleo (ignorado para modelos de razonamiento de la serie o y modelos de búsqueda web)
  • Máximo de tokens de finalización: 1–128,000 tokens (incluye tanto tokens de salida como de razonamiento)
  • Tiempo de espera de solicitud: 5–300 segundos

Fortalezas

  • ✅ Traducciones consistentemente de alta calidad
  • ✅ Excelente comprensión del contexto
  • ✅ Fuerte preservación del formato
  • ✅ Amplio soporte de idiomas
  • ✅ Tiempo de actividad confiable de la API

Consideraciones

  • 💰 Mayor costo por solicitud
  • 🌐 Requiere conexión a internet
  • ⏱️ Límites de uso según el nivel

Anthropic Claude

Mejor para: Traducciones matizadas, contenido creativo, aplicaciones centradas en la seguridad

Los modelos Claude sobresalen en entender el contexto y los matices, lo que los hace ideales para juegos con carga narrativa y escenarios complejos de localización.

Modelos Disponibles

Claude 5 Familia

  • claude-opus-5, claude-sonnet-5, claude-fable-5

Familia Claude 4.8

  • claude-opus-4-8

Familia Claude 4.7

  • claude-opus-4-7

Claude 4.6 Familia

  • claude-opus-4-6, claude-sonnet-4-6

Claude 4.5 Family

  • claude-haiku-4-5 (Rápido y eficiente)
  • claude-sonnet-4-5, claude-opus-4-5

Familia Claude 4.x

  • claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0

Familia Claude 3.x (Legado)

  • claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

Opciones de Configuración

  • Clave de API: Tu clave de API de Anthropic (obligatorio)
  • URL Base: Punto de conexión de la API de Claude
  • Modelo: Seleccionar de la familia de modelos Claude
  • Temperatura: 0.0–1.0 (0.3 recomendado)
  • Top K: Parámetro de muestreo Top-K (0 = no establecido)
  • Máximo de Tokens: 1–64,000 tokens
  • Tiempo de Espera de Solicitud: 5–300 segundos
  • Versión de Anthropic: Encabezado de versión de API

Fortalezas

  • ✅ Conciencia contextual excepcional
  • ✅ Excelente para contenido creativo/narrativo
  • ✅ Funciones de seguridad sólidas
  • ✅ Capacidades de razonamiento detalladas (pensamiento extendido en modelos 3.7+)
  • ✅ Seguimiento de instrucciones excelente

Consideraciones

  • 💰 Modelo de precios Premium
  • 🌐 Se requiere conexión a Internet
  • 📏 Los límites de tokens varían según el modelo

DeepSeek

Mejor para: Traducción rentable, alto rendimiento, proyectos con presupuesto ajustado

DeepSeek ofrece una calidad de traducción competitiva a una fracción del costo de otros proveedores, lo que lo hace ideal para proyectos de localización a gran escala.

Modelos disponibles

  • deepseek-v4-pro
  • deepseek-v4-flash

Opciones de configuración

  • Clave de API: Tu clave de API de DeepSeek (requerida)
  • URL base: Punto final de la API de DeepSeek
  • Modelo: Elige entre modelos de chat y razonamiento
  • Temperatura: 0.0-2.0 (se recomienda 0.3)
  • Máximo de tokens: 1-8,192 tokens
  • Tiempo de espera de solicitud: 5-300 segundos

Fortalezas

  • ✅ Muy rentable
  • ✅ Buena calidad de traducción
  • ✅ Tiempos de respuesta rápidos
  • ✅ Configuración sencilla
  • ✅ Límites de frecuencia altos

Consideraciones

  • 📏 Límites de tokens más bajos
  • 🆕 Proveedor más nuevo (menos historial)
  • 🌐 Requiere conexión a internet

Google Gemini

Mejor para: Proyectos multilingües, traducción rentable, integración con el ecosistema de Google

Los modelos Gemini ofrecen sólidas capacidades multilingües con precios competitivos y características únicas como el modo de pensamiento para un razonamiento mejorado.

Modelos disponibles

Familia Gemini 3.x (Vista previa)

  • gemini-3.1-pro, gemini-3.1-flash-light, gemini-3.5-flash, gemini-3.6-flash

Gemini 2.5 Family (con soporte de razonamiento)

  • gemini-2.5-pro (Buque insignia con razonamiento)
  • gemini-2.5-flash (Rápido, con soporte de razonamiento)
  • gemini-2.5-flash-lite (Variante ligera)

Familia Gemini 2.0

  • gemini-2.0-flash, gemini-2.0-flash-lite

Últimos alias

  • gemini-flash-latest, gemini-flash-lite-latest

Opciones de configuración

  • Clave de API: Tu clave de API de Google AI (obligatorio)
  • URL base: Punto de conexión de la API de Gemini
  • Modelo: Selecciona de la familia de modelos Gemini
  • Temperatura: 0.0–2.0 (0.3 recomendado)
  • Máximo de tokens de salida: 1–8,192 tokens
  • Tiempo de espera de solicitud: 5–300 segundos
  • Habilitar razonamiento: Activa el razonamiento mejorado para modelos 2.5+
  • Presupuesto de razonamiento: Controla la asignación de tokens de razonamiento (0 = sin razonamiento)

Fortalezas

  • ✅ Soporte multilingüe sólido
  • ✅ Precios competitivos
  • ✅ Razonamiento avanzado (modo de pensamiento)
  • ✅ Integración con el ecosistema de Google
  • ✅ Actualizaciones periódicas del modelo con acceso anticipado a los modelos más recientes

Consideraciones

  • 🧠 El modo de pensamiento aumenta el uso de tokens
  • 📏 Límites de tokens variables por modelo
  • 🌐 Se requiere conexión a Internet

Elegir el Proveedor Adecuado

ProveedorMejor paraCalidadCostConfiguraciónPrivacidad
OllamaPrivacidad/sin conexiónVariable*FreeAvanzadolocal
OpenAIMáxima calidad⭐⭐⭐⭐⭐💰💰💰EasyNube
ClaudeContenido creativo⭐⭐⭐⭐⭐💰💰💰💰EasyNube
DeepSeekProyectos de bajo presupuesto⭐⭐⭐⭐💰EasyNube
GeminiMultilingüe⭐⭐⭐⭐💰EasyNube

*La calidad para Ollama varía significativamente según el modelo local utilizado: algunos modelos locales modernos pueden igualar o superar a los proveedores en la nube.

Consejos de configuración del proveedor

Para todos los proveedores de nube:

  • Almacena las claves API de forma segura y no las subas al control de versiones
  • Comienza con configuraciones de temperatura conservadoras (0.3) para traducciones consistentes
  • Supervisa tu uso de API y costos
  • Prueba con lotes pequeños antes de realizar traducciones grandes

Para Ollama:

  • Asegúrese de tener suficiente RAM (se recomienda 8GB+ para modelos más grandes)
  • Utilice almacenamiento SSD para un mejor rendimiento de carga de modelos
  • Considere la aceleración por GPU para una inferencia más rápida
  • Pruebe localmente antes de confiar en él para traducciones en producción