Aller au contenu principal

Fournisseurs de traduction

Le AI Localization Automator prend en charge cinq fournisseurs d'IA différents, chacun avec des forces et des options de configuration uniques. Choisissez le fournisseur qui correspond le mieux aux besoins, au budget et aux exigences de qualité de votre projet.

Ollama (Local AI)

Idéal pour : projets sensibles à la vie privée, traduction hors ligne, utilisation illimitée

Ollama exécute les modèles d’IA localement sur votre machine, offrant une confidentialité totale et un contrôle complet, sans frais d’API ni connexion Internet.

  • translategemma:12b (Modèle de traduction spécialisé basé sur Gemma 3)
  • llama3.2 (Usage général recommandé)
  • mistral (Alternative efficace)
  • codellama (Traductions conscientes du code)
  • Et bien d'autres modèles de la communauté

Options de configuration

  • URL de base : Serveur Ollama local (par défaut : http://localhost:11434)
  • Modèle : Nom du modèle installé localement (obligatoire)
  • Utiliser l'API Chat : Activer pour une meilleure gestion des conversations
  • Température : 0,0-2,0 (0,3 recommandé)
  • Tokens max : 1-8 192 tokens
  • Taille du contexte : 512-32 768 tokens
  • Délai d'attente de la requête : 10-300 secondes (les modèles locaux peuvent être plus lents)
  • Activer le streaming : Pour un traitement des réponses en temps réel

Points forts

  • ✅ Confidentialité totale (aucune donnée ne quitte votre machine)
  • ✅ Aucun coût d'API ni limite d'utilisation
  • ✅ Fonctionne hors ligne
  • ✅ Contrôle total des paramètres du modèle
  • ✅ Large variété de modèles de la communauté
  • ✅ Pas de dépendance à un fournisseur

Considérations

  • 💻 Nécessite une configuration locale et du matériel performant
  • ⚡ Généralement plus lent que les fournisseurs cloud
  • 🔧 Configuration technique plus complexe requise
  • 📊 La qualité de traduction varie considérablement selon le modèle (certains peuvent surpasser les fournisseurs cloud)
  • 💾 Besoin de grands espaces de stockage pour les modèles

Configuration d'Ollama

  1. Installer Ollama : Téléchargez depuis ollama.ai et installez sur votre système
  2. Télécharger les modèles : Utilisez ollama pull translategemma:12b pour télécharger le modèle choisi
  3. Démarrer le serveur : Ollama s'exécute automatiquement, ou démarrez avec ollama serve
  4. Configurer le plugin : Définissez l'URL de base et le nom du modèle dans les paramètres du plugin
  5. Tester la connexion : Le plugin vérifiera la connectivité lorsque vous appliquez la configuration

OpenAI

Idéal pour : Meilleure qualité de traduction globale, sélection étendue de modèles

OpenAI fournit des modèles de langage de pointe via leur API Chat Completions, y compris les derniers modèles GPT, les modèles de raisonnement et les modèles avec recherche web.

Modèles disponibles

Famille GPT-5 (Modèles phares)

  • gpt-5, gpt-5-mini, gpt-5-nano
  • gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
  • gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
  • gpt-5.5, gpt-5.6-sol, gpt-5.6-luna

GPT-4.1 Family (haute performance)

  • gpt-4.1, gpt-4.1-mini, gpt-4.1-nano

GPT-4o Famille (Multimodale)

  • gpt-4o, gpt-4o-mini, chatgpt-4o-latest

O-Series (Modèles de raisonnement — température/top_p non pris en charge)

  • o1, o1-pro, o3, o3-mini, o4-mini

Modèles de recherche Web (Température/top_p non pris en charge)

  • gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview

Héritage / Aperçu

  • gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

Options de configuration

  • Clé API : Votre clé API OpenAI (obligatoire)
  • URL de base : Point de terminaison API (par défaut : https://api.openai.com/v1/chat/completions)
  • Modèle : Choisissez parmi les modèles disponibles listés ci-dessus
  • Utiliser la température : Activez/désactivez le paramètre de température (automatiquement ignoré pour les modèles de raisonnement de la série o et les modèles de recherche web)
  • Température : 0,0–2,0 (0,3 recommandé pour la cohérence de la traduction)
  • Top P : 0,0–1,0 paramètre d'échantillonnage nucleus (ignoré pour les modèles de raisonnement de la série o et les modèles de recherche web)
  • Nombre maximal de tokens de complétion : 1–128 000 tokens (inclut les tokens de sortie et de raisonnement)
  • Délai d'expiration de la requête : 5–300 secondes

Forces

  • ✅ Traductions constamment de haute qualité
  • ✅ Excellente compréhension du contexte
  • ✅ Forte préservation du format
  • ✅ Large prise en charge linguistique
  • ✅ Fiabilité de la disponibilité de l'API

Considérations

  • 💰 Coût plus élevé par requête
  • 🌐 Nécessite une connexion internet
  • ⏱️ Limites d'utilisation selon le niveau

Anthropic Claude

Idéal pour : Traductions nuancées, contenu créatif, applications axées sur la sécurité

Les modèles Claude excellent dans la compréhension du contexte et des nuances, ce qui les rend idéaux pour les jeux à forte composante narrative et les scénarios complexes de localisation.

Modèles disponibles

Claude 5 Family

  • claude-opus-5, claude-sonnet-5, claude-fable-5

Famille Claude 4.8

  • claude-opus-4-8

Claude 4.7 Famille

  • claude-opus-4-7

Claude 4.6 Famille

  • claude-opus-4-6, claude-sonnet-4-6

Claude 4.5 Famille

  • claude-haiku-4-5 (Rapide et efficace)
  • claude-sonnet-4-5, claude-opus-4-5

Claude 4.x Famille

  • claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0

Famille Claude 3.x (Héritage)

  • claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

Options de configuration

  • Clé API : Votre clé API Anthropic (requise)
  • URL de base : Point de terminaison de l'API Claude
  • Modèle : Sélectionnez parmi la famille de modèles Claude
  • Température : 0,0–1,0 (0,3 recommandé)
  • Top K : Paramètre d'échantillonnage Top-K (0 = non défini)
  • Tokens max : 1–64,000 tokens
  • Délai d'expiration de la requête : 5–300 secondes
  • Version Anthropic : En-tête de version de l'API

Forces

  • ✅ Conscience contextuelle exceptionnelle
  • ✅ Idéal pour le contenu créatif/narratif
  • ✅ Fonctionnalités de sécurité robustes
  • ✅ Capacités de raisonnement détaillées (réflexion étendue sur les modèles 3.7+)
  • ✅ Excellent suivi des instructions

Considérations

  • 💰 Modèle de tarification premium
  • 🌐 Connexion Internet requise
  • 📏 Les limites de tokens varient selon le modèle

DeepSeek

Idéal pour: traduction économique, débit élevé, projets soucieux de leur budget

DeepSeek offre une qualité de traduction compétitive à une fraction du coût des autres fournisseurs, ce qui en fait un choix idéal pour les projets de localisation à grande échelle.

Modèles disponibles

  • deepseek-v4-pro
  • deepseek-v4-flash

Options de configuration

  • Clé API : Votre clé API DeepSeek (obligatoire)
  • URL de base : Point de terminaison de l'API DeepSeek
  • Modèle : Choisissez entre les modèles chat et reasoner
  • Température : 0,0-2,0 (0,3 recommandé)
  • Jetons max : 1-8,192 tokens
  • Délai d'attente de la requête : 5-300 secondes

Forces

  • ✅ Très rentable
  • ✅ Bonne qualité de traduction
  • ✅ Temps de réponse rapides
  • ✅ Configuration simple
  • ✅ Limites de débit élevées

Considérations

  • 📏 Limites de tokens inférieures
  • 🆕 Fournisseur plus récent (moins d'antécédents)
  • 🌐 Nécessite une connexion Internet

Google Gemini

Idéal pour: Projets multilingues, traduction économique, intégration de l'écosystème Google

Les modèles Gemini offrent de solides capacités multilingues avec des prix compétitifs et des fonctionnalités uniques comme le mode de réflexion pour un raisonnement amélioré.

Modèles disponibles

Famille Gemini 3.x (Aperçu)

  • gemini-3.1-pro, gemini-3.1-flash-light, gemini-3.5-flash, gemini-3.6-flash

Gemini 2.5 Family (avec support de réflexion)

  • gemini-2.5-pro (Modèle phare avec raisonnement)
  • gemini-2.5-flash (Rapide, avec support de raisonnement)
  • gemini-2.5-flash-lite (Variante légère)

Famille Gemini 2.0

  • gemini-2.0-flash, gemini-2.0-flash-lite

Derniers alias

  • gemini-flash-latest, gemini-flash-lite-latest

Options de configuration

  • Clé API : Votre clé API Google AI (obligatoire)
  • URL de base : Point d'accès de l'API Gemini
  • Modèle : Sélectionnez parmi la famille de modèles Gemini
  • Température : 0.0–2.0 (0.3 recommandé)
  • Jetons de sortie max : 1–8 192 jetons
  • Délai de requête : 5–300 secondes
  • Activer la réflexion : Activez le raisonnement amélioré pour les modèles 2.5+
  • Budget de réflexion : Contrôlez l'allocation des jetons de réflexion (0 = pas de réflexion)

Forces

  • ✅ Support multilingue solide
  • ✅ Tarification compétitive
  • ✅ Raisonnement avancé (mode réflexion)
  • ✅ Intégration à l'écosystème Google
  • ✅ Mises à jour régulières des modèles avec accès anticipé aux modèles les plus récents

Considérations

  • 🧠 Le mode de réflexion augmente l'utilisation de jetons
  • 📏 Limites de jetons variables par modèle
  • 🌐 Connexion Internet requise

Choisir le bon fournisseur

FournisseurMeilleur pourQualitéCostConfigurationConfidentialité
OllamaConfidentialité/hors ligneVariable*FreeAvancéLocal
OpenAIQualité maximale⭐⭐⭐⭐⭐💰💰💰EasyNuage
ClaudeContenu créatif⭐⭐⭐⭐⭐💰💰💰💰EasyCloud
DeepSeekProjets budgétaires⭐⭐⭐⭐💰EasyCloud
GeminiMultilingue⭐⭐⭐⭐💰EasyNuage

*La qualité pour Ollama varie considérablement selon le modèle local utilisé - certains modèles locaux modernes peuvent égaler ou dépasser les fournisseurs cloud.

Conseils de configuration du fournisseur

Pour tous les fournisseurs cloud :

  • Stockez les clés API de manière sécurisée et ne les commitez pas dans le contrôle de version
  • Commencez avec des réglages de température conservateurs (0.3) pour des traductions cohérentes
  • Surveillez votre utilisation et vos coûts API
  • Testez avec de petits lots avant les grandes sessions de traduction

Pour Ollama

  • Assurez-vous d'avoir suffisamment de RAM (8 Go+ recommandé pour les modèles plus volumineux)
  • Utilisez un stockage SSD pour de meilleures performances de chargement des modèles
  • Envisagez l'accélération GPU pour une inférence plus rapide
  • Testez localement avant de vous y fier pour des traductions en production