Fournisseurs de traduction
Le AI Localization Automator prend en charge cinq fournisseurs d'IA différents, chacun avec des forces et des options de configuration uniques. Choisissez le fournisseur qui correspond le mieux aux besoins, au budget et aux exigences de qualité de votre projet.
Ollama (Local AI)
Idéal pour : projets sensibles à la vie privée, traduction hors ligne, utilisation illimitée
Ollama exécute les modèles d’IA localement sur votre machine, offrant une confidentialité totale et un contrôle complet, sans frais d’API ni connexion Internet.
Modèles populaires
- translategemma:12b (Modèle de traduction spécialisé basé sur Gemma 3)
- llama3.2 (Usage général recommandé)
- mistral (Alternative efficace)
- codellama (Traductions conscientes du code)
- Et bien d'autres modèles de la communauté

Options de configuration
- URL de base : Serveur Ollama local (par défaut :
http://localhost:11434) - Modèle : Nom du modèle installé localement (obligatoire)
- Utiliser l'API Chat : Activer pour une meilleure gestion des conversations
- Température : 0,0-2,0 (0,3 recommandé)
- Tokens max : 1-8 192 tokens
- Taille du contexte : 512-32 768 tokens
- Délai d'attente de la requête : 10-300 secondes (les modèles locaux peuvent être plus lents)
- Activer le streaming : Pour un traitement des réponses en temps réel
Points forts
- ✅ Confidentialité totale (aucune donnée ne quitte votre machine)
- ✅ Aucun coût d'API ni limite d'utilisation
- ✅ Fonctionne hors ligne
- ✅ Contrôle total des paramètres du modèle
- ✅ Large variété de modèles de la communauté
- ✅ Pas de dépendance à un fournisseur
Considérations
- 💻 Nécessite une configuration locale et du matériel performant
- ⚡ Généralement plus lent que les fournisseurs cloud
- 🔧 Configuration technique plus complexe requise
- 📊 La qualité de traduction varie considérablement selon le modèle (certains peuvent surpasser les fournisseurs cloud)
- 💾 Besoin de grands espaces de stockage pour les modèles
Configuration d'Ollama
- Installer Ollama : Téléchargez depuis ollama.ai et installez sur votre système
- Télécharger les modèles : Utilisez
ollama pull translategemma:12bpour télécharger le modèle choisi - Démarrer le serveur : Ollama s'exécute automatiquement, ou démarrez avec
ollama serve - Configurer le plugin : Définissez l'URL de base et le nom du modèle dans les paramètres du plugin
- Tester la connexion : Le plugin vérifiera la connectivité lorsque vous appliquez la configuration
OpenAI
Idéal pour : Meilleure qualité de traduction globale, sélection étendue de modèles
OpenAI fournit des modèles de langage de pointe via leur API Chat Completions, y compris les derniers modèles GPT, les modèles de raisonnement et les modèles avec recherche web.
Modèles disponibles
Famille GPT-5 (Modèles phares)
- gpt-5, gpt-5-mini, gpt-5-nano
- gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
- gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
- gpt-5.5, gpt-5.6-sol, gpt-5.6-luna
GPT-4.1 Family (haute performance)
- gpt-4.1, gpt-4.1-mini, gpt-4.1-nano
GPT-4o Famille (Multimodale)
- gpt-4o, gpt-4o-mini, chatgpt-4o-latest
O-Series (Modèles de raisonnement — température/top_p non pris en charge)
- o1, o1-pro, o3, o3-mini, o4-mini
Modèles de recherche Web (Température/top_p non pris en charge)
- gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview
Héritage / Aperçu
- gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

Options de configuration
- Clé API : Votre clé API OpenAI (obligatoire)
- URL de base : Point de terminaison API (par défaut :
https://api.openai.com/v1/chat/completions) - Modèle : Choisissez parmi les modèles disponibles listés ci-dessus
- Utiliser la température : Activez/désactivez le paramètre de température (automatiquement ignoré pour les modèles de raisonnement de la série o et les modèles de recherche web)
- Température : 0,0–2,0 (0,3 recommandé pour la cohérence de la traduction)
- Top P : 0,0–1,0 paramètre d'échantillonnage nucleus (ignoré pour les modèles de raisonnement de la série o et les modèles de recherche web)
- Nombre maximal de tokens de complétion : 1–128 000 tokens (inclut les tokens de sortie et de raisonnement)
- Délai d'expiration de la requête : 5–300 secondes
Forces
- ✅ Traductions constamment de haute qualité
- ✅ Excellente compréhension du contexte
- ✅ Forte préservation du format
- ✅ Large prise en charge linguistique
- ✅ Fiabilité de la disponibilité de l'API
Considérations
- 💰 Coût plus élevé par requête
- 🌐 Nécessite une connexion internet
- ⏱️ Limites d'utilisation selon le niveau
Anthropic Claude
Idéal pour : Traductions nuancées, contenu créatif, applications axées sur la sécurité
Les modèles Claude excellent dans la compréhension du contexte et des nuances, ce qui les rend idéaux pour les jeux à forte composante narrative et les scénarios complexes de localisation.
Modèles disponibles
Claude 5 Family
- claude-opus-5, claude-sonnet-5, claude-fable-5
Famille Claude 4.8
- claude-opus-4-8
Claude 4.7 Famille
- claude-opus-4-7
Claude 4.6 Famille
- claude-opus-4-6, claude-sonnet-4-6
Claude 4.5 Famille
- claude-haiku-4-5 (Rapide et efficace)
- claude-sonnet-4-5, claude-opus-4-5
Claude 4.x Famille
- claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0
Famille Claude 3.x (Héritage)
- claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

Options de configuration
- Clé API : Votre clé API Anthropic (requise)
- URL de base : Point de terminaison de l'API Claude
- Modèle : Sélectionnez parmi la famille de modèles Claude
- Température : 0,0–1,0 (0,3 recommandé)
- Top K : Paramètre d'échantillonnage Top-K (0 = non défini)
- Tokens max : 1–64,000 tokens
- Délai d'expiration de la requête : 5–300 secondes
- Version Anthropic : En-tête de version de l'API
Forces
- ✅ Conscience contextuelle exceptionnelle
- ✅ Idéal pour le contenu créatif/narratif
- ✅ Fonctionnalités de sécurité robustes
- ✅ Capacités de raisonnement détaillées (réflexion étendue sur les modèles 3.7+)
- ✅ Excellent suivi des instructions
Considérations
- 💰 Modèle de tarification premium
- 🌐 Connexion Internet requise
- 📏 Les limites de tokens varient selon le modèle
DeepSeek
Idéal pour: traduction économique, débit élevé, projets soucieux de leur budget
DeepSeek offre une qualité de traduction compétitive à une fraction du coût des autres fournisseurs, ce qui en fait un choix idéal pour les projets de localisation à grande échelle.
Modèles disponibles
- deepseek-v4-pro
- deepseek-v4-flash

Options de configuration
- Clé API : Votre clé API DeepSeek (obligatoire)
- URL de base : Point de terminaison de l'API DeepSeek
- Modèle : Choisissez entre les modèles chat et reasoner
- Température : 0,0-2,0 (0,3 recommandé)
- Jetons max : 1-8,192 tokens
- Délai d'attente de la requête : 5-300 secondes
Forces
- ✅ Très rentable
- ✅ Bonne qualité de traduction
- ✅ Temps de réponse rapides
- ✅ Configuration simple
- ✅ Limites de débit élevées
Considérations
- 📏 Limites de tokens inférieures
- 🆕 Fournisseur plus récent (moins d'antécédents)
- 🌐 Nécessite une connexion Internet
Google Gemini
Idéal pour: Projets multilingues, traduction économique, intégration de l'écosystème Google
Les modèles Gemini offrent de solides capacités multilingues avec des prix compétitifs et des fonctionnalités uniques comme le mode de réflexion pour un raisonnement amélioré.
Modèles disponibles
Famille Gemini 3.x (Aperçu)
- gemini-3.1-pro, gemini-3.1-flash-light, gemini-3.5-flash, gemini-3.6-flash
Gemini 2.5 Family (avec support de réflexion)
- gemini-2.5-pro (Modèle phare avec raisonnement)
- gemini-2.5-flash (Rapide, avec support de raisonnement)
- gemini-2.5-flash-lite (Variante légère)
Famille Gemini 2.0
- gemini-2.0-flash, gemini-2.0-flash-lite
Derniers alias
- gemini-flash-latest, gemini-flash-lite-latest

Options de configuration
- Clé API : Votre clé API Google AI (obligatoire)
- URL de base : Point d'accès de l'API Gemini
- Modèle : Sélectionnez parmi la famille de modèles Gemini
- Température : 0.0–2.0 (0.3 recommandé)
- Jetons de sortie max : 1–8 192 jetons
- Délai de requête : 5–300 secondes
- Activer la réflexion : Activez le raisonnement amélioré pour les modèles 2.5+
- Budget de réflexion : Contrôlez l'allocation des jetons de réflexion (0 = pas de réflexion)
Forces
- ✅ Support multilingue solide
- ✅ Tarification compétitive
- ✅ Raisonnement avancé (mode réflexion)
- ✅ Intégration à l'écosystème Google
- ✅ Mises à jour régulières des modèles avec accès anticipé aux modèles les plus récents
Considérations
- 🧠 Le mode de réflexion augmente l'utilisation de jetons
- 📏 Limites de jetons variables par modèle
- 🌐 Connexion Internet requise
Choisir le bon fournisseur
| Fournisseur | Meilleur pour | Qualité | Cost | Configuration | Confidentialité |
|---|---|---|---|---|---|
| Ollama | Confidentialité/hors ligne | Variable* | Free | Avancé | Local |
| OpenAI | Qualité maximale | ⭐⭐⭐⭐⭐ | 💰💰💰 | Easy | Nuage |
| Claude | Contenu créatif | ⭐⭐⭐⭐⭐ | 💰💰💰💰 | Easy | Cloud |
| DeepSeek | Projets budgétaires | ⭐⭐⭐⭐ | 💰 | Easy | Cloud |
| Gemini | Multilingue | ⭐⭐⭐⭐ | 💰 | Easy | Nuage |
*La qualité pour Ollama varie considérablement selon le modèle local utilisé - certains modèles locaux modernes peuvent égaler ou dépasser les fournisseurs cloud.
Conseils de configuration du fournisseur
Pour tous les fournisseurs cloud :
- Stockez les clés API de manière sécurisée et ne les commitez pas dans le contrôle de version
- Commencez avec des réglages de température conservateurs (0.3) pour des traductions cohérentes
- Surveillez votre utilisation et vos coûts API
- Testez avec de petits lots avant les grandes sessions de traduction
Pour Ollama
- Assurez-vous d'avoir suffisamment de RAM (8 Go+ recommandé pour les modèles plus volumineux)
- Utilisez un stockage SSD pour de meilleures performances de chargement des modèles
- Envisagez l'accélération GPU pour une inférence plus rapide
- Testez localement avant de vous y fier pour des traductions en production