跳到主要内容

翻译提供商

AI Localization Automator 支持五种不同的AI提供商,每种都有独特的优势和配置选项。选择最适合您项目需求、预算和质量要求的提供商。

Ollama (本地AI)

适用场景:隐私敏感项目、离线翻译、无限使用

Ollama 在您的本地机器上运行 AI 模型,提供完全的隐私和控制,无需 API 费用或互联网要求。

  • translategemma:12b (基于Gemma 3的专业翻译模型)
  • llama3.2 (推荐通用模型)
  • mistral (高效替代方案)
  • codellama (代码感知翻译)
  • 以及更多社区模型

配置选项

  • 基础URL:本地Ollama服务器(默认:http://localhost:11434
  • 模型:本地已安装模型的名称(必填)
  • 使用聊天API:启用以获得更好的对话处理
  • 温度:0.0-2.0(推荐0.3)
  • 最大令牌数:1-8,192个令牌
  • 上下文大小:512-32,768个令牌
  • 请求超时:10-300秒(本地模型可能较慢)
  • 启用流式传输:用于实时响应处理

优势

  • ✅ 完全隐私(数据不会离开您的设备)
  • ✅ 无API费用或使用限制
  • ✅ 支持离线运行
  • ✅ 完全控制模型参数
  • ✅ 丰富的社区模型
  • ✅ 无供应商锁定

注意事项

  • 💻 需要本地设置和性能足够的硬件
  • ⚡ 通常比云服务商慢
  • 🔧 需要更多技术设置
  • 📊 翻译质量因模型而异(有些可超越云服务商)
  • 💾 模型需要大量存储空间

设置 Ollama

  1. 安装 Ollama: 从 ollama.ai 下载并安装在你的系统上
  2. 下载模型: 使用 ollama pull translategemma:12b 下载你选择的模型
  3. 启动服务器: Ollama 会自动运行,或者通过 ollama serve 启动
  4. 配置插件: 在插件设置中设置基础 URL 和模型名称
  5. 测试连接: 当你应用配置时,插件将验证连接

OpenAI

最佳适用场景:最高的整体翻译质量,广泛的模型选择

OpenAI通过其Chat Completions API提供行业领先的语言模型,包括最新的GPT模型、推理模型以及支持网络搜索的模型。

可用模型

GPT-5 系列 (旗舰模型)

  • gpt-5, gpt-5-mini, gpt-5-nano
  • gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
  • gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
  • gpt-5.5, gpt-5.6-sol, gpt-5.6-luna

GPT-4.1 Family (高性能)

  • gpt-4.1, gpt-4.1-mini, gpt-4.1-nano

GPT-4o 系列(多模态)

  • gpt-4o, gpt-4o-mini, chatgpt-4o-latest

O-Series (推理模型 — temperature/top_p 不受支持)

  • o1, o1-pro, o3, o3-mini, o4-mini

网页搜索模型 (Temperature/top_p 不支持)

  • gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview

旧版 / 预览

  • gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

配置选项

  • API 密钥:您的 OpenAI API 密钥(必填)
  • 基础 URL:API 端点(默认:https://api.openai.com/v1/chat/completions
  • 模型:从上方列出的可用模型中选择
  • 使用温度:开启/关闭温度参数(对于 o 系列推理模型和网络搜索模型自动忽略)
  • 温度:0.0–2.0(为保持翻译一致性,建议使用 0.3)
  • Top P:0.0–1.0 核心采样参数(对于 o 系列推理模型和网络搜索模型忽略)
  • 最大完成令牌数:1–128,000 个令牌(包含输出令牌和推理令牌)
  • 请求超时:5–300 秒

优势

  • ✅ 始终如一的高质量翻译
  • ✅ 出色的上下文理解能力
  • ✅ 强大的格式保持能力
  • ✅ 广泛的语言支持
  • ✅ 可靠的 API 运行时间

注意事项

  • 💰 每次请求成本较高
  • 🌐 需要互联网连接
  • ⏱️ 基于等级的用量限制

Anthropic Claude

最适合:细腻的翻译、创意内容、注重安全的应用

Claude模型擅长理解上下文和细微差别,因此非常适合叙事密集的游戏和复杂的本地化场景。

可用模型

Claude 5 Family

  • claude-opus-5, claude-sonnet-5, claude-fable-5

Claude 4.8 系列

  • claude-opus-4-8

Claude 4.7 系列

  • claude-opus-4-7

Claude 4.6 Family

  • claude-opus-4-6, claude-sonnet-4-6

Claude 4.5 系列

  • claude-haiku-4-5 (快速高效)
  • claude-sonnet-4-5claude-opus-4-5

Claude 4.x 系列

  • claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0

Claude 3.x 系列(旧版)

  • claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

配置选项

  • API Key:您的 Anthropic API 密钥(必需)
  • Base URL:Claude API 端点
  • Model:从 Claude 模型系列中选择
  • Temperature:0.0–1.0(推荐 0.3)
  • Top K:Top-K 采样参数(0 表示未设置)
  • Max Tokens:1–64,000 个令牌
  • Request Timeout:5–300 秒
  • Anthropic Version:API 版本标头

优势

  • ✅ 出色的上下文感知能力
  • ✅ 非常适合创意/叙事内容
  • ✅ 强大的安全功能
  • ✅ 详细的推理能力(3.7+模型上的扩展思考)
  • ✅ 优秀的指令遵循能力

注意事项

  • 💰 高级定价模式
  • 🌐 需要互联网连接
  • 📏 Token 限制因模型而异

DeepSeek

最佳适用:高性价比翻译、高吞吐量、预算敏感的项目

DeepSeek以其他提供商成本的一小部分提供具有竞争力的翻译质量,使其成为大规模本地化项目的理想选择。

可用模型

  • deepseek-v4-pro
  • deepseek-v4-flash

配置选项

  • API Key: 您的DeepSeek API密钥(必填)
  • Base URL: DeepSeek API端点
  • Model: 在聊天模型与推理模型之间选择
  • Temperature: 0.0-2.0(推荐0.3)
  • Max Tokens: 1-8,192个令牌
  • Request Timeout: 5-300秒

优势

  • ✅ 性价比很高
  • ✅ 翻译质量好
  • ✅ 响应速度快
  • ✅ 配置简单
  • ✅ 高频率限制

注意事项

  • 📏 更低的令牌限制
  • 🆕 较新的提供商(记录较少)
  • 🌐 需要网络连接

Google Gemini

最适合:多语言项目、高性价比翻译、Google生态系统集成

Gemini模型提供强大的多语言能力,具有竞争力的定价和独特的功能,如思考模式,以增强推理能力。

可用模型

Gemini 3.x Family (预览)

  • gemini-3.1-progemini-3.1-flash-lightgemini-3.5-flashgemini-3.6-flash

Gemini 2.5 系列(支持思考)

  • gemini-2.5-pro(旗舰级,具备思考能力)
  • gemini-2.5-flash(快速,支持思考)
  • gemini-2.5-flash-lite(轻量级变体)

Gemini 2.0 Family

  • gemini-2.0-flash, gemini-2.0-flash-lite

最新别名

  • gemini-flash-latest, gemini-flash-lite-latest

配置选项

  • API 密钥:您的 Google AI API 密钥(必填)
  • 基础 URL:Gemini API 端点
  • 模型:从 Gemini 模型系列中选择
  • 温度:0.0–2.0(推荐 0.3)
  • 最大输出令牌数:1–8,192 个令牌
  • 请求超时:5–300 秒
  • 启用思考:为 2.5+ 模型激活增强推理
  • 思考预算:控制思考令牌分配(0 = 无思考)

优势

  • ✅ 强大的多语言支持
  • ✅ 有竞争力的定价
  • ✅ 高级推理(思考模式)
  • ✅ Google生态系统集成
  • ✅ 定期模型更新并提供最新模型的预览访问

注意事项

  • 🧠 思考模式增加 Token 用量
  • 📏 不同模型的 Token 限制
  • 🌐 需要互联网连接

选择合适的提供商

提供者最适合质量Cost设置隐私
Ollama隐私/离线变量*Free高级本地
OpenAI最高质量⭐⭐⭐⭐⭐💰💰💰Easy
Claude创意内容⭐⭐⭐⭐⭐💰💰💰💰Easy
DeepSeek预算项目⭐⭐⭐⭐钱袋Easy
Gemini多语言⭐⭐⭐⭐💰Easy

*Ollama的质量因使用的本地模型而异——一些现代本地模型可以达到甚至超过云提供商。

提供商配置提示

适用于所有云服务提供商:

  • 安全存储 API 密钥,不要将其提交到版本控制
  • 从保守的温度设置(0.3)开始,以确保翻译的一致性
  • 监控您的 API 使用情况和成本
  • 在进行大规模翻译运行之前,先使用小批量进行测试

对于 Ollama:

  • 确保充足的RAM(较大模型建议8GB以上)
  • 使用SSD存储以获得更好的模型加载性能
  • 考虑使用GPU加速以加快推理速度
  • 在依赖它进行生产翻译之前先在本地测试