본문으로 건너뛰기

번역 제공업체

AI Localization Automator는 다섯 가지 AI 제공자를 지원하며, 각각 고유한 강점과 구성 옵션을 가지고 있습니다. 프로젝트의 요구 사항, 예산, 품질 요구 사항에 가장 적합한 제공자를 선택하세요.

Ollama (로컬 AI)

가장 적합한 대상: 개인 정보 보호에 민감한 프로젝트, 오프라인 번역, 무제한 사용

Ollama는 사용자 컴퓨터에서 AI 모델을 로컬로 실행하여, API 비용이나 인터넷 연결 없이 완벽한 프라이버시와 제어를 제공합니다.

  • translategemma:12b (Gemma 3 기반의 특화된 번역 모델)
  • llama3.2 (권장되는 범용 모델)
  • mistral (효율적인 대안)
  • codellama (코드를 인식하는 번역)
  • 그리고 더 많은 커뮤니티 모델들

구성 옵션

  • 기본 URL: 로컬 Ollama 서버 (기본값: http://localhost:11434)
  • 모델: 로컬에 설치된 모델 이름 (필수)
  • 채팅 API 사용: 더 나은 대화 처리를 위해 활성화
  • 온도: 0.0-2.0 (0.3 권장)
  • 최대 토큰: 1-8,192 토큰
  • 컨텍스트 크기: 512-32,768 토큰
  • 요청 시간 제한: 10-300초 (로컬 모델은 느릴 수 있음)
  • 스트리밍 활성화: 실시간 응답 처리를 위해

강점

  • ✅ 완전한 프라이버시 (데이터가 기기 밖으로 나가지 않음)
  • ✅ API 비용이나 사용 제한 없음
  • ✅ 오프라인에서 작동
  • ✅ 모델 매개변수에 대한 완전한 제어
  • ✅ 다양한 커뮤니티 모델
  • ✅ 공급업체 종속 없음

고려 사항

  • 💻 로컬 설정과 적절한 하드웨어가 필요합니다
  • ⚡ 일반적으로 클라우드 제공업체보다 느립니다
  • 🔧 더 많은 기술적 설정이 필요합니다
  • 📊 번역 품질은 모델에 따라 크게 다릅니다 (일부는 클라우드 제공업체를 능가할 수 있습니다)
  • 💾 모델에 대한 대용량 저장 공간이 필요합니다

Ollama 설정하기

  1. Ollama 설치: ollama.ai에서 다운로드하여 시스템에 설치하세요
  2. 모델 다운로드: ollama pull translategemma:12b를 사용하여 선택한 모델을 다운로드하세요
  3. 서버 시작: Ollama가 자동으로 실행되거나 ollama serve로 시작합니다
  4. 플러그인 구성: 플러그인 설정에서 기본 URL과 모델 이름을 설정하세요
  5. 연결 테스트: 구성을 적용하면 플러그인이 연결을 확인합니다

OpenAI

최적 대상: 최고의 전반적인 번역 품질, 다양한 모델 선택

OpenAI는 Chat Completions API를 통해 업계 선도적인 언어 모델을 제공합니다. 여기에는 최신 GPT 모델, 추론 모델, 웹 검색 지원 모델이 포함됩니다.

사용 가능한 모델

GPT-5 시리즈 (플래그십 모델)

  • gpt-5, gpt-5-mini, gpt-5-nano
  • gpt-5.1, gpt-5.2, gpt-5.3-chat-latest
  • gpt-5.4, gpt-5.4-mini, gpt-5.4-nano
  • gpt-5.5, gpt-5.6-sol, gpt-5.6-luna

GPT-4.1 패밀리 (고성능)

  • gpt-4.1, gpt-4.1-mini, gpt-4.1-nano

GPT-4o 패밀리 (멀티모달)

  • gpt-4o, gpt-4o-mini, chatgpt-4o-latest

O-Series (추론 모델 — temperature/top_p 지원되지 않음)

  • o1, o1-pro, o3, o3-mini, o4-mini

웹 검색 모델 (Temperature/top_p는 지원되지 않음)

  • gpt-5-search-api, gpt-4o-search-preview, gpt-4o-mini-search-preview

레거시 / 프리뷰

  • gpt-4.5-preview, gpt-4, gpt-4-32k, gpt-4-turbo, gpt-3.5-turbo, gpt-3.5-turbo-16k

구성 옵션

  • API 키: 귀하의 OpenAI API 키 (필수)
  • 기본 URL: API 엔드포인트 (기본값: https://api.openai.com/v1/chat/completions)
  • 모델: 위에 나열된 사용 가능한 모델 중에서 선택하세요
  • 온도 사용: 온도 매개변수를 켜거나 끕니다 (o-시리즈 추론 및 웹 검색 모델에서는 자동으로 무시됨)
  • 온도: 0.0–2.0 (번역 일관성을 위해 0.3 권장)
  • Top P: 0.0–1.0 핵 샘플링 매개변수 (o-시리즈 추론 및 웹 검색 모델에서는 무시됨)
  • 최대 완료 토큰: 1–128,000 토큰 (출력 및 추론 토큰 모두 포함)
  • 요청 시간 초과: 5–300초

강점

  • ✅ 일관된 고품질 번역
  • ✅ 뛰어난 맥락 이해
  • ✅ 강력한 형식 유지
  • ✅ 광범위한 언어 지원
  • ✅ 신뢰할 수 있는 API 가동 시간

고려사항

  • 💰 요청당 비용이 더 높음
  • 🌐 인터넷 연결 필요
  • ⏱️ 등급에 따른 사용 제한

Anthropic Claude

적합한 대상: 미묘한 번역, 창의적인 콘텐츠, 안전 중심 애플리케이션

Claude 모델은 맥락과 뉘앙스를 이해하는 데 뛰어나므로, 스토리 중심 게임과 복잡한 현지화 시나리오에 이상적입니다.

사용 가능한 모델

Claude 5 제품군

  • claude-opus-5, claude-sonnet-5, claude-fable-5

Claude 4.8 제품군

  • claude-opus-4-8

Claude 4.7 제품군

  • claude-opus-4-7

Claude 4.6 Family

  • claude-opus-4-6, claude-sonnet-4-6

Claude 4.5 패밀리

  • claude-haiku-4-5 (빠르고 효율적)
  • claude-sonnet-4-5, claude-opus-4-5

Claude 4.x 패밀리

  • claude-sonnet-4-0, claude-opus-4-1, claude-opus-4-0

Claude 3.x 제품군 (레거시)

  • claude-3-7-sonnet-latest, claude-3-5-haiku-latest, claude-3-opus-latest

구성 옵션

  • API 키: 귀하의 Anthropic API 키 (필수)
  • 기본 URL: Claude API 엔드포인트
  • 모델: Claude 모델 제품군에서 선택
  • 온도: 0.0–1.0 (0.3 권장)
  • Top K: Top-K 샘플링 매개변수 (0 = 설정되지 않음)
  • 최대 토큰: 1–64,000 토큰
  • 요청 시간 초과: 5–300초
  • Anthropic 버전: API 버전 헤더

강점

  • ✅ 뛰어난 맥락 인식
  • ✅ 창의적/스토리텔링 콘텐츠에 적합
  • ✅ 강력한 안전 기능
  • ✅ 상세한 추론 능력 (3.7+ 모델의 확장 사고)
  • ✅ 뛰어난 명령어 수행

고려사항

  • 💰 프리미엄 가격 모델
  • 🌐 인터넷 연결 필요
  • 📏 토큰 제한은 모델에 따라 다름

DeepSeek

최적 대상: 비용 효율적인 번역, 높은 처리량, 예산을 고려한 프로젝트

DeepSeek은 다른 제공업체의 비용의 극히 일부로 경쟁력 있는 번역 품질을 제공하므로, 대규모 현지화 프로젝트에 이상적입니다.

사용 가능한 모델

  • deepseek-v4-pro
  • deepseek-v4-flash

설정 옵션

  • API 키: 귀하의 DeepSeek API 키 (필수)
  • 기본 URL: DeepSeek API 엔드포인트
  • 모델: 채팅 및 reasoner 모델 중에서 선택
  • 온도: 0.0-2.0 (0.3 권장)
  • 최대 토큰: 1-8,192 토큰
  • 요청 시간 초과: 5-300초

강점

  • ✅ 매우 비용 효율적
  • ✅ 좋은 번역 품질
  • ✅ 빠른 응답 시간
  • ✅ 간단한 구성
  • ✅ 높은 속도 제한

고려사항

  • 📏 더 낮은 토큰 제한
  • 🆕 최신 제공자 (실적 부족)
  • 🌐 인터넷 연결 필요

Google Gemini

최적 대상: 다국어 프로젝트, 비용 효율적인 번역, Google 생태계 통합

Gemini 모델은 강력한 다국어 지원 기능, 경쟁력 있는 가격, 그리고 향상된 추론을 위한 사고 모드와 같은 독특한 기능을 제공합니다.

사용 가능한 모델

Gemini 3.x 제품군 (미리보기)

  • gemini-3.1-pro, gemini-3.1-flash-light, gemini-3.5-flash, gemini-3.6-flash

Gemini 2.5 제품군 (생각 지원 포함)

  • gemini-2.5-pro (플래그십, 사고 기능 포함)
  • gemini-2.5-flash (빠름, 사고 기능 지원)
  • gemini-2.5-flash-lite (경량 변형)

Gemini 2.0 제품군

  • gemini-2.0-flash, gemini-2.0-flash-lite

최신 별칭

  • gemini-flash-latest, gemini-flash-lite-latest

구성 옵션

  • API 키: Google AI API 키 (필수)
  • 기본 URL: Gemini API 엔드포인트
  • 모델: Gemini 모델 군에서 선택
  • Temperature: 0.0–2.0 (0.3 권장)
  • 최대 출력 토큰: 1–8,192 토큰
  • 요청 타임아웃: 5–300초
  • Thinking 활성화: 2.5 이상 모델에 대해 향상된 추론 활성화
  • Thinking 예산: Thinking 토큰 할당 제어 (0 = Thinking 없음)

장점

  • ✅ 강력한 다국어 지원
  • ✅ 경쟁력 있는 가격
  • ✅ 고급 추론 (사고 모드)
  • ✅ Google 생태계 통합
  • ✅ 정기적인 모델 업데이트 및 최신 모델 미리보기 액세스

고려 사항

  • 🧠 사고 모드는 토큰 사용량을 증가시킵니다.
  • 📏 모델별 가변 토큰 제한
  • 🌐 인터넷 연결 필요

올바른 제공업체 선택

제공자최적의품질Cost설정개인정보
Ollama개인정보 보호 / 오프라인변수*Free고급로컬
OpenAI최고 품질⭐⭐⭐⭐⭐💰💰💰Easy클라우드
Claude창의적인 콘텐츠⭐⭐⭐⭐⭐💰💰💰💰Easy클라우드
DeepSeek예산 프로젝트⭐⭐⭐⭐💰Easy클라우드
Gemini다국어⭐⭐⭐⭐💰Easy클라우드

*Ollama의 품질은 사용된 로컬 모델에 따라 크게 달라집니다 - 일부 최신 로컬 모델은 클라우드 제공업체와 동등하거나 능가할 수 있습니다.

공급자 구성 팁

모든 클라우드 제공업체를 위한:

  • API 키를 안전하게 저장하고 버전 관리에 커밋하지 마세요
  • 일관된 번역을 위해 보수적인 온도 설정(0.3)으로 시작하세요
  • API 사용량과 비용을 모니터링하세요
  • 대규모 번역 실행 전에 소규모 배치로 테스트하세요

Ollama의 경우:

  • 충분한 RAM 확보 (대형 모델의 경우 8GB+ 권장)
  • 더 나은 모델 로딩 성능을 위해 SSD 스토리지 사용
  • 더 빠른 추론을 위해 GPU 가속 고려
  • 프로덕션 번역에 의존하기 전에 로컬에서 테스트