번역 용어집 101 — 캐릭터 이름과 용어 고정하기
번역 용어집은 모든 배치와 모든 제공자에 걸쳐 원본→대상 용어 쌍을 강제 치환하므로, 여주인공의 이름이 1장과 47장에서 똑같이 읽힙니다. 플레이스홀더 마스크의 작동 방식과 CSV 작업 흐름. Supporter 이상.
200줄짜리 일본 비주얼 노벨을 DeepL에 돌리면 여주인공의 이름이 Alice로 나옵니다. 다음 200줄은 그것을 Aris로 만듭니다. 그다음 배치는 Arisu로 정합니다. 4장쯤이면 어느 장면을 읽느냐에 따라 그녀는 이름이 세 개입니다.
이것이 긴 서사 게임에서 기계 번역의 가장 흔한 실패 방식입니다 — 문법도, 표현도 아니라 일관성 없는 고유명사입니다. 제공자는 배치 사이에 기억이 없어, 이름을 볼 때마다 가장 그럴듯한 로마자 표기를 매번 다시 추측합니다. 40시간짜리 RPG에 걸쳐 그 표류는 읽을 만한 번역을 네 사람이 번역한 것처럼 느끼게 만듭니다.
번역 용어집이 이것을 고칩니다. 원본-대상 용어 쌍을 한 번 정의하면 — アリス → Alice, 勇者 → Hero, 魔王 → Demon Lord — 모든 제공자의 모든 번역 배치가 그것을 존중합니다. 제공자는 그 용어를 원형으로는 아예 보지도 못합니다.
번역 용어집이란
RuneTranslate의 용어집은 세 열짜리 규칙 목록입니다:
- source — 고정할 원본 언어 부분 문자열(기본은 일본어. 지원되는 아무 원본 언어), 예:
勇者. - target — 출력에서 렌더링되기 원하는 방식, 예:
Hero. - targetLang — 규칙이 적용되는 출력 언어. 그래서 하나의 용어집이 영어 + 스페인어 + 독일어를 한꺼번에 커버할 수 있습니다.
전형적인 비주얼 노벨 등장인물에 이런 것을 30개 추가하면 고유명사 표류라는 부류 전체를 한 방에 제거한 셈입니다.
플레이스홀더 마스크는 어떻게 작동하나 (제공자에 구애받지 않음)
순진한 접근 — 제공자 실행 후에 대상 용어를 정규식으로 바꿔 넣는 것 — 은 DeepL에서는 그럭저럭 되지만 LLM에서는 깨집니다. LLM은 자신이 번역한 용어 주위로 문장을 이미 다시 표현해, 붕 뜬 관사와 이상한 대문자화를 남기니까요.
RuneTranslate는 용어집 용어를 제공자에 닿기 전에 가립니다. 러너가 배치된 모든 원본 문자열을 훑어 각 용어집 원본을 숫자 플레이스홀더 — [[G0]], [[G1]] 등 — 로 치환합니다(가장 긴 일치 용어 우선, 그래서 魔王軍이 魔王을 이김). 제공자는 오역할 수 없는 불투명한 토큰을 봅니다. 돌아오는 길에 그 플레이스홀더가 여러분의 대상 용어가 되고, 그다음 엔진 태그 마스크(RPG Maker 코드, KAG 태그, Ren’Py 삽입)가 그 위에 복원됩니다. 결과: DeepL이든 LLM이든 무료 Google Translate든 용어집 용어가 똑같이 렌더링됩니다.
우선순위 — TM이 용어집을 이기고, 용어집이 제공자를 이긴다
배치가 러너를 어떻게 흐르는지 알면 왜 용어집 편집이 제공자 크레딧을 들이지 않는지, 번역 메모리가 어떻게 협력하는지 설명됩니다:
- 번역 메모리(TM) 단락. 이 정확한 원본 문자열을 과거 어떤 프로젝트에서 이미 번역했다면, 캐시된 번역이 즉시 제공됩니다 — 제공자 호출 0회. 그 유닛은 제공자가 보기 전에 배치를 떠납니다.
- 용어집 마스크가 TM이 제공하지 않은 유닛에 적용됩니다.
- 제공자 호출이 가려진 텍스트에서 실행됩니다. 이것이 돈이 들고 / 할당량에 계산되는 유일한 단계입니다.
- 복원 — 용어집 플레이스홀더가 여러분의 대상 용어가 되고, 그다음 엔진 태그가 그 위에 복원됩니다.
- TM 쓰기 — 최종 번역된 줄이 캐시되므로, 다음에 이 일본어를 보면 무료 1단계 히트가 됩니다.
TM은 가장 큰 비용 절감이고, 용어집은 가장 큰 품질 절감입니다. 함께 있으면 복리로 늘어납니다. 줄 하나를 한 번 손 편집하면 TM에 캐시되고, 용어집이 캐시 히트와 새 배치 모두에 걸쳐 고유명사를 일관되게 유지합니다.
TM + 용어집 상호작용 (우회 가드)
한 가지 미묘한 극단 사례: 3개월 전에 용어집 없이 勇者가 든 100줄을 번역했고, TM이 그것들을 무작위로 Warrior / Champion / Hero로 캐시했다고 합시다. 이제 勇者 → Hero를 용어집에 추가합니다.
순진하게라면 TM은 여전히 Warrior를 돌려줄 것입니다 — 그게 캐시된 것이니까요. RuneTranslate는 이를 막습니다. TM 히트 시점에, 용어집 원본이 유닛에 나타나는데 캐시된 대상이 용어집의 대상 렌더링을 담고 있지 않으면, 캐시 히트가 우회되고 그 유닛이 새 제공자 호출로 떨어집니다. 실행 요약에 "N개 유닛이 용어집 변경을 존중하려 캐시를 우회함" 줄이 표시됩니다. 그래서 오래된 프로젝트에 새 용어집 항목을 추가해도 낡은 이름에 갇히는 일이 없습니다 — 그저 영향받은 유닛만 다시 실행하세요.
용어집 만들기 — 무엇을 추가할까
전형적인 프로젝트라면 영향력 순으로 정렬하세요:
- 등장인물 목록 먼저. 이름 있는 모든 캐릭터 — 위키, VNDB, 또는 게임 자체 크레딧 화면에서 가져오세요. 이것만으로 긴 게임에서 표류의 약 80%가 제거됩니다.
- 지명 둘째. 마을, 던전, 지역, 왕국 — 특히 그럴듯한 로마자 표기가 둘 이상인 한자.
- 대표 공격 / 스킬 셋째. 보스 기술, 반복 주문, 필살기 이름 — RPG와 전투 중심 VN에 중요합니다.
- 세계 고유 용어 넷째. 종족, 클래스, 유물, 화폐를 위한 지어낸 단어.
추가하지 말아야 할 것: 흔한 단어. 剣 → sword는 오탐을 부릅니다 — 제공자가 알아서 잘 렌더링했을 剣이 든 모든 복합어(魔剣, 聖剣, 剣士)를 고정합니다. 항목은 문자 그대로, 대소문자를 구별하는 부분 문자열 일치이므로, 고정하려는 고유명사에 고유할 만큼 충분히 길게 유지하세요.
CSV 가져오기 / 내보내기 — 용어집 공유
협업자와 번역하시나요? 설정의 용어집 탭에는 CSV 가져오기와 CSV 내보내기 버튼이 있어, 항목을 헤더 source,target,targetLang와 행당 한 용어를 가진 RFC-4180 파일로 왕복시킵니다 — 예: 勇者,Hero,en과 勇者,Héroe,es. 헤더 행은 필수이고, 쉼표나 따옴표가 든 필드는 큰따옴표로 감싸이며(내장 따옴표는 이중화), 가져오기는 선택적 BOM이 있는 UTF-8(Excel의 기본값)을 읽습니다. 빈 행과 지원되지 않는 targetLang을 가진 행은 행별 이유와 함께 건너뜁니다.
가져오기는 병합 모드(CSV 행을 위에 추가, 원본 + 언어로 중복 제거, 충돌 시 CSV가 이김)나 교체 모드(기존을 지우고 CSV만 사용)를 제공합니다. 병합은 부분 용어집을 공유하는 협업자에게 알맞은 기본값이고, 교체는 백업을 복원하기에 알맞습니다.
현재 한계
- 문자 그대로의 부분 문자열 일치만. 정규식도 와일드카드도 없음 —
勇者よ와勇者だ를 모두 고정하려면 항목 두 개를 추가하세요. - 항목당 대상 언어 하나. 한 행은 하나의 출력 언어에 묶이므로 "勇者 → Hero (en) + Héroe (es) + Held (de)"는 세 행입니다. CSV 형식이 이를 자연스럽게 지원합니다.
- 유료 등급 전용(Supporter 이상). 무료 등급은 용어집 카드를 보여주지만 항목이 번역 실행에 영향을 주지 않습니다. 발견 대화상자가 Patreon을 가리킵니다.
마무리
기계 번역의 모든 품질 지렛대 중, 용어집은 노력 대비 영향의 비율이 가장 높습니다 — 그것을 만드는 10분이 뒤에서 일관성 없는 이름을 손으로 고치는 몇 시간을 아낍니다. 등장인물 목록으로 시작해 1차 패스를 내보내고, 결과를 읽으며 표류를 알아챌 때마다 용어를 추가하세요.
그것을 어조를 잘 다루는 제공자(VN에는 Anthropic Claude가 제 기본값입니다)와 AI 리파이너와 짝지으면, 출력이 이미 "읽을 만한 기계 번역"을 지나 "가벼운 손 편집으로 팬 번역으로 출시 가능"에 들어섭니다.
실제 프로젝트에서 용어집을 시험하려면 RuneTranslate 다운로드하세요. Supporter($3/mo) 기능이며, 무료 등급은 엔진과 제공자에 대해 완전히 열린 채로 유지됩니다.
RuneTranslate를 써볼 준비가 되셨나요?
무료 등급에서 모든 엔진과 모든 번역 제공자가 열립니다. Supporter($3/mo)로 최고 속도가 열립니다.
Windows용 다운로드
