跳转至

Ludo Atlas · 管线 · 本地化管线

管线与工作流。定位:把一款游戏从只有源语言带到多语言可发行的完整工作流,覆盖文本抽取与键值规范、翻译与回填、翻译记忆与术语表、字体与排版、测试与验收、平台与商店语言元数据。 配套:《技术实现手册》·《制作管理手册》·《全平台上架手册》·《避坑大全》。


1. 定位与适用

本地化不是「翻译一遍文本」,而是一条从立项挂到发布后的管线。它管五层东西:界面与系统文本、叙事与对白文本、字体与排版、贴图内嵌文字、商店与平台语言元数据。任何一层漏掉,对应语言的玩家都会第一时间看见。

投入等级由两个变量决定:文本量决定成本,语境依赖度决定质量下限。文本量越大、越依赖语境,本地化就越接近「重写」而不是「替换」。

项目形态 文本量级 本地化策略
文本量小(动作、街机、休闲) 千字级 界面与商店页为主,语言包一两周可覆盖
中等(模拟、策略、卡牌) 万字级 引擎字符串系统加翻译平台,按语言分批推进
文字密集(叙事、RPG、视觉小说) 十万字级 全管线:术语表、翻译记忆、外包、LQA 全部就位

三个前提只要有一条不成立,先别铺语言:

  • 源文本已经稳定,键与结构冻结过至少一轮。边写边翻适合增量补充,不适合首发主力语言。
  • 文本全部走引擎字符串系统,没有硬编码,没有拼接句。
  • 有明确的语言优先级与预算:先做哪几门、每门按什么标准验收,写进排期。

语言阶梯(常见顺序):源语言与英文打底,之后按商店数据排:法德西意、简中繁中、日韩、葡语俄语波兰语。每加一门都是乘法成本:翻译、校对、LQA、字体、图片文字各算一份。

成本口径(估范围用,不构成报价):

项目 计费方式 量级直觉
翻译 按源文字数或词数 千字级以小时计,十万字级以月计
校对与 LQA 按小时或按翻译量的比例 常见为翻译成本的 30%-60%
字体 按语言授权 CJK 商用字体是一笔固定授权费
图片文字 按张 每张含文字的界面图与宣传图单独计

2. 工具链

选型围绕四个动作:导出、协作、回填、校验。按动作选工具,不按品牌选工具。

环节 工具类别 代表选项 选型要点
源文本管理 引擎字符串系统 Unity Localization、Unreal String Table、Godot 翻译资源、Ren'Py translate 运行时切换语言、支持复数与变量、能批量导出导入
翻译协作 翻译平台 Crowdin、Lokalise、Weblate、Transifex、Phrase 翻译记忆、术语表、上下文截图、审校流、接口
交换格式 表格与标准格式 CSV、PO、XLIFF、JSON 列规范固定、可 diff、能被脚本校验
机翻辅助 机翻引擎与语言模型 通用机翻与主流大模型 术语可预置、可批量、边界见《AI 工作流手册》
字体 字体与子集化工具 商业与开源 CJK 字体、子集化脚本 商用授权、字符覆盖、回退链配置
校验 伪本地化与静态检查 引擎内置流程、自研脚本 一次扫出缺键、占位符、超长三类问题

三条纪律:

  • 单一事实来源在仓库:源文本住在版本库里,翻译平台只是协作副本;不能出现「平台里改了、仓库里没有」的版本。
  • 格式优先级:引擎原生导出优先,不够用再上标准格式;用自研格式就必须自配校验脚本,否则回填会变成手工事故。
  • 第一个里程碑不是「翻完」,而是导出、回填、校验三个动作能自动跑通。

3. 流程与规范

主线六步,每一步的产物是下一步的输入:

  1. 抽取:从引擎导出带键的文本批次。
  2. 冻结:批内键冻结,只增不改;改动标记受影响句段。
  3. 翻译与校对:译员翻译、校对复核、母语者抽查。
  4. 回填:译文导入引擎,生成各语言语言包。
  5. 集成测试:全语言冒烟、伪本地化与截图核对。
  6. 发布与增量:随版本发布;新增内容走新批次。

3.1 文本抽取与键值规范

  • 抽取的触发点是一个内容批次冻结,不是想起一次导一次。每个批次对应一个版本号,全程可追溯。
  • 键名一条规则全库用到底,推荐结构:模块.场景.序号,例如 ui.menu.start、dialogue.ch03.scene02.line07。
  • 键必须稳定:已发布的键不改名。改名等于删除加新增,所有语言的对位与翻译记忆一起断掉。
  • 禁止用源文本当键:源文一改,所有译文失联。
  • 导出表的最小列:键、源文本、译文、上下文注释、长度上限、状态、批次号。注释写清说话人、场景、语气,以及一词多义的定夺。
  • 一个键一句话:含变量、复数、性别的文本用占位符与引擎的复数系统表达;不要把句子拆成碎片键再拼接。
  • 贴图内嵌文字同期登记:含文字的界面图、logo、教程图进一张图片文字清单,抽取阶段就列全。

3.2 翻译决策:人工、机翻与混合

同一条管线里三种模式可以混用,但要对语言与内容分层:

模式 做法 质量 成本 适用
人工翻译 译员翻译、校对复核、LQA 抽查 最高 最高 首发主力语言、关键叙事
混合 机翻初稿加人工校对润色 中上 中 长尾语言、系统与界面文本
机翻直出 机翻直接进包 不稳 最低 只用于内部验证,不作为发行语言
  • 机翻的定位是初稿工具,不是成品:术语与语气必须过人工校对,笑点、双关、文化梗不进机翻直出。边界与核对流程见《AI 工作流手册》。
  • 每门语言先试译:术语密集段、口语段、含变量段、长度紧张段各一段,验收通过再铺量。
  • 三道质检:翻译与校对分离,项目方做一致性校验,母语者 LQA 对成品抽查。
  • 语言可以分层:首发主力语言上人工翻译,长尾语言用混合模式;数据不支持的语种先放观察名单,别硬凑语言数。
  • 开工前先定风格指南:语气、称谓、敬语、标点与数字格式。各译员自由发挥带来的返工,是本地化最贵的隐性账。

3.3 翻译记忆与术语表

  • 翻译记忆(TM)是句段对仓库:按项目与语言对维护,相似句自动给出建议译法。复用率越高,成本越低、一致性越好。
  • 入库纪律:只收校对后的句子;机翻初稿不自动入库,否则错误会随每一批翻译继承下去。
  • 术语表管三类词:专有名词(人名、地名、招式、道具)、系统术语(技能、属性、机制)、禁用词(平台敏感词与品牌禁忌)。
  • 字段最小集:源词、目标译法、词性、大小写规则、禁用译法、备注。
  • 维护纪律:术语表只有一个负责人;改一条术语要全库回查译文;新术语先登记后使用。
资产 内容 维护时机 常见失误
术语表 源词、译法、禁用译法、备注 立项与每批新增同步 同一名词出现三种叫法
翻译记忆 校对后的句段对与元数据 每批回收 未校对机翻入库,污染后续批次
风格指南 语气、称谓、标点、数字格式 每门语言开工前 译员风格不一,成品像拼盘

3.4 回填与语言包版本

  • 回填只做导入,不改结构:译文按键对位导入;任何手工改导入文件的做法,都会在下一批丢失。
  • 完整性检查:每语言一份包,查缺失键、多余键、过期键(源文本改过未回译)。
  • 缺键回退要有策略:显示源语言文本优于显示键名;回退路径在每类界面控件上都要测过。
  • 版本可追溯:翻译批次对应版本标签;任何一次发布构建都能回答「这份包用了哪批译文」。
  • 回填后立刻冒烟:启动、主菜单、核心循环、存读档、设置,每门语言过一遍。

3.5 字体与排版

  • CJK 的字体账:字形数以万计,字体文件大;静态文本按用字子集化,玩家输入与用户生成内容要保留完整字符集或回退链。
  • 授权先于采购:每款字体逐语言确认商用授权并归档凭证;开源字体也核对版本与条款。
  • 回退链:主字体缺字时回退到备用字体;用包含生僻字、特殊符号、全角标点的测试串逐语言扫一遍。
  • 排版规范:行高、字距、标点禁则(行首不出现闭标点等)、中英数混排间距,写进界面规范,不靠默契。
  • 截断与自适应:界面宽度按最长语言预留(起步按源语言 30%-60% 余量);按钮与标签用自适应宽度或换行方案;关键按钮不许截断。
  • 文本溢出:对话与描述类文本做滚动或分页;伪本地化加长 30%-40% 是基本测试条件。

3.6 平台与商店的语言元数据

  • Steam:商店语言列表分「界面、字幕、语音」三项,每一项必须与游戏实际一致;商店简介、成就、云存档名称是否覆盖,单独登记。
  • 主机:认证对语言与地区内容有清单要求,按平台开发者文档准备;语音与字幕的分离条款提前核对,别等认证阶段才发现缺项。
  • 移动与网页商店:商店列表、截图与更新说明同属元数据;应用内语言跟随系统语言切换是常见预期。
  • 宣传物同期本地化:预告片字幕、宣传图内嵌文字、活动公告进同一张清单。
  • 商店语言列表只勾真实支持的语言;修改要排进发布计划,后台有审核时间,发布当天才想起来必误事。

4. 自动化与验收

4.1 自动化检查

检查 查什么 作用环节
键一致性 缺失、多余、过期(源文已改未回译) 回填与集成
占位符一致性 各语言译文的占位符集合与源文一致;富文本标签闭合 回填
长度警戒 标注了长度上限的键,按译文比例超限即报警 集成
伪本地化构建 每次提交生成一份加长的伪本地化包 日常开发
术语检查 禁用译法与偏离术语表的译法 每批交付前
  • 自动化只查机械错误,语气与质量留给校对与 LQA;每次语言包变更后自动跑检查,报警进入缺陷单,不留在日志里无人处理。

4.2 测试方法

  • 伪本地化:把源文本替换成加长 30%-40%、带重音与特殊字符的模拟文本,提前暴露截断、溢出与字体问题。
  • 图片文字扫描:跑一遍全流程截图,逐屏核对贴图内文字是否在清单里、是否已翻。
  • 语言包完整性:每门语言跑通关冒烟,覆盖启动、教学、核心循环、存档、错误提示、设置。
  • 母语者 LQA:抽主流程与关键文本,按类别记录问题(错译、语气、术语、截断、标点)。
  • 回归纪律:改字体、改界面布局、加文本之后重跑截图扫描;截断与溢出会在每次布局变化后复发。

4.3 发布验收清单(每门语言)

  • 键完整率百分之百,回退策略经确认。
  • 全语言冒烟通过,无阻塞性文本缺陷。
  • 伪本地化与测试串:无未记录的截断、溢出与缺字。
  • 图片文字清单全部勾验。
  • 术语表与禁用词检查通过。
  • 字体授权凭证归档。
  • 商店语言列表与游戏实际支持逐项核对一致。
  • 遗留问题单在案,版本更新时回收。

5. 常见坑

  1. 硬编码文本:字符串写死在代码与预制体里,抽取漏掉,某语言里露出源文。规避:文本一律走字符串系统,加静态检查兜底。
  2. 字符串拼接:把「你获得了」加数字加「枚金币」拼成句子,语序不同的语言全错。规避:整句键加占位符,禁止碎片拼接。
  3. 语境缺失:同一个词在不同场景意思不同,译员只能猜。规避:导出必带上下文注释与截图。
  4. 忘测字体与截断:默认字体缺字、按钮溢出,长语言一上全崩。规避:测试串、伪本地化、母语者实测三样一起上。
  5. 收尾才做本地化:发布前一个月才开工,文本还在动,译文全部对不上。规避:批次冻结与增量翻译,把本地化当管线,不当尾工序。
  6. 用源文本当键:源文一改,全语言失联。规避:稳定键名,键与文案解耦。
  7. 术语漂移:同一技能三种叫法。规避:术语表加全库回查,交付前机械扫描。
  8. 机翻污染翻译记忆:未校对初稿入库,错误随批次继承。规避:只收校对稿。
  9. 占位符错译:译员把变量名翻掉或删了,运行时报错或文本缺参。规避:自动校验加译员须知。
  10. 图片文字漏翻:宣传图、教程图、贴图里的文字没进清单。规避:清单从抽取阶段建立,截图扫描收口。
  11. 商店语言乱勾:列表写了支持、游戏里没有,换来差评与投诉。规避:发布前逐项核对,宁少勿虚。
  12. 字体版权事故:未授权商用字体随包发布。规避:逐款凭证归档,备好可替换的开源方案。

延伸阅读

  • 技术实现手册:字符串系统、数据驱动与自动化基建,本页第 2、4 节的底稿。
  • 制作管理手册:外包管理、估算与排期,语言批次排期的方法论。
  • 全平台上架手册:商店提交与语言元数据要求,配合第 3.6 节阅读。
  • 避坑大全:文本、界面与本地化相关坑位,与第 5 节对照。
  • AI 工作流手册:机翻与 AI 辅助的边界与人工核对流程。
  • 视觉小说手册:文本密集型项目的本地化前置要求,见其第 4.3 节。