为什么翻译后字体会出问题
目录
翻译后的文档可能词语正确,外观却已经错乱。缺失字符、意外的字体变化、断开的字母和溢出文本通常源于不同问题,因此也需要不同的修复方法。
简短答案
翻译后字体看起来出问题,通常是因为原字体无法显示目标语言,或者打开文件的系统没有该字体,而导出的 PDF 也没有嵌入字体。有些文字系统还需要基本字体替换无法提供的字形塑形和布局支持。还有一些情况是字体工作正常,只是译文比原文占用更多空间。
根据可见症状判断可能原因:
| 你看到的现象 | 可能原因 | 首先尝试的修复方法 |
|---|---|---|
| 空白方框或小方框 | 字体缺少所需字形 | 换用支持目标文字系统的字体 |
| 字体样式发生变化 | 原字体缺失或无法嵌入 | 安装、替换或嵌入字体 |
| 阿拉伯文或印度文字母断开 | 应用、字体或导出流程缺乏正确的字形塑形支持 | 使用支持该文字系统的软件打开文件 |
| 文本被裁切或互相重叠 | 译文需要更多空间 | 调整文本框尺寸或版式 |
| 一台电脑上正常,另一台上异常 | 文件依赖本地安装的字体 | 嵌入字体或使用广泛可用的替代字体 |
一种字体不会包含所有字符
Unicode 为每个字符分配一个编号,但 Unicode 本身不是字体。Unicode Consortium 解释说,字体会把这些字符编号映射为可见字形。如果字体没有某个字符的字形,应用就没有合适的内容可以绘制。
因此,使用仅含拉丁字母的展示字体排版的英文文档,翻译成阿拉伯文、印地文、泰文、中文或其他文字系统后,可能变成方框。小型定制字体只包含基本英文字符时,带重音的拉丁字母也可能显示失败。
最直接的修复方式是选择经过验证、覆盖目标书写系统的字体。Google 的 Noto 字体系列覆盖 1,000 多种语言和 150 多种文字系统。当品牌字体不支持所需字符时,它是一个实用的起点。你不必让所有语言使用同一种字体;记录清晰的字体映射通常更好:
| 内容 | 示例字体策略 |
|---|---|
| 拉丁文、希腊文和西里尔文 | 如果覆盖完整,使用一个兼容的字体家族 |
| 阿拉伯文或希伯来文 | 选择针对该文字系统设计的字体,并测试从右到左的布局 |
| 中文、日文和韩文 | 选择正确的地区字体,并检查标点和换行 |
| 天城文、泰文或其他复杂文字系统 | 在最终应用中验证组合标记和字母塑形 |
字体替换会改变文档
文档可以记录字体名称,却不一定把字体数据放入文件。如果有人在没有安装该字体的电脑上打开文件,软件就会选择后备字体。替代字体可能比原字体更宽、更窄、更高,或在视觉上完全不同。
嵌入字体可以降低这一风险。Adobe 说明,嵌入的字体会随 PDF 一起保存,因此文件在其他系统上查看或打印时不会发生替换。PDF 可以包含完整字体,也可以只包含文档中使用过的字符子集。字体供应商的许可仍可能限制嵌入。
对于已完成的 PDF,使用字体子集更高效,但文件日后编辑时可能带来问题。根据英文源文件创建的子集可能不包含翻译所需的新字符。对于可编辑工作,应保留原始 DOCX、PPTX 或设计文件,翻译后重新导出 PDF,不要把最终 PDF 当作主文件。
如果 PDF 格式已经损坏,请参考我们的不丢失格式翻译 PDF 指南中的检查方法。
有些文字系统需要的不只是字形
字体包含正确字符是必要条件,但并不总是充分条件。阿拉伯字母会根据其在词中的位置改变形状。许多印度文字系统会把辅音、元音和标记组合成塑形后的字群。传统蒙古文则使用位置变体和竖排布局。
Unicode Consortium 指出,字体只是文本渲染系统的一部分。应用及其字形塑形引擎也必须正确解释字体规则。这解释了一种常见故障:同一句话在现代浏览器中显示正确,却在通过旧软件导出后变得断开或错位。
遇到这种情况时:
- 将一小段示例粘贴到当前浏览器或文字处理器中。如果那里显示正确,原应用或导出流程很可能是原因。
- 测试一个已知支持该文字系统的字体。
- 检查段落方向和语言设置。
- 使用支持复杂文字系统的较新软件重新导出。
- 检查最终 PDF,不要只相信可编辑源文件。
文本扩展可能看起来像字体问题
翻译会同时改变字符数量和字符宽度。W3C 指出,英文和中文尤其紧凑,因此从这些语言翻译出去的文本通常会变长。短标签的扩展可能比完整段落更明显,而某些文字系统还需要更多垂直空间。
即使每个字形都正确,结果也可能看起来像字体故障:词语换到更多行,标题与图片相撞,表格行变高,或软件自动缩小字号直至难以阅读。
先修复容器,再缩小字体:
- 加宽或加深文本框。
- 允许标题和表格行换行。
- 删除从源语言继承的手动换行。
- 调整段落间距和行高。
- 只有在无法安全改变版式时,才减小字号。
幻灯片相关检查请参阅 PPTX translation QA checklist。InDesign 用户也可以参考我们的 IDML translation guide 中关于字体和溢出的检查。
实用的修复流程
1. 确认症状
不要立刻替换所有字体。先判断问题是缺失字形、字体替换、字形塑形还是溢出。大范围更换字体可能掩盖原始原因,并产生新的版式问题。
2. 回到可编辑源文件
只要有条件,就使用 DOCX、PPTX、电子表格或设计文件。与扁平化 PDF 相比,源文件能更可靠地保留段落、表格和文本框。
3. 创建字体映射
记录每种目标文字系统和字重所批准使用的字体。分别检查常规、粗体、斜体和符号字符;某个字体家族可能只在常规字面中支持某文字系统,而不是所有样式都支持。
4. 在不扁平化文件的情况下翻译
将文档文本复制到普通文本框会丢失大量控制样式和布局的结构。在格式受支持时,应将原始文件上传到文档翻译服务;OpenL Doc Translator 是一个选项。无论使用什么工具,输出结果仍需进行字体和布局检查。
5. 嵌入字体后导出
在许可允许的情况下,将所需字体嵌入最终 PDF。在 Acrobat 中打开 Document Properties,检查 Fonts 标签,确认哪些字体已嵌入或被设为子集。
6. 测试交付文件
在未安装源字体的设备上打开结果。以正常缩放检查每一页,搜索目标语言文本,并从 PDF 中复制一小段句子。仅凭视觉外观无法证明底层文本可用。
交付前检查清单
- 没有出现空方框、项目符号异常或替换字符。
- 阿拉伯文、印度文字及其他需要塑形的文字系统连接和定位正确。
- 粗体、斜体、上标和符号字符显示正确。
- 标题、表格、题注和脚注没有溢出。
- 在许可允许时,PDF 使用了嵌入字体。
- 搜索、选择和复制粘贴仍然有效。
- 文档在第二台设备上看起来也正确。
关键是把字体覆盖范围、字体可用性、文字系统渲染和布局视为彼此独立的检查项。确定是哪一层出错后,修复通常就很直接。
Sources
- Adobe: Embedding fonts in PDFs overview — Explains PDF font embedding, subsetting, licensing restrictions, and substitution.
- Unicode Consortium: Fonts and Keyboards FAQ — Explains the relationship between Unicode characters, fonts, glyph mappings, and rendering systems.
- Google Fonts: Noto — Provides a multilingual font collection covering more than 1,000 languages and over 150 writing systems.
- W3C: Text size in translation — Describes text expansion, character width, line height, and flexible layout considerations across languages.


