為什麼翻譯後字型會壞掉
TABLE OF CONTENTS
翻譯後的文件可能字詞都正確,看起來卻依然殘破不堪。缺字、字型意外改變、字母斷開以及文字溢出,通常源自不同的問題,因此每一種都需要不同的修法。
簡短答案
翻譯後字型看似壞掉,通常是因為原始字型無法顯示目標語言,或是因為開啟檔案的系統上沒有該字型,而匯出的 PDF 又沒有內嵌它。有些文字系統還需要基本的字型替換無法提供的字型塑形(shaping)與版面配置支援。在其他情況下,字型其實運作正常,只是翻譯佔用的空間比原文更多。
用你看到的症狀來判斷可能的原因:
| 你看到什麼 | 可能原因 | 先嘗試的修正方式 |
|---|---|---|
| 空白方塊或方框 | 字型缺少所需的字符 | 改用支援目標文字系統的字型 |
| 出現不同的字體 | 原始字型遺失或無法內嵌 | 安裝、替換或內嵌該字型 |
| 阿拉伯文或印度系文字字母斷開 | 應用程式、字型或匯出流程缺少正確的塑形支援 | 用支援該文字系統的軟體開啟檔案 |
| 文字被裁切或重疊 | 翻譯需要更多空間 | 調整文字框大小或調整版面 |
| 文字在一台電腦上看起來正常,另一台卻不是 | 檔案依賴本機安裝的字型 | 內嵌字型或改用普遍可取得的替代字型 |
字型並非包含每一個字符
Unicode 為每個字符指定一個編號,但 Unicode 本身並不是字型。Unicode Consortium 說明,字型會把這些字符編號對應到可見的字符圖形(glyph)。如果某個字體沒有某個字符的字符圖形,應用程式就沒有合適的內容可以繪製。
這就是為什麼一份使用純拉丁字母展示字型的英文文件,在翻譯成阿拉伯文、印地文、泰文、中文或其他文字系統後,可能變成一個個方框。當小型自訂字型只包含基本英文字符時,帶重音的拉丁字母也可能出問題。
最乾淨的修正方式,是選擇一個已驗證涵蓋目標書寫系統的字體。Google 的 Noto 系列涵蓋超過 1,000 種語言與 150 種以上的書寫系統,當品牌字型不支援所需字符時,它是有用的起點。你不必所有語言都用同一種字型;一份有明文記錄的字型對照表通常更好:
| 內容 | 字型策略範例 |
|---|---|
| 拉丁文、希臘文與西里爾文 | 若涵蓋範圍完整,可使用同一個相容的字型家族 |
| 阿拉伯文或希伯來文 | 選擇專為該文字系統設計的字型家族,並測試由右至左版面 |
| 中文、日文與韓文 | 選擇正確的地區字型家族,並檢查標點與斷行 |
| 天城文、泰文或其他複雜文字系統 | 在最終應用程式中驗證組合符號與字母塑形 |
字型替換會改變文件樣貌
文件可以指定某個字型,卻沒有把字型資料一併帶在檔案裡。如果有人在沒有該字體的電腦上開啟它,軟體就會挑選一個替代字型。替代字型可能更寬、更窄、更高,或與原字型完全不像。
內嵌 PDF 可以降低這種風險。Adobe 說明,內嵌字型會隨 PDF 一起傳遞,避免檔案在其他系統上檢視或列印時被替換。PDF 可以包含完整字型,或只包含文件中用到的部分字符子集。內嵌仍可能受到字型供應商授權條款的限制。
對已完成的 PDF 而言,子集化(subsetting)很有效率,但日後編輯檔案時卻可能造成麻煩。以英文原文建立的子集,可能不包含翻譯所需的新字符。若要保留可編輯性,請保留原始 DOCX、PPTX 或設計檔,並在翻譯後匯出新的 PDF,而不是把最終 PDF 當作母檔。
如果 PDF 格式已經毀損,請參考我們指南中的檢查項目:翻譯 PDF 而不失去格式。
有些文字系統需要的不只是字符圖形
字型裡有正確的字符是必要條件,但不總是充分條件。阿拉伯文字母會依其在詞中的位置改變形態。許多印度系文字會把子音、母音與符號組合成塑形後的字符叢。傳統蒙古文則使用依位置變化的字形與垂直版面。
Unicode Consortium 指出,字型只是文字繪製系統中的一個環節。應用程式及其塑形引擎也必須正確解讀字型的規則。這說明了常見的失敗情況:同一句話在現代瀏覽器中看起來正確,但透過較舊的軟體匯出後卻顯得斷開或錯位。
遇到這種情況時:
- 把一小段範例貼到最新的瀏覽器或文書處理器中。如果在這裡能正確繪製,原始應用程式或匯出流程就是可能的原因。
- 測試一款已知支援該文字系統的字型。
- 檢查段落方向與語言設定。
- 用支援最新複雜文字系統的軟體重新匯出。
- 檢查最終 PDF,而不是只信任可編輯的原始檔。
文字膨脹看起來可能像字型問題
翻譯會同時改變字符數量與字符寬度。W3C 指出,英文與中文是特別精簡的來源語言,因此從這些語言翻譯出來的內容往往更長。短標籤的膨脹幅度可能比整段文字更明顯,而某些書寫系統還需要更多垂直空間。
即使每個字符圖形都正確,結果也可能看起來像字型故障:文字多折了好幾行、標題撞到圖片、表格列變高,或軟體自動把字縮小到難以閱讀。
先修容器,再縮字型:
- 加寬或加深文字框。
- 允許標題與表格列換行。
- 移除從來源語言沿用下來的手動換行。
- 調整段落間距與行高。
- 只有在版面無法安全變更時,才縮小字級。
若需針對簡報的檢查項目,請參閱 PPTX 翻譯 QA 檢查清單。InDesign 使用者也可以依照我們 IDML 翻譯指南中的字型與溢出檢查進行。
實用的修復流程
1. 找出症狀
不要立刻把所有字型都換掉。先判斷問題是缺字符、字型替換、塑形,還是文字溢出。大範圍更換字型可能掩蓋真正的原因,並產生新的版面問題。
2. 回到可編輯的原始檔
只要手邊有 DOCX、PPTX、試算表或設計檔就使用它們。原始檔比平面化的 PDF 更能可靠地保留段落、表格與文字框。
3. 建立字型對照表
為每個目標文字系統與字重記錄核可的字型。分別檢查一般、粗體、斜體與符號字符;某個字型家族可能在其一般字面支援某個文字系統,但並非每一種樣式都支援。
4. 翻譯時不要平面化檔案
把文件文字複製到純文字方塊中,會捨棄許多控制樣式與版面的結構。當格式受到支援時,請改為把原始檔案上傳到文件翻譯工具;OpenL Doc Translator 是其中一個選擇。無論使用哪種工具,輸出結果仍然需要字型與版面審查。
5. 匯出時內嵌字型
在授權允許時,把所需的字型內嵌到最終 PDF 中。在 Acrobat 中,開啟 Document Properties 並檢查 Fonts 分頁,查看哪些字型已內嵌或子集化。
6. 測試交付的檔案
在未安裝來源字型的裝置上開啟結果。以正常縮放檢查每一頁、搜尋目標語言文字,並從 PDF 複製一段範例句子出來。外觀本身並不能證明底層文字可用。
交付前要檢查什麼
- 沒有出現空白方塊、項目符號或取代字符。
- 阿拉伯文、印度系文字與其他需塑形的文字系統能正確連接與定位。
- 粗體、斜體、上標與符號字符能正確顯示。
- 標題、表格、圖說與註腳沒有溢出。
- 在授權允許的情況下,PDF 使用內嵌字型。
- 搜尋、選取與複製貼上仍能運作。
- 文件在第二台裝置上看起來正確。
關鍵在於把字型涵蓋範圍、字型可用性、文字系統繪製與版面當成各自獨立的檢查項目。一旦找出是哪一層出了問題,修復通常就很直接。
Sources
- Adobe: Embedding fonts in PDFs overview — Explains PDF font embedding, subsetting, licensing restrictions, and substitution.
- Unicode Consortium: Fonts and Keyboards FAQ — Explains the relationship between Unicode characters, fonts, glyph mappings, and rendering systems.
- Google Fonts: Noto — Provides a multilingual font collection covering more than 1,000 languages and over 150 writing systems.
- W3C: Text size in translation — Describes text expansion, character width, line height, and flexible layout considerations across languages.


