למה מסמכים מתורגמים נעשים ארוכים יותר
TABLE OF CONTENTS
מסמך מתורגם יכול להתווסף לו עמודים בלי להתווסף לו רעיונות. אורכי מילים שונים, מבני משפטים, כללי שבירת שורה ומטריקות גופן משנים כמה מקום דורשת אותה משמעות.
התשובה הקצרה
מסמכים מתורגמים נעשים ארוכים יותר כאשר טקסט היעד תופס יותר מקום אופקי או אנכי מאשר המקור. זה יכול לקרות משום שהתרגום משתמש ביותר תווים, במילים ארוכות יותר, בפחות מקומות לשבירת שורה, בגליפים רחבים יותר או בריווח שורות גדול יותר.
לפיכך מספר העמודים הוא תוצאה של פריסה, לא מדד אמין לאיכות התרגום. תרגום תמציתי עשוי עדיין להזדקק לעמוד נוסף, ואילו תרגום גרוע יכול להיות קצר יותר משום שהשמיט תוכן.
כלל התכנון השימושי ביותר הוא פשוט: צפו שהפריסה תזוז, במיוחד כאשר המקור עוצב כך שייכנס במדויק.
למה אותה משמעות תופסת יותר מקום
תוויות קצרות באנגלית יכולות להתארך בחדות
אנגלית וסינית מרבות להביע מידע בצורה תמציתית. W3C מציין שתרגומים משפות אלה ארוכים יותר לעיתים קרובות, במיוחד כאשר המקור מכיל תוויות קצרות.
ההנחיות שלו להתפשטות טקסט מציגות את טווחי התכנון הממוצעים הבאים לתרגום מאנגלית לשפות אירופיות:
| אורך המקור באנגלית | האורך המתורגם הממוצע ביחס למקור |
|---|---|
| עד 10 תווים | 200-300% |
| 11-20 תווים | 180-200% |
| 21-30 תווים | 160-180% |
| 31-50 תווים | 140-160% |
| 51-70 תווים | 151-170% |
| יותר מ-70 תווים | 130% |
הנתונים האלה הם מרווחי תכנון לפריסה, לא הבטחות לצמד שפות מסוים. הלקח השימושי שלהם הוא שמחרוזות המקור הקצרות ביותר זקוקות לרוב למרווח הביטחון היחסי הגדול ביותר. כותרת טבלה או תיבת הדגשה בנות שתי מילים יכולות לגרום לצרות רבות יותר מפסקה שלמה, משום שהן בדרך כלל יושבות בתוך מכל קטן יותר.
הדקדוק משנה את מספר המילים
שפות אינן ארוזות את המשמעות באותו אופן. שפה אחת עשויה להביע רעיון באמצעות נטייה, בעוד שאחרת זקוקה למילת יידוע, למילית יחס, לפועל עזר או לביטוי מסביר. סדר המילים יכול גם להעביר לוואי או תנאי למקום שבו הוא יוצר שורה נוספת.
אין פירושו של דבר שהמתרגם צריך להעתיק את מבנה המקור או להסיר מילים הכרחיות כדי לשמור על מספר העמודים. התרגום חייב קודם כול להיות מלא וטבעי; הפריסה צריכה להתאים את עצמה אליו.
מילים ארוכות מצמצמות את אפשרויות הגלישה
W3C משתמש במילה הגרמנית Eingabeverarbeitungsfunktionen כדוגמה למילה מורכבת המחליפה את הביטוי באנגלית “Input processing features”. הביטוי באנגלית יכול להיגלש ברווחים. המילה המורכבת בגרמנית עשויה להישאר בשורה אחת אלא אם למסמך יש חלוקה מתאימה למילים המודעת לשפה.
התקן של Unicode לשבירת שורות מסביר מדוע זה חשוב: תוכנה בוחרת שבירות שורה מתוך ההזדמנויות המותרות עבור התווים והשפה שבשימוש. עמודות צרות, תאי טבלה ותיבות טקסט נכשלים מוקדם יותר כאשר ההזדמנויות האלה מוגבלות.
מספר התווים אינו זהה לרוחב החזותי
תרגום יכול להכיל פחות תווים ובכל זאת לתפוס יותר מקום. W3C משווה בין desktop באנגלית לבין デスクトップ ביפנית: למונח היפני יש פחות תווים אך הוא בדרך כלל דורש רוחב אופקי גדול יותר.
החלפת גופן יכולה לשנות את התוצאה שוב. גופן חלופי עשוי להיות רחב או גבוה יותר מגופן המקור, ולהפוך שורה שנכנסה בעבר לשתי שורות. אם בקובץ המתורגם מופיעים גם גליפים חסרים, אותיות מנותקות או גופנים לא צפויים וגם גלישה, אבחנו את הבעיות האלה בנפרד בעזרת המדריך שלנו ללמה גופנים נשברים אחרי תרגום.
חלק מהכתבים זקוקים ליותר מקום אנכי
ערבית, סינית, דבנגארי, יפנית, קוריאנית, תאית, טיבטית וכתבים אחרים עשויים להזדקק לגליפים גבוהים יותר או לריווח שורות גדול יותר מטקסט לטיני. פסקה יכולה אפוא להוסיף מקום אנכי גם כאשר מספר השורות שלה נשאר ללא שינוי.
זו הסיבה שהקטנת הגופן היא לעיתים רחוקות התיקון הראשוני הטוב ביותר. ייתכן שהטקסט ייכנס, אך כתב היעד עלול להפוך לקשה לקריאה או שהסימנים שלו עלולים להתנגש.
היכן התפשטות טקסט שוברת מסמך
פסקאות גוף ארוכות בדרך כלל נזרמות מחדש. הבעיות מתרכזות במכלים שתוכננו סביב טקסט המקור:
| רכיב במסמך | כשל אופייני | תגובה טובה יותר |
|---|---|---|
| כותרות | שורה נוספת דוחפת את גוף הטקסט לעמוד אחר | אפשרו גלישה והשאירו את הכותרת עם הפסקה הבאה |
| טבלאות | השורות גדלות, העמודות נעשות צרות מדי, או שהטקסט נחתך | הרחיבו עמודות מפתח, אפשרו לשורות לגדול, או שנו את כיוון העמוד |
| תיבות טקסט ותיבות הדגשה | הטקסט גולש או מתכווץ אוטומטית | הגדילו את התיבה או קצרו רק לאחר סקירת המשמעות |
| טפסים | תוויות מתנגשות בשדות | העבירו תוויות מעל לשדות או הגדילו את רוחב התווית |
| כותרות עליונות ותחתונות | הטקסט חופף למספרי עמודים או לשוליים | פשטו את הטקסט החוזר ובדקו כל מקטע |
| כתוביות והערות שוליים | הפניות נפרדות מהנושא שלהן | השאירו רכיבים קשורים יחד ועדכנו את המספור |
| שקופיות | תבליטים נעשים צפופים או קטנים מדי לקריאה | פצלו את השקופית או צמצמו את תוכן המקור לפני התרגום |
שורה אחת שהשתנתה יכולה להשפיע בשרשרת על שאר הקובץ. טבלה גבוהה יותר מזיזה כתובית; הכתובית מזיזה מעבר עמוד; מעבר העמוד משנה את תוכן העניינים. סקרו את המסמך כולו לאחר שהטקסט סופי, במקום לתקן עמודים בזמן שהניסוח עוד משתנה.
הכינו את המקור לפני התרגום
1. הסירו שבירות שורה ידניות
שבירות שורה שהוכנסו כדי שהמקור ייראה מאוזן מתאימות לעיתים רחוקות לשפת היעד. שמרו על מעברי פסקה אמיתיים, אך הניחו למשפטים רגילים להיגלש אוטומטית.
2. תנו למכלים צרים מקום לגדול
בדקו טבלאות, עמודות צד, טפסים, תרשימים ותיבות טקסט לפני התרגום. הגדילו ריפוד רק במקום שיש בו מקום, אפשרו לשורות לגדול, והימנעו מתיבות בגובה קבוע לטקסט חיוני.
3. השתמשו בסגנונות פסקה וכותרת
סגנונות מאפשרים תיקונים גלובליים. אם כותרות מתורגמות זקוקות לריווח או לגובה שורה שונים, שינוי סגנון אחד בטוח יותר מעריכה ידנית של כל כותרת.
4. הגדירו את שפת המסמך הנכונה
הגדרות שפה עוזרות לתוכנה תואמת לבחור איות, חלוקת מילים והתנהגות שבירת שורות. הן גם מונעות מעורך להחיל כללי שפת מקור על הטקסט המתורגם.
5. הגנו על מונחים שאסור שישתנו
סמנו שמות מוצרים, קודים, כתובות URL, משתנים ומזהים משפטיים. תנו למתרגם הקשר לגבי קיצורים במקום להסתמך על תוויות מקור מקוצרות שאולי אין להן מקבילה תמציתית.
6. שמרו קובץ אב הניתן לעריכה
תקנו את הפריסה בקובץ ה-DOCX, ה-PPTX, הגיליון האלקטרוני או קובץ העיצוב כשאפשר. ההנחיות של Google Cloud לתרגום מסמכים ממליצות לתרגם DOCX או PPTX לפני המרת התוצאה ל-PDF, משום שפורמטים אלה משמרים בדרך כלל פריסה וסגנונות טוב יותר מ-PDF. להכנה המיוחדת ל-PDF, פעלו לפי תהליך העבודה לתרגום PDF בלי לאבד את העיצוב.
תקנו תרגום שהתארך בלי לפגוע בו
פעלו לפי הסדר הזה כדי שתיקון חזותי לא ייצור בעיה לשונית:
- ודאו שלא שוכפל דבר. השוו סדר כותרות, רשימות, טבלאות ופסקאות חוזרות עם המקור.
- הסירו שבירות שורה משפת המקור. הניחו לטקסט היעד להיזרם מחדש לפני שינוי הטיפוגרפיה.
- שנו את גודל המכל. הרחיבו עמודה, העמיקו תיבת טקסט, או אפשרו לשורת טבלה לגדול.
- כווננו את הריווח. צמצמו ריווח פסקאות או ריפוד מופרזים בלי לצופף את הכתב.
- החילו חלוקת מילים מודעת לשפה. השתמשו בה רק כשהיא נכונה לשפת היעד ולסגנון המסמך.
- שכתבו באופן מקומי. בקשו מסוקר מוסמך לקצר כותרת או תווית תוך שמירה על המשמעות והטון.
- הקטינו את גופן אחרון. שמרו על אחידות גוף הטקסט והרכיבים החוזרים, ואל תכווצו קטעים מבודדים עד שהם בקושי נכנסים.
אל תמחקו הסתייגויות, דוגמאות, אזהרות או תנאים משפטיים כדי להשיב את מספר העמודים המקורי. אם מגבלה קבועה היא הכרחית, כגון טופס של עמוד אחד או סיכום של שתי שקופיות, הגדירו את המגבלה לפני התרגום כדי שהמתרגם יוכל לכתוב עבור המקום הזמין.
השתמשו בתהליך תרגום המשמר את הפריסה
העתקת טקסט לכלי תרגום פשוט משליכה את הטבלאות, הסגנונות, מסגרות הטקסט והקשרים שהפריסה תלויה בהם. העלאת המסמך הניתן לעריכה מעניקה לכלי מודע-מסמך יותר מבנה לשמר.
OpenL Doc Translator תומך בפורמטים הכוללים PDF, DOCX, PPTX, XLSX, EPUB ו-SRT. העמוד הרשמי שלו מציין שהוא שומר על גופנים, צבעים, טבלאות ופריסת עמוד, ומספק גם גרסאות מתורגמות וגם דו-לשוניות. הקובץ הדו-לשוני שימושי לבדיקה אם שינוי פריסה נבע מהתפשטות טקסט לגיטימית או מתוכן חסר או משוכפל.
שימור העיצוב מפחית שחזור ידני, אך הוא אינו יכול לגרום לכל שפה לתפוס מקום זהה. סיימו בסקירת פריסה ודו-לשונית נפרדת בעזרת רשימת הבדיקה לסקירת מסמך דו-לשוני. בדקו גלישה, גדילת טבלאות, מעברי עמודים, כותרות עליונות, תחתונות, תוכן העניינים וה-PDF הסופי המיוצא.
בדיקה אחרונה לפני מסירה
- שום טקסט אינו חתוך, מוסתר, חופף או מכווץ אוטומטית מתחת לגודל המאושר.
- טבלאות משמרות את יחסי השורה-עמודה שלהן ונשארות קריאות.
- כותרות נשארות עם התוכן שהן מציגות.
- כתוביות, הערות שוליים, תיבות הדגשה והפניות לעמודים עדיין מצביעות למקום הנכון.
- גופנים תומכים בכל תו וסגנון של שפת היעד.
- תוכן העניינים וההפניות הצולבות עודכנו.
- גם הקובץ הניתן לעריכה וגם ה-PDF המיוצא נסקרו.
- השוואה דו-לשונית מאשרת שלא אבד תוכן כדי שהקובץ ייכנס.
מסמך מתורגם ארוך יותר הוא בדרך כלל עדות לכך ששפה ופריסה פועלות זו על זו, ולא שמשהו השתבש. תכננו מקום להתרחבות, שמרו על מבנה המסמך, וכוננו את הפריסה רק לאחר שהתרגום הושלם.
Sources
- W3C: Text size in translation - Explains systematic text expansion, compound words, character width, line height, and flexible-layout planning.
- Unicode Standard Annex #14: Unicode Line Breaking Algorithm - Defines line-break opportunities, line fitting, and language-sensitive hyphenation considerations.
- Google Cloud: Translate documents - Explains document-format support, layout preservation, and why DOCX or PPTX sources generally retain layout better than PDF.
- OpenL Doc Translator - Lists supported formats, layout-preservation features, and bilingual review output.


