چگونه یک PDF را بدون از دست دادن قالب‌بندی ترجمه کنیم (2026)

OpenL Team 6/21/2026
چگونه یک PDF را بدون از دست دادن قالب‌بندی ترجمه کنیم (2026)

TABLE OF CONTENTS

شما یک PDF را در یک online translator بارگذاری می‌کنید، نتیجه را download می‌کنید و آن را باز می‌کنید. متن ترجمه شده است — اما جدول‌هایتان به توده‌ای از کلمات تبدیل شده‌اند، تصویرها جابه‌جا شده‌اند، و همه فونت‌ها حالا Arial هستند. اینجا سه روش برای حل این مشکل آمده است، از one-click tools تا OCR-first workflows برای scanned documents.

روش 1: از یک All-in-One Document Translator استفاده کنید

مناسب برای: PDFهای تمیز و text-based با layout ساده. سریع‌ترین مسیر از upload تا translated file را می‌خواهید، بدون step اضافی.

این platformها به‌صورت خودکار متن داخل PDF شما را detect می‌کنند، آن را ترجمه می‌کنند، و output را دوباره render می‌کنند — در حالی که fonts، tables، images و page structure حفظ می‌شود. ابتدا یک tool انتخاب کنید، سپس steps زیر را دنبال کنید.

سند PDF تمیز و آماده برای ترجمه

Tools برای این روش:

  • OpenL Doc Translator — Free daily preview؛ برای full translations به‌صورت pay-per-document. از PDF، DOCX، PPTX، XLSX، EPUB، SRT و موارد بیشتر پشتیبانی می‌کند. 100+ languages، تا 80 MB برای هر file. Fonts، colors، tables و page layout را حفظ می‌کند. Advanced Translation mode برای business و academic documents، specialized terminology را بدون تبدیل خراب به literal equivalents مدیریت می‌کند. هم یک translated PDF تمیز و هم یک bilingual side-by-side version تحویل می‌دهد.
  • iLovePDF Translate PDF — برای 1 document در روز free است (تا 15 MB). Built-in OCR، scanned PDFs را بدون step جداگانه مدیریت می‌کند. Output را به 25 languages می‌دهد.
  • NoteGPT — کاملا free. 100+ languages، تا 50 MB برای هر file. یک side-by-side bilingual view تولید می‌کند. برای research papers و contracts مناسب است.
  • Smartcat — 14-day free trial. 280+ languages، پشتیبانی از translation memory و glossary. برای teams و agencies ساخته شده است.

Steps:

  1. PDF خود را upload کنید. File را روی platform انتخابی drag and drop کنید. بیشتر tools، source language را auto-detect می‌کنند — قبل از ادامه، درست بودن آن را double-check کنید.

  2. Target language و translation mode را انتخاب کنید. اگر tool، quality tiers ارائه می‌دهد (مثل Advanced Translation mode در OpenL یا AI engine selection در Smartcat)، بر اساس document type انتخاب کنید: standard mode برای everyday text، و advanced برای legal، medical یا technical content که terminology accuracy در آن مهم است.

  3. Output را download و verify کنید. Translated PDF را باز کنید و دنبال layout issues بگردید — صفحه اول و آخر، هر table، و image captions را check کنید. اگر tool، bilingual comparison file ارائه می‌دهد (OpenL و NoteGPT هر دو این کار را می‌کنند)، از آن برای spot-check passages در برابر original استفاده کنید.

محدودیت‌های این روش: All-in-one tools با PDFهای تمیز و text-based بهترین عملکرد را دارند. اگر PDF شما dense multi-column layouts، inline formulas، یا heavy branding با custom fonts دارد، روش 2 control بیشتری به شما می‌دهد. اگر scanned document است — یعنی متن در واقع عکس متن است — به روش 3 بروید. برای بررسی عمیق‌تر این workflow، guide to translating scanned PDFs ما را ببینید.

روش 2: ابتدا به Word تبدیل کنید، سپس ترجمه کنید

مناسب برای: PDFهایی با dense tables، multi-column layouts، marketing brochures، یا هر documentی که در آن به control دقیق روی final formatting نیاز دارید.

PDF files متن را به‌عنوان independent blocks ذخیره می‌کنند که با coordinates جای‌گذاری شده‌اند — file هیچ مفهومی از paragraphs، rows یا columns ندارد. وقتی یک translation tool متن را در همان محل replace می‌کند، text expansion (German می‌تواند تا 30% characters بیشتر اضافه کند؛ French حدود 15–20%) همه چیز را از alignment خارج می‌کند. DOCX با content متفاوت رفتار می‌کند: متن را به‌صورت structural hierarchy — sections، paragraphs، tables، inline images — organize می‌کند که translation tools می‌توانند بدون حدس زدن در آن navigate کنند. Convert کردن به DOCX در ابتدا، structure را intact نگه می‌دارد؛ سپس translator به‌جای coordinate-positioned fragments با real paragraphs و table cells کار می‌کند.

  1. PDF خود را به DOCX convert کنید. با converterی شروع کنید که layout را حفظ می‌کند — این همان stepی است که formatting یا زنده می‌ماند یا از بین می‌رود. (اگر فقط با Word documents کار می‌کنید، step-by-step guide to translating DOCX files ما را ببینید.) خود Microsoft Word این کار را به‌طرز شگفت‌آوری خوب انجام می‌دهد: PDF را مستقیم در Word باز کنید (File → Open → انتخاب PDF). Tables، columns و images را به یک editable document تبدیل می‌کند. برای browser-based options، Smallpdf (2 free conversions در روز)، iLovePDF (2 تا در hour)، و UtilVox (browser-native، files هرگز از device شما خارج نمی‌شوند) همگی clean DOCX output با layout retention خوب تولید می‌کنند.

  2. DOCX را در یک document translator upload کنید. DeepL برای European languages طبیعی‌ترین translations را تولید می‌کند و DOCX را خوب مدیریت می‌کند، هرچند free tier آن به 3 documents در month و 5 MB محدود است. OpenL Doc Translator علاوه بر PDF، DOCX را هم می‌پذیرد و 100+ languages را پوشش می‌دهد — اگر با Japanese، Arabic یا Korean کار می‌کنید مفید است، جایی که language coverage در DeepL ممکن است کافی نباشد. Google Cloud Translation API از 249 languages پشتیبانی می‌کند و هنگام ترجمه native-format files، document structure را حفظ می‌کند، هرچند به مقداری technical setup نیاز دارد.

  3. Translated DOCX را download و inspect کنید. Translated file را باز کنید و layout issues را بررسی کنید: مطمئن شوید table cells collapse نشده‌اند، images نزدیک captions خود مانده‌اند، و page breaks در جاهای معقول قرار گرفته‌اند. بیشتر issues با minor adjustments مستقیم در Word قابل رفع هستند.

  4. به‌صورت PDF export کنید. File → Save As → PDF. نتیجه یک translated PDF است که formatting آن از round trip جان سالم به در برده است.

روش 3: OCR-First برای Scanned و Image-Based PDFs

مناسب برای: Scanned documents، image-only PDFs، photographed pages، handwritten notes. (برای handwritten documents به‌طور خاص، handwritten notes translation guide ما challenges مربوط به penmanship را عمیق‌تر پوشش می‌دهد.)

یک scanned PDF، text document نیست — مجموعه‌ای از pictures است که اتفاقا text دارند. بیشتر translation tools یا آن را کاملا ignore می‌کنند یا output خراب تولید می‌کنند، چون text layerی برای کار وجود ندارد. برای extract کردن text پیش از translation، به OCR (Optical Character Recognition) نیاز دارید.

قرار دادن سند در scanner برای OCR

  1. روی scanned PDF خود OCR اجرا کنید. کیفیت این step همه چیز را downstream تعیین می‌کند. ABBYY FineReader بالاترین OCR accuracy را در industry دارد (190+ recognition languages، مدیریت low-resolution scans، stamps و rotated pages) — یک desktop app است، پس files به‌صورت local می‌مانند. Immersive Translate BabelDoc یک free، open-source option با pixel-level layout preservation، built-in OCR و 500,000 free tokens در month است — برای academic papers دارای formulas و multi-column layouts قوی است. iLovePDF در Translate PDF tool خود OCR دارد، بنابراین steps 1 و 2 در یک upload merge می‌شوند — برای clean scans که به fine-grained OCR control نیاز ندارید راحت است.

  2. به‌صورت searchable PDF یا DOCX save کنید. پس از OCR، file را با recognized text layer embedded export کنید. یک searchable PDF، original scanned image را زیر کار نگه می‌دارد و یک invisible text layer اضافه می‌کند. DOCX export یک editable document آماده برای Method 2 به شما می‌دهد.

  3. Cleaned file را ترجمه کنید. اگر searchable PDF export کرده‌اید، از روش 1 (all-in-one tool) استفاده کنید — embedded text layer اجازه می‌دهد document translators مستقیم کار کنند. اگر DOCX export کرده‌اید، برای بهترین formatting control از روش 2 (Word-first pipeline) استفاده کنید. در هر صورت، translation tool حالا به‌جای حدس زدن از pixels، actual text برای کار دارد.

  4. با original compare کنید. Scanned documents quirksی دارند که OCR ممکن است miss کند: smudged characters، mixed-language sections، stamps overlapping text. Translated file را side by side با original باز کنید. به numbers، dates، proper names و هر چیزی در small print توجه ویژه داشته باشید — OCR errors معمولا همین‌جا concentrate می‌شوند.

کدام OCR tool برای کدام document:

Document typeBest OCR toolWhy
Clean printed scans (200+ DPI)iLovePDF (built-in)OCR و translation در یک upload — بدون extra steps
Academic papers with formulas and columnsImmersive Translate BabelDocMulti-column layout و formula rendering را در pixel level حفظ می‌کند؛ 500K free tokens/month
Low-quality, skewed, or archival scansABBYY FineReaderبالاترین accuracy روی degraded text، rotated pages و stamps؛ 190+ recognition languages
Sensitive/confidential documentsABBYY FineReader (desktop)Files به‌صورت local می‌مانند — upload به cloud services انجام نمی‌شود

تفاوت کلیدی: اگر scan quality خوب است و speed می‌خواهید، built-in OCR tools (iLovePDF، BabelDoc) همه چیز را در یک workflow مدیریت می‌کنند. اگر scan quality ضعیف است یا document confidential است، desktop OCR قبل از ترجمه ارزش extra step را دارد.

وقتی OCR fail می‌شود: اگر scan low-resolution (زیر 200 DPI)، به‌شدت skewed، یا شامل handwritten cursive باشد، OCR accuracy به‌شدت افت می‌کند. در این موارد، ابتدا rescan در 300+ DPI را امتحان کنید — source image تمیزتر اغلب بدون تغییر tools مشکل را حل می‌کند. برای documentsی که نمی‌توانید دوباره scan کنید (archival materials، one-of-a-kind records)، ABBYY FineReader degraded text را بهتر از هر consumer OCR engine دیگری مدیریت می‌کند.

از کدام روش باید استفاده کنید؟

FactorMethod 1: All-in-OneMethod 2: Word FirstMethod 3: OCR First
Best forClean text-based PDFsTables, columns, brochuresScanned/image-based PDFs
Format retentionGoodVery goodبه OCR quality بستگی دارد
Effort2 minutes, 3 clicks10–15 minutes20–30 minutes
CostFree previews; paid for fullFree to moderateFree to ~$70/yr (ABBYY)
Pick this if…PDF شما یک report، contract یا article با standard formatting استPDF شما tight tables، multiple columns دارد، یا لازم است translation را edit کنیدPDF شما scan، photo یا imageی است که text در آن selectable نیست

Tips

  • قبل از ترجمه یک 100-page document، one page first را test کنید. هر PDF متفاوت است — toolی که 20-page report شما را perfectly مدیریت می‌کند ممکن است روی file دیگری با mixed layouts fail شود. یک representative page را translate کنید، output را verify کنید، سپس باقی را batch کنید.
  • انتظار text expansion داشته باشید. Translated text به‌ندرت در همان space جا می‌شود. German می‌تواند تا 30% طولانی‌تر از English شود؛ French حدود 15–20%. Chinese و Japanese معمولا compactتر هستند. Text boxes، table cells و narrow columns که برای source language طراحی شده‌اند ممکن است overflow کنند یا gaps ناخوشایند باقی بگذارند. پس از translation، clipped text را در لبه‌های containers بررسی کنید.
  • قبل از upload، passwords و restrictions را حذف کنید. Password-protected یا print-restricted PDFs در بیشتر translation platforms بدون پیام واضح fail می‌شوند. ابتدا file را با security settings در PDF reader خود unlock کنید — یا آن را به یک PDF جدید و unrestricted print کنید.
  • Confidential documents را در free tools upload نکنید مگر اینکه privacy policy آنها صراحتا auto-deletion و no data use for training را تضمین کند. DeepL Pro و OpenL هر دو اعلام می‌کنند uploaded documents را retain نمی‌کنند و روی آنها train نمی‌کنند. Free tiers بسیاری از services دیگر حق استفاده از content شما را برای خود محفوظ می‌دانند — terms را بخوانید.

FAQ

آیا می‌توانم یک PDF را free و بدون از دست دادن formatting ترجمه کنم؟

تا حدی. Free tools مثل iLovePDF (1 document/day)، NoteGPT (free، 50 MB) و free daily preview در OpenL نیازهای occasional را پوشش می‌دهند. اما هر free tier محدودیت دارد — file size caps، daily quotas یا output quality کمتر. برای regular use، paid plans (DeepL Pro از حدود €9/month، pay-per-document model در OpenL) گزینه practical هستند.

چرا وقتی PDF را ترجمه می‌کنم tables همیشه خراب می‌شوند؟

Tables در PDFs به‌صورت independent text blocks ذخیره می‌شوند که با coordinates قرار گرفته‌اند — file هیچ مفهومی از rows، columns یا cell relationships ندارد. وقتی طول translated text تغییر می‌کند، tool باید حدس بزند هر piece کجا belongs می‌شود. Toolی که برای document translation طراحی شده است (مثل OpenL یا document mode در DeepL)، coordinate geometry را analyze می‌کند تا table structure را reconstruct کند. Generic translation tools که plain text را extract می‌کنند و دوباره dump می‌کنند، این کار را انجام نمی‌دهند — همان‌جاست که table پنج‌ستونه شما به دیواری از کلمات تبدیل می‌شود.

کدام tool، images و captions را کنار هم نگه می‌دارد؟

OpenL Doc Translator و Smartcat هر دو حفظ visual elements — images، charts، captions — را در original positions نسبت به surrounding text در اولویت قرار می‌دهند. iLovePDF هم image placement را خوب preserve می‌کند. اگر PDF شما image-heavy است (product brochures، illustrated guides)، ابتدا all-in-one tools در Method 1 را test کنید.

اگر PDF من در یک صفحه چند زبان mixed داشته باشد چه؟

این یکی از سخت‌ترین موارد برای automated tools است. بیشتر translators فرض می‌کنند هر document فقط یک source language دارد. برای PDFs دارای intentional mixed-language content (bilingual contracts، language textbooks، annotated research papers)، OpenL Doc Translator را امتحان کنید — AI engine آن mixed-language sections را بهتر از rule-based alternatives detect و handle می‌کند. برای critical documents، manual post-translation review ضروری است.

آیا font choice پس از translation حفظ می‌شود؟

در بیشتر موارد، نه دقیقا. Translated documents معمولا به‌جای original custom typeface از system fonts یا default font family در tool استفاده می‌کنند. OpenL، font styling (bold، italic، size hierarchy) و color را preserve می‌کند، اما unavailable fonts را با close equivalents substitute می‌کند. اگر brand typography غیرقابل مذاکره است، از روش 2 (Word-first) استفاده کنید و پیش از export به PDF، fonts خود را در translated DOCX دوباره apply کنید.

Sources