PDF із договором, де можна виділити текст, і PDF зі сканом того самого договору виглядають майже однаково. Але працювати з ними треба по-різному. Якщо не перевірити файл заздалегідь, частина написів може залишитися мовою оригіналу, а таблиці й підписи - з’їхати після експорту.
Щоб перекласти PDF і не втратити макет, спершу з’ясуйте, чи є в ньому текстовий шар. Потім пошукайте редагований оригінал, а для сканів запустіть OCR і перевірте, що програма розпізнала. Після перекладу окремо звірте зміст і верстку: одна перевірка не замінить іншу.
Що насправді означає «зберегти форматування» в PDF¶
Збережений макет - це не обов’язково точна копія кожного шрифту й переносу. Головне, щоб перекладений документ було зручно читати й використовувати: заголовки мали зрозумілу ієрархію, таблиці не розсипалися, підписи залишалися біля своїх полів, а текст не перекривав зображення чи печатки.
PDF фіксує вигляд сторінки, але не завжди зберігає структуру, яку зручно редагувати. В одному файлі можна виділяти текст і бачити логічні блоки, інший складається зі світлин сторінок, а третій поєднує текст, скани й графіку. Тож запит «перекласти PDF» насправді містить щонайменше два завдання: витягти весь текст і розмістити переклад так, щоб документ залишався читабельним.
Текст після перекладу може стати довшим або коротшим. Якщо фраза не вміщується в комірку таблиці, вона переходить на новий рядок, блок зсувається, а сторінка змінює вигляд. Правильний переклад сам по собі не виправить вузьких полів, невдалого поділу абзаців або напису, який у вихідному PDF був частиною зображення.
Розділіть перевірку на п’ять частин:
- Повнота вилучення: чи потрапили в роботу всі заголовки, примітки, виноски, колонтитули й підписи.
- Точність розпізнавання: чи правильно зчитані літери, числа, імена, дати й спеціальні знаки.
- Якість перекладу: чи узгоджені терміни й чи не змінився зміст.
- Відповідність макету: чи не обрізаний текст і чи зрозуміло, до якого елемента належить підпис або примітка.
- Готовність фінального файла: чи відкривається PDF і чи можна прочитати текст на кожній сторінці.
W3C пояснює, чому PDF, створений тільки зі сканованих зображень, важко використовувати:
“A document that consists of scanned images of text is inherently inaccessible because the content of the document is images, not searchable text.”
Простіше кажучи, поки скан не має текстового шару, комп’ютер бачить зображення сторінки, а не слова. Спочатку програмі чи перекладачеві треба розпізнати текст. Пояснення W3C про OCR для сканованих PDF також нагадує: розпізнавання може помилятися, тому результат треба звірити зі сканом.
Якщо ти працюєш в агенції або команді, зафіксуй не тільки мовні вимоги, а й те, що саме перевіряти. У формах це можуть бути поля й числа, у таблицях - значення, в інструкціях - підписи до зображень. Якщо не внести такі елементи в завдання, команда може вичитати абзаци й пропустити важливу інформацію, яка не схожа на звичайний текст.
Спершу визначте, який PDF у вас¶
Щоб перевірити PDF, відкрий файл і спробуй виділити курсором слово, скопіювати його й вставити в текстовий редактор. Якщо слова виділяються окремо, у PDF, імовірно, є текстовий шар. Якщо виділяється ціла сторінка як зображення або не виділяється нічого, перед тобою може бути скан без розпізнаного тексту.
Але один тест не доводить, що весь документ готовий до автоматичного перекладу. На більшості сторінок може бути текстовий шар, а на решті - зображення з написами. Наприклад, у презентації, бланку чи каталозі заголовок може виділятися, а дрібний підпис на схемі - ні.
| Тип PDF | Як його розпізнати | Що робити перед перекладом |
|---|---|---|
| Текстовий PDF | Слова можна вибрати й скопіювати | Перевірити структуру та перейти до перекладу |
| Скан без текстового шару | Вміст сторінки поводиться як зображення | Запустити OCR і звірити результат зі сканом |
| Змішаний PDF | Частина тексту виділяється, а частина існує лише в зображеннях | Перевірити кожну сторінку й окремо обробити невидимий для копіювання текст |
| PDF зі складною графікою | Текст прив’язаний до схем, планів, діаграм чи зображень | Визначити, чи треба перекладати підписи всередині графіки та хто оновить макет |
OCR - це оптичне розпізнавання символів. Програма аналізує зображення сторінки й створює текстовий шар, який можна шукати або копіювати. W3C описує OCR як спосіб перетворити зображення тексту на звичайний текст, коли вихідного файла немає. Сам факт розпізнавання ще не означає, що кожне слово прочитано правильно.
Якщо PDF змішаний, склади короткий список проблемних сторінок: відміть форми, графіки, печатки, дрібні підписи й розмиті фрагменти. Не треба одразу переробляти весь документ. Достатньо знати, які місця потребуватимуть уваги, щоб не помітити їх уже після здавання перекладу.
Наприклад, основний текст договору можна скопіювати, але підпис до схеми може бути частиною зображення. Звичайне копіювання його не захопить. Якщо не додати напис до переліку матеріалів для перекладу, в готовому PDF абзаци будуть новою мовою, а схема - старою.
Цифрові підписи, печатки й рукописні позначки перевіряй окремо. Не розраховуй, що OCR розпізнає їх без помилок. Якщо позначка має юридичне чи робоче значення, попроси відповідального фахівця звірити її з джерелом. Не відновлюй зміст навмання.
За підходом W3C, скан без текстового шару не дає змоги звичайно виділяти, редагувати й перекомпонувати текст, доки цей шар не створено. Тож перед питанням «як перекласти PDF онлайн» з’ясуй спершу, чи є у файлі текст, який інструмент узагалі може прочитати.
Який формат вибрати: PDF, Word чи онлайн-переклад¶
Якщо в тебе є вихідний DOCX, PPTX або інший редагований документ, почни з нього. У редагованому файлі простіше працювати з абзацами, таблицями й заголовками, ніж відновлювати структуру зі сторінки, зафіксованої в PDF. Після перекладу відредагуй документ і експортуй його в PDF.
Конвертація PDF у Word - запасний варіант, а не спосіб гарантовано відновити оригінал. PDF може зберігати зовнішній вигляд, але не пояснювати, де закінчується одна комірка таблиці й починається інша. Після конвертації перевір колонки, розриви сторінок, списки й порядок читання блоків.
| Робочий варіант | Коли підходить | Що перевірити |
|---|---|---|
| Редагований вихідний файл | Є DOCX, презентація або інший оригінал | Чи відповідає перекладена версія фінальному макету |
| Переклад текстового PDF | Текст виділяється, а складність верстки помірна | Чи збережені таблиці, заголовки, примітки та переноси |
| OCR сканованого PDF | Текст доступний тільки як зображення | Чи точно розпізнані слова, числа й імена |
| Ручне відновлення макета | PDF має складні схеми, нестандартні блоки або пошкоджену структуру | Хто відповідатиме за фінальну верстку та звірку |
Google Translate дає змогу перекласти документи у браузері: вибрати файл і мови, завантажити документ, натиснути переклад і завантажити результат. За довідкою, перевіреною 1 червня 2026 року, інструмент приймає PDF, DOCX, PPTX і XLSX розміром до 10 МБ; у PDF має бути не більше ніж 300 сторінок (довідка Google Translate). Там само зазначено, що функція недоступна на малих екранах і мобільних пристроях.
Довідка Google попереджає:
“You can find text in images and scanned .pdf pages in the output document but they aren’t translated.”
Тобто напис на скані може залишитися видимим у готовому документі, але не перекластися. Якщо весь PDF - скан, перед перекладом потрібне OCR; якщо PDF змішаний, перевір усі написи, які не вдається скопіювати.
Довідкова сторінка Google описує переклад і завантаження файла, але не обіцяє зберегти кожен шрифт, перенос рядка чи розташування блоків. Тому не вважай документ готовим до передавання замовнику лише тому, що інструмент переклав і завантажив файл. Відкрий його й переглянь сторінки, особливо таблиці та форми.
Для перекладу великої кількості файлів або об’ємних документів Google радить переглянути документацію Cloud Translation API. Обирай між браузерною функцією та іншим процесом з огляду на формат, обсяг і потребу зберегти макет, а не тільки на мову тексту.
Для іншого робочого процесу можна взяти спеціалізований інструмент для документів. Наприклад, у ChatsControl завантажують PDF, отримують перекладений документ зі збереженням елементів верстки - зокрема таблиць, заголовків і списків - і перевіряють результат. Для сканованого файла сервіс спершу запускає OCR. Такий варіант зручний, коли треба перекласти документ, а не вставляти текст частинами в поле перекладу. Але інструмент не призначений для рукописів і дуже неякісних сканів: їх треба звіряти вручну.
Якщо порівнюєш процеси для редагованих файлів, переглянь також матеріал про переклад Word або PDF онлайн зі збереженням форматування. А поради для роботи з DOCX і ChatGPT зібрані у статті про ChatGPT і форматування Word/DOCX.
Які елементи макета найчастіше потребують уваги¶
У кожного документа свої слабкі місця. У договорі це можуть бути номери пунктів, таблиці й виноски; у посібнику - заголовки, підписи до малюнків і посилання між розділами; у звіті - колонки, осі діаграм і дрібні примітки. Перевірка «на вигляд усе нормально» не покаже, чи вцілів потрібний елемент.
| Елемент | Типова проблема після перекладу | Що звірити |
|---|---|---|
| Таблиці | Довший текст переноситься й збільшує висоту рядка | Заголовки колонок, порядок значень, межі сторінок |
| Форми | Переклад не вміщається в поле або підпис віддаляється від поля | Назви полів, підказки, підписи та порожні місця для внесення даних |
| Схеми й графіки | Написи всередині графіки залишаються без перекладу | Позначення, легенду, одиниці вимірювання та підписи |
| Колонтитули й номери сторінок | Повторювані блоки пропускають під час витягання тексту | Назву документа, дату версії, нумерацію й короткі примітки |
| Списки й перехресні посилання | Нумерація змінюється або посилання веде не до того пункту | Порядок пунктів, рівні вкладеності й згадки розділів |
| Виноски | Маркер залишається, а текст примітки зникає або відривається | Відповідність маркера примітці та порядок читання |
| Печатки й позначки | OCR неправильно читає текст на зображенні | Чи потрібне відтворення позначки та чи правильно її описано |
Таблиці можуть зламатися так, що це не одразу помітно. У перекладеному PDF усі слова начебто на місці, але значення з одного стовпця візуально стоїть на рівні сусіднього рядка. Зістав не тільки клітинки, а й те, чи відповідають дані заголовкам колонок.
У формах важлива не лише довжина фрази. Напис може пояснювати поле, бути умовою, яку треба прийняти, або інструкцією для читача. Навіть якщо переклад умістився, але з’їхав до іншого елемента, людина може неправильно зрозуміти, що саме потрібно заповнити.
Зображення не завжди треба перекладати однаково. Напис може бути декоративним, змістовим або частиною схеми. Виріши, чи достатньо перекласти підпис поруч, чи потрібно змінювати саму графіку. Простий текст, накладений поверх зображення, може закрити важливу частину креслення.
У багатомовному документі заздалегідь домовся, що робити з власними назвами, одиницями вимірювання, скороченнями й позначеннями. Термін має залишатися послідовним у таблицях, заголовках і примітках. У матеріалі про збереження форматування у Word, PDF та Excel є поради для різних форматів: ризики в них перетинаються, але виправляти їх доводиться по-різному.
Покроковий процес перекладу PDF із перевіркою¶
Щоб робота йшла передбачувано, розділи діагностику, переклад і верстку. Не виправляй макет навмання, доки не з’ясуєш, чи вдалося витягти весь текст.
- Збережи оригінал. Зроби робочу копію й не перезаписуй отриманий файл. Оригінал знадобиться для звірки розпізнаних слів, чисел і розташування блоків.
- Перевір текстовий шар. Спробуй виділити й скопіювати кілька фрагментів: основний абзац, текст таблиці, колонтитул і підпис до зображення. Перевірка однієї сторінки не підтверджує, що всі сторінки влаштовані однаково.
- Знайди вихідний файл. Запитай замовника, чи є DOCX, презентація або інше джерело, з якого створили PDF. Якщо оригінал є, порівняй його з PDF і переконайся, що це фінальна редакція.
- Виконай OCR для скану. Якщо інструмент дає змогу вибрати мову розпізнавання, вкажи її. Переконайся, що OCR охопив потрібні сторінки, а не тільки перший аркуш.
- Звір OCR до перекладу. Перевір імена, адреси, дати, числа, розділові знаки й позначення. Помилка розпізнавання може перейти в переклад і залишитися непоміченою під час мовної редактури.
- Узгодь вимоги до результату. Визнач формат вихідного файла, потребу зберегти вигляд сторінок, правила для зображень і того, хто відповідатиме за остаточну верстку.
- Переклади й відредагуй текст. Звір ключові терміни, перевір числа й назви, а за потреби дай перекладачеві короткий опис документа.
- Перевір верстку. Відкрий фінальний файл, переглянь кожну сторінку й звір заголовки, таблиці, колонки, переноси, виноски та текст на зображеннях.
- Перевір комплектність. Переконайся, що перекладено всі сторінки й елементи, погоджені із замовником. Якщо частину графіки не змінювали, зафіксуй це окремо.
Не вважай розпізнаний PDF готовим до перекладу. W3C прямо зауважує, що OCR може пропустити частину тексту. Спочатку перевір, чи відповідає розпізнаний текст оригіналу, і тільки тоді використовуй його як джерело перекладу (техніка PDF7 від W3C).
Уяви форму з дрібними цифрами й полем для дати, де решту сторінки займають чіткі абзаци. OCR може добре прочитати абзаци, але змінити символ у даті або пропустити позначку в полі. Тут посторінкова звірка важливіша за швидке вичитування суцільного тексту.
Інструмент для документів може об’єднати кілька кроків, але не замінить перевірку. У ChatsControl завантажений PDF проходить OCR і переклад, а потім сервіс формує документ зі збереженням форматування. Після цього фахівець може переглянути оригінал поруч із перекладом і звірити рядки, імена та числа. Такий перегляд допомагає контролювати відповідність, але не підтверджує юридичну правильність перекладу й не замінює перевірку складної графіки.
Оцінюй машинний переклад і технічну якість файла окремо. PDF може бути точним за формою, але містити термінологічні помилки; влучний переклад може бути погано розміщений на сторінці. Про типові проблеми читай у матеріалі про те, як машинний переклад руйнує форматування документів.
Підводні камені: що може піти не так¶
Не довіряй розпізнаванню лише тому, що після OCR текст можна шукати. Пошук підтверджує наявність текстового шару, але не його точність. Якщо програма неправильно прочитала літеру в прізвищі чи знак у номері, перекладач може прийняти помилку за текст оригіналу.
W3C окремо попереджає:
“OCR may fail to recognize some text.”
Зауваження W3C означає, що частина тексту може не розпізнатися; в описаному процесі Acrobat сумнівні фрагменти позначаються як підозрілі. Якщо такий фрагмент трапився, звір його зі сканом, а не виправляй навмання.
Ще одна пастка - перекладати PDF із текстом у зображеннях так, ніби це звичайний документ із текстовим шаром. Google Translate попереджає, що напис у зображенні або на сканованій сторінці може залишитися у вихідному документі без перекладу. Перевіряй не тільки основний текст, а й підписи всередині схем.
Не думай, що конвертація у Word автоматично повернула початкову верстку. Текст після перетворення може редагуватися, але колонки чи таблиці можуть бути розкладені неправильно. Перш ніж передати файл на переклад або верстку, порівняй його сторінки з оригіналом.
Не перевіряй тільки першу сторінку. У межах одного документа структура може змінюватися: десь звичайний текст, десь форма, діаграма або багатоколонковий блок. Переглянь увесь PDF і познач сторінки, де потрібна окрема увага.
Охайний на вигляд PDF теж може бути неповним. Звір послідовність заголовків, нумерацію, виноски, додатки й повторювані колонтитули. Якщо в оригіналі є сторінка зі складною графікою, переконайся, що її не пропустили під час витягання тексту.
Про технічні обмеження сканованих PDF говорять і в обговоренні на Proz про OCR і переклад сканованих PDF. Обговорення не гарантує якість якогось інструмента, але нагадує про два окремі завдання: спочатку прочитати зображення, а потім відновити сторінку.
У ChatsControl для перевірки є перегляд оригіналу поруч із перекладом і окремий засіб, який допомагає шукати проблеми з числами, іменами, термінологією та пропусками. Такий контроль доречний після автоматичного перекладу, але фінальну верстку все одно перевіряй у самому PDF. Для рукописного або дуже пошкодженого скану автоматичне розпізнавання не замінить ручної роботи.
Перед передаванням файла пройдися коротким чеклістом:
- текст виділяється на всіх сторінках, де має бути текстовий шар;
- написи на схемах, графіках і зображеннях внесені до переліку перекладу;
- результати OCR звірені з оригіналом;
- числа, дати, імена й спеціальні позначення перевірені окремо;
- таблиці, форми, виноски й нумерація залишилися зрозумілими;
- фінальний PDF відкривається й не має обрізаних або перекритих блоків;
- усі зміни макета погоджені, якщо сторінки не вдалося зберегти без змін.
Як обрати робочий процес для команди¶
Починай із того, який результат потрібен замовнику, а не з назви інструмента. Якщо важливий тільки зміст, а макет не має значення, переклади текст і поверни його в погодженому форматі. Якщо документ піде клієнту, до установи або на друк, перевір верстку й комплектність окремо.
| Критерій | Редагований файл і перекладач | Онлайн-переклад документа | OCR, переклад і ручна перевірка |
|---|---|---|---|
| Текстовий шар | Зазвичай доступний у вихідному файлі | Потрібен доступний для читання текст | Створюється для сканів |
| Контроль термінів | Можна узгодити з перекладачем | Залежить від можливостей обраного інструмента | Потрібен окремий перегляд термінів |
| Складний макет | Редагується у вихідному файлі | Після експорту потрібна перевірка | Може вимагати ручного відновлення |
| Ризик пропусків | Залежить від повноти матеріалів | Написи в зображеннях можуть лишитися неперекладеними | OCR може помилятися, тому потрібна звірка |
| Відповідальність за фінальний вигляд | Узгоджується між перекладачем і верстальником | Не можна припускати, що макет збережеться без перевірки | Команда має розподілити OCR, мовну перевірку й верстку |
Для невеликого текстового PDF може вистачити браузерного перекладу з подальшою перевіркою. Google вказує обмеження на розмір і кількість сторінок у довідці, перевіреній 1 червня 2026 року (умови перекладу документів Google). Якщо файл виходить за ці межі або потребує складнішої обробки, довідка радить подивитися документацію Cloud Translation API.
Для документів із таблицями, зображеннями чи сканами не зупиняйся на питанні «чи перекладає інструмент PDF». З’ясуй, чи зберігається потрібна структура, чи обробляються написи в зображеннях, як перевірити OCR і хто виправлятиме макет після експорту. Якщо працює команда, домовтеся про це до початку роботи.
Автоматичний переклад не дорівнює засвідченому перекладу. Якщо текст має бути засвідчений, окремо погодь вимоги установи до перекладача, підпису й оформлення документа. Для такого завдання можна розглянути послугу засвідченого перекладу, де результат проходить людську перевірку й засвідчення за потрібною процедурою.
Обирай процес за трьома критеріями: чи є редагований оригінал, наскільки складний макет і хто відповідає за помилку. Збереження форматування - не одна кнопка, а послідовна робота: від перевірки текстового шару до перегляду останнього експортованого файла.
FAQ¶
Як перекласти PDF і зберегти початкове форматування?¶
Перевір, чи має PDF текстовий шар, і пошукай вихідний DOCX або інший редагований файл. Після перекладу звір таблиці, заголовки, зображення, виноски, переноси й усі сторінки: завантажений результат ще не означає, що макет збережено точно.
Чи перекладає Google Translate текст у сканованому PDF?¶
Ні. Довідка Google Translate повідомляє, що текст у зображеннях і сканованих сторінках PDF може відображатися у вихідному документі, але не перекладається (довідка Google). Спочатку запусти OCR, а потім звір розпізнаний текст з оригіналом.
Чи варто конвертувати PDF у Word перед перекладом?¶
Якщо в тебе є вихідний Word-файл, використовуй його замість конвертації PDF. Якщо оригіналу немає, перевір результат перетворення: таблиці, колонки, списки й порядок читання можуть відрізнятися від вихідного документа.
Як перевірити перекладений PDF на пропущений текст і проблеми з макетом?¶
Порівняй сторінки з оригіналом і перевір таблиці, колонтитули, підписи до зображень, виноски й нумерацію. Окремо звір імена, числа, дати та фрагменти, які розпізнав OCR.
Що зробити перед перекладом сканованого PDF?¶
Збережи копію оригіналу, запусти OCR із правильною мовою розпізнавання й перевір текстовий шар на кожній сторінці. Зістав з оригіналом імена, числа, дати й символи: наявність пошукового тексту ще не доводить, що розпізнавання правильне.
Чи можна перекласти PDF онлайн на телефоні?¶
За довідкою, перевіреною 1 червня 2026 року, функція перекладу документів Google недоступна на малих екранах і мобільних пристроях (довідка Google Translate). Відкрий сервіс у браузері на комп’ютері або вибери інший спосіб роботи з документом.
Чи буде перекладений PDF повністю схожим на оригінал?¶
Не обов’язково. Після перекладу можуть змінитися довжина тексту й переноси, а документація Google не обіцяє точного збереження кожного шрифту чи сторінкового макета. Переглянь фінальний файл і виправ місця, де текст обрізаний або перекриває інші елементи.
Який варіант обрати для PDF із таблицями та зображеннями?¶
Спочатку знайди редагований оригінал. Якщо його немає, перевір текстовий шар і познач зображення з написами. Після перекладу окремо звір таблиці й графіку, а для сканів додай OCR і ручну перевірку розпізнаного тексту.