Ти вже три години переформатуєш 40-сторінковий фінансовий звіт, який повернувся від машинного перекладу. Таблиці перемішані, маркери розсипані по сторінках, шрифти спотворені, а той ретельно розроблений шаблон контракту? Виглядає як якщо б пережив заклинення принтера. Ласкаво просимо в кладовище форматування — де машинний переклад і структура документа йдуть помирати.
Проблема не в самому перекладі. Це те, що більшість систем MT видаляють коди форматування перед перекладом, працюють з чистим текстом, а потім повертають купу слів без будь-якої структурної інформації. Реконструкція макету, що слідує за цим? Її або немає, або вона настільки груба, що ти витрачаєш більше часу на виправлення формату, ніж на уточнення мови.
Це не крайній випадок — це норма. За опитуванням перекладачів 2025 року, 66% повідомляють, що вихід MT вимагає значних правок після постредагування, а чверть кажуть, що якість просто погана. Однак 87% професіоналів все ще використовують MTPE (постредагування машинного перекладу), тому що при правильному використанні це може економити до 63% часу на повторюваному роботі. Хитрість полягає у знанні, коли використовувати який метод, і як структурувати робочий процес, щоб виловити руйнування форматування до того, як це коштуватиме тобі годин роботи.
Давай розберемося, чому MT руйнує форматування, що насправді працює, і який підхід підходить для твоєї ситуації.
Технічна причина, чому MT спотворює твої документи¶
Системи машинного перекладу працюють з текстом, а не з документами. Ця фундаментальна різниця пояснює все, що йде не так.
Ось що відбувається:
1. Коди форматування видаляються під час вилучення. Коли MT читає твій DOCX або PDF, він не бачить “Заголовок 1 у Calibri Bold”. Він бачить чистий текст: “Фінансова резюме компанії”. Все метаінформація — шрифт, розмір, колір, стиль абзацу — видаляється. Те саме з таблицями: структурна розмітка зникає, залишаючи лише вміст комірок.
2. Текст перекладається ізольовано. Двигун MT перекладає той чистий текст без жодної свідомості того, як він вписується в більший макет. Речення, яке в англійській мові складається з 14 слів, може містити 18 слів у німецькій мові або 10 слів у китайській. Система не піклується — вона просто видає переклад.
3. Форматування переповідно вставляється. Інструмент намагається переповідно вставити коди, але він робить припущення на основі освіти. Чи той період закінчив абзац або речення? Чи цей розрив лінії був навмисним або просто автоматичним переносом? Результат — найкраще наближення реконструкції, часто неправильне.
4. Складні структури (таблиці, багатоколонкові макети, заголовки, пов’язані з нижніми колонтитулами) повністю розсипаються. Коли комірки таблиці містять різну кількість тексту до і після перекладу, вся структура дестабілізується. Зображення, які були прив’язані до конкретного тексту, тепер плавають. Заголовки, які були одним рядком, тепер займають три. Таблиці у PDF-ах? Забудь — PDF-и мають фіксовану розташовану на пікселях структуру, і текст не може перевватися.
Саме тому фахівці кажуть: PDF — твій ворог для перекладу. Жорстка структура формату означає нульову гнучкість для розширення чи стиснення тексту. Той же документ у DOCX може перевватися; у PDF це цегла.
Чому зміна довжини тексту руйнує все¶
Ось цифра, яка має значення: перекладений текст рідко має таку ж довжину, що й вихідник.
За словами фахівців перекладу, мовні пари мають передбачувані коефіцієнти розширення чи стиснення:
- Англійська → Німецька: +15% до +20% кількості слів (дівогі німецькі складені слова займають місце)
- Англійська → Іспанська: +10% до +15% (іспанська використовує більше слів для однієї концепції)
- Англійська → Китайська: -20% до -30% кількості слів (китайські символи щільно містять значення)
- Англійська → Французька: +10% до +15%
Це розширення не абстрактне. Коли ти перекладаєш односторінковий англійський контракт на німецьку, він стає принаймні 1,2 сторінками. Та таблиця з 5 колонками? 6-та колонка опускається вниз. Заголовки, розроблені для одного рядка, тепер потребують двох. Маркери, які акуратно поміщаються, тепер розсипаються по сторінках.
Загальні інструменти (Google Translate, ChatGPT, безкоштовний браузерний інструмент DeepL) не мають механізму для справління з цим. Вони витягують текст, перекладають його й повертають назад — сподіваючись, що структура виживе. Як показують дослідження, це рідко трапляється.
Три професійних підходи, які насправді працюють¶
Підхід 1: CAT-інструменти (Trados, memoQ) - для повторюваної роботи¶
CAT (Computer-Assisted Translation) інструменти розроблені для професіоналів, які перекладають повторно. Вони працюють на рівні формату файлу, що означає вони витягують текст, зберігаючи базові коди структури, перекладають текст безпечно в ізольованому середовищі сегмент-за-сегментом, і потім переповідно вставляють коди в новий документ, використовуючи оригінальний шаблон.
Як це працює:
- Ти відкриваєш свій DOCX у Trados або memoQ.
- Інструмент аналізує файл і визначає сегменти: абзаци, комірки таблиці, заголовки, підписи. Коди форматування залишаються прив’язаними до кожного сегмента.
- Ти (або MT) перекладаєш сегменти всередині редактора інструменту — сегмент залишається прив’язаним до свого контексту форматування.
- Інструмент реконструює документ, переповідно вставляючи всі коди. Таблиці залишаються таблицями, шрифти залишаються шрифтами, розриви сторінок виживають.
Сильні сторони: - Обробляє складні файли (Word, PowerPoint, InDesign, Excel, HTML, XML). - Пам’ять перекладів означає, що ти не перекладаєш повторювані фрази. - Перевірки якості ловлять відсутні числа, невідповідну термінологію, зламані коди. - Інтегрується з двигунами MT (Google, DeepL, користувацькі нейронні моделі) для автоматизації першого чернетки.
Слабкі сторони: - Крута крива навчання; займає тижні для налаштування команди. - Витрати на ліцензування: €500-1000+ на рік на перекладача. - Надмірно складно, якщо ти перекладаєш раз на пів року. - Вимагає чистих вихідних файлів (дійсна структура таблиці, відсутні вбудовані зображення в комірках, послідовні стилі). Смітник на вході = смітник на виході.
Найкраще для: Бюро перекладів, внутрішніх команд з великим обсягом, повторюваних документів (юридичні шаблони, технічні посібники, звіти про відповідність).
Підхід 2: Попередня підготовка твого документа - швидка виправка¶
Перед передачею чогось на MT виправляй сам документ. Це коштує часу спочатку, але економить масивну роботу з постредагування.
Чек-лист перед відправленням на MT:
- Видаліть вбудовані зображення та текст у графіці. Якщо твій логотип або діаграма має накладений текст, система MT спробує перекласти цей текст — він закінчиться спотвореним або розсипаним. Замість цього видобуй текст у викличні.
- Розбий таблиці на прості структури. Немає вкладених таблиць, немає об’єднаних комірок, немає контенту, який займає кілька колонок. Плоскі таблиці виживають MT; складні розсипаються.
- Послідовно використовуй стилі. Не застосовуй жирне шрифту безпосередньо — використовуй стиль “Наголос”. Не регулюй інтервали вручну — використовуй стилі абзацу. Коли стилі послідовні, інструмент може передбачувано їх переповідно застосувати.
- Помічай текст у текстові поля, а не у форми. Форми (особливо повернені чи розташовані) не перекладаються чисто; їх розташування втрачається або текст всередину не перекладається.
- Видаліть прямі форматування. Видалити прямі наголошення шрифту/розміру/кольору; покладатися на шаблон. Коли форматування прив’язане до стилів, воно виживає; прямі форматування часто не виживають.
- Спростіть заголовки та нижні колонтитули. Складні макети заголовків (зображення + таблиці + текст) часто розсипаються. Використовуй прості текстові заголовки; додавай складність назад при постредагуванні.
- Позначте незвичайний контент. Додайте коментарі чи нотатки: “Ця таблиця про ціни — зберігайте вирівнювання,” або “Це зображення містить японський текст, який потребує окремого перекладу.”
Зусилля: 30 хвилин до 2 годин на документ, в залежності від розміру. Виграш: На 30-50% швидше постредагування, тому що система MT має чистіший вхід.
Найкраще для: Окремих документів, звітів, які ти перекладаєш внутрішньо, сканованих документів, які ти оцифровуєш перед перекладом.
Підхід 3: AI-інструменти з вбудованим збереженням форматування - найшвидші для окремих документів¶
Нова категорія інструментів (як ChatsControl) розроблена спеціально для перекладу цілих документів при збереженні форматування — без налаштування CAT-інструменту, без підготовки попередньої підготовки.
Як це працює:
- Завантажуй свій DOCX, PDF чи PowerPoint.
- Інструмент запускає OCR, якщо це скан, потім аналізує структуру документа (визначаючи текст, таблиці, зображення, заголовки, стилі).
- Він перекладає контент, зберігаючи структурну свідомість — таблиці залишаються таблицями, шрифти залишаються шрифтами.
- Ти отримуєш той же формат файлу з збереженим форматуванням і двомовним поглядом «поруч» для перегляду.
- Використовуй чат-функцію для запиту змін до конкретних уривків без перекладу цілого документа.
Сильні сторони: - Немає налаштування, немає кривої навчання — завантажуй і вперед. - Автоматично обробляє PDF-и, сканування та форматовані документи. - Двомовний перегляд вбудований, тому ти бачиш вихідник і переклад поруч. - Вбудовані перевірки якості для чисел, імен, упущеного контенту. - Швидко: більшість документів повертаються за хвилини на годин, а не дні. - Працює для окремих перекладів, а не просто для повторюваної роботи великого обсягу.
Слабкі сторони: - Немає пам’яті перекладів (тому повторювані фрази не відслідковуються для послідовності в проектах). - Не є повнофункціональним інструментом командного робочого процесу — немає управління продавцями, без формальних ворот якості. - Не підтримує рукописні документи чи дуже низької якості сканування (ці все ще потребують ручної обробки).
Найкраще для: Фрілансерів, окремих професійних перекладів, робочих процесів двомовного перегляду, документів, де швидкість має значення, сертифікацій, які ти хочеш QA-йти перед доставкою клієнтам.
Порівняння поруч¶
| CAT-інструменти (Trados, memoQ) | Попередня підготовка | AI-інструменти (ChatsControl) | |
|---|---|---|---|
| Час налаштування | Дні до тижнів | Немає | 5 хвилин |
| Крива навчання | Крута | Немає | Немає |
| Вартість | €500-1500/рік + навчання | Час (підготовча робота) | За символ ($20-50 типово) |
| Найкраще для | Робочі процеси агентства, великий обсяг | Змішані робочі процеси | Швидкі окремі, двомовний перегляд |
| Збереження форматування | 95%+ (якщо вихідник чистий) | 80-90% (залежить від постредагування) | 90%+ (AI-вбудований) |
| Пам’ять перекладів | Так | Ні | Ні |
| Командна співпраця | Так (з функціями) | Обмежено | Обмежено (спільні посилання) |
| Добре обробляє PDF-и | З плагіном OCR | Складно | Так, за замовчуванням |
| Час за документ 5000 слів | 4-8 годин (переклад+перегляд) | 2-4 години (підготовка+MT+редагування) | 1-2 години (завантаження+перегляд+уточнення) |
Як професійні робочі процеси насправді це обробляють¶
Реальний світовий переклад форматованих документів не полягає в одному підході — це комбінація.
Типовий робочий процес для юридичного контракту (20 сторінок, зміст, форматовані таблиці, блок підпису):
- Попередня підготовка вихідника (30 хвилин). Спростіть заголовок/нижній колонтитул, вирівняйте складні таблиці, додайте коментарі, позначаючи незвичайне форматування.
- Запусти через CAT-інструмент чи AI-інструмент (2 години). Дозволити Trados чи ChatsControl перекласти, збережучи структуру.
- Двомовний перегляд (1,5 години). Читайте вихідник і переклад поруч, ловіть помилки перекладу, невідповідність термінології, та початкове руйнування форматування.
- Постредагування форматування (1 година). Перевіти текст, який не поміщався, виправити сиротські маркери, переповідно вирівняти вміст таблиці, налаштувати інтервали.
- Проходження QA (30 хвилин). Запустіть автоматизовані перевірки (або ручне сканування) для: відсутніх чисел, змінених власних імен, зламаної структури таблиці, розривів сторінок в дивних місцях.
- Доставка (5 хвилин). Експортуй до остаточного формату (PDF, підписаний DOCX, що б не потребував клієнт).
Загальний час: 5-6 годин за 20 сторінок. Без інструментів форматування той же документ займає 12-16 годин, тому що ти або борешся з загальним інструментом MT, або перебудовуєш документ з нуля.
Поширені помилки, які вбивають форматування (і як їх уникнути)¶
Помилка 1: Переклад PDF безпосередньо без OCR чи відновлення вихідника. PDF-и є дисплей-перший, що означає, вони оптимізовані для перегляду, а не редагування. Текст прив’язаний до координат пікселів, зображення вбудовані, шрифти заблоковані. Переклад PDF без попередньої конвертації його в DOCX — це прохання на знищення.
Виправка: Завжди запрашуй вихідні DOCX чи PPTX. Якщо у тебе лише PDF, використай OCR для переобудови редаговної версії спочатку (ABBYY FineReader, Acrobat Pro), потім перекладай DOCX.
Помилка 2: Копіювання вихідника MT у твій оригінальний файл. Ти перекладаєш у Google Translate, отримуєш текст назад, копіюєш-вставляєш його в твій форматований документ Word. Шрифти змінюються, інтервали вибухають, таблиці розсипаються.
Виправка: Ніколи не копіюй-вставляй MT у твій форматований оригінальний. Або використовуй інструмент, який зберігає форматування (CAT чи AI-інструмент), або перебудуй документ з чистого шаблону.
Помилка 3: Припущення, що CAT-інструменти обробляють погану якість вихідників. CAT-інструмент є настільки хорошим, наскільки гарний вихідний файл. Якщо твій оригінальний DOCX має зламані таблиці (невідповідна кількість рядків, неправильна розмітка), або якщо комірки містять зображення, інструмент не може виправити це — він просто спадкує безлад.
Виправка: Попередня підготовка жорстко. Якщо вихідник зламаний, переклад буде зламаний.
Помилка 4: Недооцінювання розширення тексту при постредагуванні. Ти отримуєш назад німецький текст, який на 20% довший. Ти вставляєш його назад у твій однаксторінковий англійський макет, сподіваючись, що він поміститься. Він не поміщається. Тепер половина твоїх маркерів розсипається й твій нижній колонтитул сидить посередині сторінки.
Виправка: Припущення про розширення/стиснення заздалегідь. Резервуй додаткове місце в полях, використовуй стилі, які можуть перевватися, або перебудуй сторінки під час постредагування замість того, щоб пхати новий текст у старі контейнери.
Помилка 5: Трактування всіх мовних пар рівномірно. Англійська-іспанська? Руйнування форматування помірне (текст зростає на 10-15%). Англійська-китайська? Текст скорочується на 20-30%, і тобі можливо потрібно зменшити розміри шрифтів. Англійська-японська? Схоже на китайську, плюс тобі потрібно перевірити проблеми з макетом справа-ліво.
Виправка: Перед перекладом на нову мову оцініть розширення тексту за допомогою галузевих бенчмарків. Залишай місце відповідно.
Поєднання всього разом: твоє дерево рішень¶
Перекладаєш вперше або окремі документи? → Використовуй AI-інструмент типу ChatsControl. Швидше, без налаштування.
Великий обсяг повторюваної роботи (100+ документів/рік)? → Інвестуй у Trados чи memoQ. Пам’ять перекладів окупає себе після 30-50 документів.
Комбінація обох? → Попередня підготовка у Word (30 хв за док), запусти через AI-інструмент чи MT-двигун, постредагування (1-2 години).
Тільки сканування чи лише PDF-и? → AI-інструмент чи OCR + Trados. Загальна MT не допоможе.
Потребуєш сертифіковані/юридично обов’язуючі переклади? → Використовуй AI для чернетки (двомовний перегляд + QA вбудовані), потім мати присяжний перекладач перевірити та поставити печатку.
Суть: руйнування форматування в MT вирішуване, але це вимагає вибору правильного інструменту для твого робочого процесу. CAT-інструмент не допомагає, якщо ти перекладаєш п’ять документів на рік; AI-інструмент не масштабується до 500. Знай твій обсяг, знай свої болючі місця й вибирай відповідно.
Часті питання¶
Запитання: Чому Google Translate руйнує мій PDF, а Word краще? Відповідь: PDF-и мають жорсткі, фіксовані макети — текстові поля не розширюються. Word-документи (DOCX) мають гнучку структуру, тому текст може перевватися. PDF це формат-перший; Word це контент-перший. Завжди замовляйте DOCX або надавайте редаговний вихідник.
Запитання: Чи можу я просто скопіювати вихід MT назад у свій оригінальний файл? Відповідь: Ні — перекладений текст рідко має таку ж довжину. Німецькі та нідерландські переклади на 15-20% довші за англійські, китайські на 30% коротші. Копіювання розриває текстові поля, зміщує зображення й руйнує нумерацію сторінок. Відбудуйте з форматованого вихідника.
Запитання: Чи CAT-інструменти типу Trados дійсно зберігають таблиці? Відповідь: Так, але тільки якщо ваш вихідний файл чистий (дійсна синтаксис таблиці, послідовні стилі). CAT-інструменти зберігають структуру таблиці, витягуючи й переповідно вставляючи коди форматування. Якщо вихідник має зламану розмітку, CAT-інструменти не можуть її виправити.
Запитання: На скільки MTPE швидший за переклад з нуля? Відповідь: До 63% швидше для повторюваного, технічного контенту з хорошим виходом MT. Творчі, юридичні та медичні тексти показують менші здобутки (20-40% швидше), тому що потребують більше переробок. Якість перекладу варіюється за мовними парами (ANG→NIM краще, ніж ANG→JAP).
Запитання: Чи мені потрібен інструмент типу ChatsControl, якщо я вже використовую Trados? Відповідь: Ні — Trados це повна CAT/TMS для командних робочих процесів та використання пам’яті перекладів. ChatsControl швидший для окремих документів і автоматично зберігає форматування без налаштування. Використовуйте Trados, якщо керуєте робочими процесами продавців; ChatsControl для швидких двомовних чернеток.
Запитання: Яка різниця між попередньою підготовкою та постредагуванням форматування? Відповідь: Попередня підготовка: виправте форматування вихідника перед MT (чисті таблиці, видаліть вбудовані зображення, спростіть стилі) щоб MT був легший. Постредагування: виправте вихід MT та перевіте текст до цільового формату. Обидва потрібні для складних документів.