Повні стандарти редагування машинного перекладу: що означає «готово до публікації»

Розберіть стандарти постредагування: ISO 18587, ISO 17100, MQM та TAUS QE. Дізнайтеся, як професіонали визначають «готово до друку» і який стандарт обрати.

Також: RU EN UK
Повні стандарти редагування машинного перекладу: що означає «готово до публікації»

Коли переклад справді «готовий»?

Ти видатив чотири години на документ. Граматика в порядку, термінологія консистентна, глосарій клієнта дотримано. Відправляєш — і клієнт повертає: «Не готово до публікації». Питаєш: готово для чого саме? Для твіту чи контракту? Для промо-відео чи посібника з експлуатації? Це зовсім різні рівні готовності.

Якість постредагування не має єдиного порога. Це спектр, з назвами типу «легке PE», «повне PE» й «готово до друку». І якщо клієнт просто каже «зроби це готовим до публікації» без уточнення, ти вгадуєш.

Цей посібник розвіює туман. Ми пройдемо через фреймворки що насправді використовуються професіоналами (ISO 18587, ISO 17100, MQM, TAUS), покажемо як перевести їх у чек-лист і допоможемо розрізнити «непогано» від «справді готово».

Спектр постредагування: легке PE, повне PE, готово до публікації

Постредагування — це не одна справа. Коливається від швидких косметичних виправок до повного перегляду другої мовою.

Легке постредагування (light PE): Ти прагнеш читабельності, не досконалості. Сфокусуйся на граматиці, очевидних помилках й розумінні. Ігноруй дрібні розбіжності стилю або фразування що технічно правильне, але незручне. Легке PE зазвичай займає 20-30% часу що потребував би повний людський переклад. Це придатне для внутрішніх документів, чернеток, ситуацій де швидкість важливіша за полірування.

Повне постредагування (full PE): Ти прагнеш якості для публікації. Кожен термін перевірений проти глосарію. Граматика й стиль відполіровані. Культурна відповідність верифікована. Факти й числа перевірені. Ти виправляєш не лише помилки, але й незграбне фразування. Повне PE може займати 50-70% часу перекладу — часом рівно як свіжий переклад, що чомусь деякі перекладачи стверджують що дуже помилковий вихід MT краще просто перекласти заново.

Готово до публікації: Це складне, бо залежить від контексту. Твіт перекладений готовий коли він ясний й відповідає брендові. Медичний документ готовий лише коли його перевірив фахівець та він відповідає регуляціям. Готово = відповідає вимогам кінцевого використання й специфікаціям клієнта, ничого більше.

Індустріальний стандарт для визначення цих рівнів — ISO 18587:2017, що встановлює компетентності, процеси й очікування якості для постредагування машинного перекладу. Розрізняє легке й повне PE формально, але не мандатує який використовувати — це рішення клієнта залежно від призначення документу.

ISO 18587: Стандарт постредагування

Якщо ти працюєш з серйозним клієнтом чи агенцією, вони вірогідно посилаються на ISO 18587 у своїх специфікаціях. Цей стандарт визначає як виглядає професійне постредагування.

Що ISO 18587 вимагає:

  • Кваліфікований постредактор (хтось з підготовкою перекладача, знайомством з предметною областю, досвідом постредагування).
  • Ясне визначення наперед чи ти робиш легке чи повне PE.
  • Документований процес: вибір двигуна перекладу, генерація вихідних даних MT, виконання PE, перевірка QA, доставка.
  • Для повного PE, другий перегляд чи прохід QA рекомендований (хоча не обов’язковий, на відміну від ISO 17100).
  • Документований зворотний зв’язок двигуну MT чи продавцю для майбутнього вдосконалення.

Стандарт не встановлює єдиний «рівень якості». Натомість каже: визначте вашу ціль якості, документуйте ваш процес, й послідовно досягайте цієї цілі. Якщо клієнт каже «легке PE, лише внутрішнього використання», й ти доставляєш це, ти відповідаєш ISO 18587. Якщо вони пізніше скаржаться «але це не було готово до публікації», контракт тебе захищає — бо легке PE було узгоджене наперед.

Ось чому контракти важливі. Професійне постредагування уточнює: легке чи повне PE? Глосарій надано? Хто вирішує питання термінології? Що рахується помилкою? На скільки можеш перевищити кошторис часу PE?

ISO 17100: Ширший стандарт якості перекладу

ISO 17100:2015 покриває всю професійну роботу з перекладу, не лише постредагування. Але це критично для розуміння що означає «якість» в формальному контексті.

核心 ISO 17100 вимога: Кожен переклад мусить пройти перегляд кимось іншим ніж перекладач. Це не є можливістю. Самоперевірка перекладачем не рахується. Потрібен другий кваліфікований лінгвіст щоб виловити що першій пропустив.

Хто вважається кваліфікованим? ISO 17100 визначає компетентність як:

  • П’ять років професійного досвіду перекладу (чи два роки якщо маєш постдипломну освіту з перекладу).
  • Рідна чи майже рідна вільність обох мов.
  • Знання предметної галузі.
  • Технічна компетентність (використання CAT-інструментів, управління проектами, розуміння специфікацій клієнта).

Робота редактора не просто коректура. Вони перевіряють:

  • Точність та консистентність термінології.
  • Граматичну правильність.
  • Відповідність стиль-гайду й глосарію клієнта.
  • Повноту (нічого не потрапило й не додано без причини).
  • Культурну й юридичну відповідність.

За ISO 17100, якщо переклад виходить з помилкою що незалежний перегляд мав би виловити, то перекладач і агенція несуть відповідальність. Ось чому багато агенцій вимагають перегляд як окремий крок з підписом, й чому окремі постредактори працюючи для агенцій часто не ті що доставляють — передають редакторові.

Для самостійних перекладачів використовуючих AI-інструменти чи постредагування MT: ISO 17100 все ще застосовується якщо працюєш за професійним контрактом. Або робиш незалежний перегляд сам (затратно часу) або партнеруєш з іншим перекладачем обмінюючись переглядами. Багато фрілансерів це пропускають з огляду на вартість, що означає вони не ISO 17100 відповідні — й клієнтські контракти часто це вимагають.

MQM: Як помилки рахуються й зважуються

Якщо ISO 18587 й ISO 17100 визначають хто перевіряє якість й коли, то MQM (Multidimensional Quality Metrics) визначає що рахується помилкою й наскільки це важливо.

MQM розбиває помилки на п’ять головних категорій:

Точність — Передає ли переклад значення вихідного? Помилки включають: - Неправильний переклад (невірне значення передане). - Пропуск (контент залишено). - Додаток (контент добавлено без джерельного виправдання). - Неперекладене (іноземне слово чи фраза залишено в вихідній мові).

Плинність — Чи читається цільовий текст природно? Помилки включають: - Граматичні помилки. - Незграбне фразування. - Невідповідне розташування пробілів чи пунктуації.

Термінологія — Чи є терміни консистентні й правильні? Помилки включають: - Невірний термін використаний для запису глосарію. - Невідповідні терміни всередину документу (використання трьох різних слів для одного поняття). - Термінологія невідповідна галузі.

Стиль — Чи відповідний тон, регістр й голос? Помилки включають: - Надто формальний коли потрібен казуальний (чи навпаки). - Голос бренду не відповідає. - Невідповідна формальність по документу.

Локалізація — Чи правильні формати, дати, валюти й культурні посилання? Помилки включають: - Формат дати невірний (DD/MM/YYYY vs MM/DD/YYYY). - Символ чи розташування валюти невірне. - Культурні посилання що не залишаються в цільовій мові.

MQM також призначає ваги серйозності:

  • Незначна (вага 1) — Не впливає на читабельність чи значення. Приклад: кома в невірному місці.
  • Серйозна (вага 5) — Впливає на читабельність чи ясність. Приклад: неправильний переклад ознаки продукту.
  • Критична (вага 25) — Робить текст непридатним чи оманливим. Приклад: юридична стаття неправильно перекладена чи пропущена.

Як використовувати MQM у твоєму робочому процесі: Коли ти перевіряєш переклад, категоризуй кожну помилку. Якщо більшість помилок — незначні проблеми плинності (граматика), це інше ніж жменька критичних помилок точності. Переклад з 50-ма незначними помилками може бути готовим до публікації; один з єдиною критичною пропуском — ні. Це допомагає пріоритизувати що виправляти й скільки часу витратити.

Багато інструментів QA тепер скорочують переклади використовуючи MQM принципи. Ти побачиш вихід типу: «3 критичні помилки, 12 серйозних, 40 незначних» замість просто однієї «оцінки якості». Це багато більш корисно.

TAUS QE Оцінки: Прогнозування зусиль постредагування

TAUS (Translation Automation User Society) розробив інструмент оцінювання якості що прогнозує скільки роботи сегмент потребує — до того як людина його навіть торкнеться.

Оцінка TAUS QE коливається від 0 до 1:

  • 0,84 й вище: «Легкий перегляд потрібен». Вихід MT солідний; швидкий прохід виловить огірки.
  • 0,60 до 0,84: «Стандартне постредагування». Очікуй витратити 30-60% часу перекладу на редагування.
  • Нижче 0,60: «Перекласти заново чи важке PE». Часто швидше перекласти з нуля ніж врятувати цей вихід.

Оцінка базується на семантичній схожості — наскільки близьке цільове значення до вихідного значення — обчислено використовуючи AI вбудовування. Це не людська думка, тому констатно й швидко. Можеш запустити це на 1000 сегментів за секунди.

Чому це важливо для твого робочого процесу: Якщо ти вирішуєш чи редагувати партію MT вихідних даних, запусти перевірку TAUS QE наперед. Якщо 80% сегментів набирають вище 0,84, ти закінчиш швидко з легким PE. Якщо 60% набирають нижче 0,60, ти переклаватимеш більшість все одно — твій клієнт мав би знати що PE не буде рентабельним.

Багато агенцій вбудовують TAUS QE в їхні трубопроводи. Вони автоматично маршрутизують високо-оцінені сегменти молодшим постредакторам (швидкіша доставка, нижча вартість) й низько-оцінені до старших перекладачів (які вирішують: врятувати чи перекласти заново). Це ще не стандартна практика для самостійних перекладачів, але деякі MT платформи (типу DeepL чи Systran) починають пропонувати QE оцінки разом з перекладами.

Практичне: Як зібрати чек-лист постредагування

Фреймворки супер, але ось що виглядає реальний чек-лист:

Перед тим як почати: - Маєш клієнтський глосарій? Якщо ні, запитай. Пропущені глосарії спричиняють 20-30% правок PE. - Знаєш легке чи повне PE? Запитай, письмово. - Знаєш кінцеве використання? (внутрішній документ, взаємодія з клієнтом, юридичний, маркетинг) Це змінює пріоритети.

Під час PE (у порядку пріоритету):

  1. Критичні помилки (MQM Critical вага 25): - Будь-який неправильний переклад терміну в глосарії. - Пропущені речення чи параграфи. - Числа, дати, чи власні імена що неправильні. - Зупинись тут якщо робиш легке PE. Виправ це й ти закінчив.

  2. Серйозні помилки точності (вага 5): - Речення що змінили значення (навіть якщо технічно читабельні). - Невідповідності термінології всередину документу. - Граматичні помилки що впливають на ясність.

  3. Плинність й стиль (вага 1-5): - Незграбне фразування що читається ненатурально. - Невідповідності тону (надто формальне для маркетингу, надто казуальне для технічних документів). - Проблеми форматування (розташування пробілів, пунктуація). - Для легкого PE, пропусти ці якщо вони не блокують розуміння. - Для повного PE, виправ їх всі.

  4. Локалізація й культурна відповідність: - Формати дати/часу неправильні для цільової країни. - Символи чи формати валют неправильні. - Ідіоми чи культурні посилання що не перекладаються.

Після того як закінчиш: - Запусти перевірку глосарію: пошукай твої терміни глосарію й переконайся що кожен використаний консистентно. Інструменти типу memoQ чи XBench можуть автоматизувати це. - Перевір фактично числа, URL, дати. Особливо важливе для контрактів, рахунків-фактур, технічних документів. - Прочитай вголос один повний параграф щоб виловити проблеми ритму й потоку.

Консистентність термінології: Твій найбільший важіль

Ось конкретний важіль що ти контролюєш: управління термінологією. Це найбільший фактор скорочення часу постредагування.

Коли клієнт надає глосарій, забезпечуй його безмилосердно. Якщо глосарій каже «хмарний сервіс», не «хмарні обчислення» чи «хмарні послуги», використовуй лише цю фразу кожного разу. Це видаляє рішення постредагування. Переклад що відповідає глосарію займає 15-25% менше часу редагувати.

Як зібрати глосарій якщо клієнт його не надав:

  1. Просканування вихідного документу для повторних термінів (особливо іменники й фрази що несуть значення).
  2. Визнач 50-100 найкритичніших термінів (назви продуктів, юридичні терміни, жаргон предметної галузі).
  3. Пропонуй переклади, в ідеалі перевірені предметним фахівцем (SME) в цільовій країні.
  4. Документуй кожен термін й його контекст й примітки використання.
  5. Отримай затвердження клієнта.

Спільний глосарій скорочує час PE й також запобігає туди-сюди обговоренням. «Це X чи Y?» відповідається глосарієм, не електронною поштою.

Багато перекладачів пропускають роботу глосарію щоб зекономити час спочатку. Потім вони витрачають удвічі більше часу редагуючи й перевіряючи бо термінологія всюди. Це хибна економія.

Реальний приклад: Коли PE не варто

Ось випадок де постредагування не спрацьовує:

Ти отримуєш MT вихід 50-сторінкового технічного посібника. Це в парі мов де MT двигун слабкий (напр. японський на польський). Ти починаєш PE:

  • Пропущені цілі параграфи (додатки/пропуски).
  • Технічні терміни перекладені невідповідно (хмара/мережа/сервер все використовують неправильну термінологію).
  • Речення настільки помилені що ти мусиш повторно прочитати вихідне щоб зрозуміти що було призначено.
  • Глосарій не надано.

Твої варіанти: 1. Редагувати це (кошторис 60-80 годин при $35/час = $2,100-2,800). 2. Перекласти з нуля (кошторис 40-60 годин при $50/час = $2,000-3,000).

Варіант 2 швидше і краще. Варіант 1 — пастка — ти витрачаєш удвічі більше часу бо ти намагаєшся врятувати непридатний вихід.

Професіональні перекладачи роблять це рішення базуючись на TAUS QE оцінках чи швидкому зразкові PE (редагуй першу 2-3 сторінку). Якщо зусилля невясні, ти отримуєш зарплату за оцінювання — час витрачений з’ясовуючи чи PE можливе чи ні, — це оплачується. Не роби це безплатно.

Часті питання

Яка різниця між легким і повним постредагуванням?

Легке PE сфокусоване на читабельності й базовій точності — виправляє граматику та серйозні помилки для внутрішнього використання — займає ~20% часу перекладу. Повне PE забезпечує якість для публікації — перевіряє термінологію, стиль, культурну відповідність, повноту — займає ~50-70% часу. Використовуйте легке PE для некритичного контенту, повне — для матеріалів клієнта.

Як перекладачи знають, коли переклад готовий до публікації?

Готово означає відповідає специфікаціям клієнта й вимогам кінцевого використання. ISO 17100 вимагає перегляду другим лінгвістом. MQM фреймворки перевіряють нульові критичні помилки й мінімальні серйозні. Практичні перевірки використовують вирівнювання глосарію, точність фактів, культурну відповідність. Визначення варіюється — пост у соцмережах і контракт мають різні стандарти.

Чому деякі перекладачі вважають машинний переклад як той, що неможливо редагувати?

Деякі MT двигуни видають вихід настільки помилкий (масивні пропуски, суперечливі терміни глосарію, незрозумілі фрази) що переписування швидше за редагування. TAUS оцінки нижче 0,60 зазвичай так себе поводять. Професіональні постредактори роблять судження: якщо редагування триватиме довше ніж свіжий переклад, ефективніше перекласти заново.

Як глосарії термінів скорочують час редагування?

Консистентна термінологія скорочує час редагування закріпленням очікуваних варіантів слів. Без глосарію постредактор витрачає час вирішуючи який варіант правильний. З глосарієм затвердженим SME, це рішення вже прийняте. Само по собі це може скоротити час PE на 15-25% для технічного контенту.

Що вам говорить TAUS оцінка якості?

TAUS (Translation Automation User Society) оцінки прогнозують скільки редагування потребує сегмент. Оцінки 0,84+ потребують лише легкого перегляду. Оцінки 0,60-0,84 потребують стандартного постредагування (термінологія, виправки плинності). Оцінки нижче 0,60 вірогідно потребують перекладу заново. Оцінка базується на семантичній схожості між вихідним й цільовим текстом, не на людській думці.

Хто відповідає за помилки знайдені після того як переклад опубліковано?

За ISO 17100, перекладач/агенція які підписали відповідають якщо помилка була б виловлена при належному перегляді. Якщо обидва — перекладач і редактор — підписали, то агенція (не окремі перекладачі) несе відповідальність. Для клієнтських глосаріїв, клієнт ділить відповідальність за помилки термінології. Контракти зазвичай визначають строки виправлення після здачі (24-48 годин для дрібних виправок).

Спробуйте ChatsControl

AI-платформа для професійних перекладачів

Спробувати безкоштовно →