Ти ціноутворення МТОО проект за $0.04 за слово (на 40% дешевше за повний переклад), а редактор каже, що це найвалідніша робота цього місяця. Тим часом інший редактор молотить подібну за довжиною роботу за половину часу. Однакова кількість слів, різко відрізняється зусилля - а ти платиш їм однаково.
Це ловушка, в яку потрапило 86% редакторів за 2024-2025 рік. Проблема не в самому МТОО, а в тому, що словна ціна повністю ігнорує складність. Сегмент з однією помилкою терміну займає 30 секунд роботи. Інший з розбитою граматикою, невідповідним тоном і пропущеними смислами потребує 15 хвилин. Обидва - це “100 слів”, обидва платять однаково. Це не ціноутворення, це арифметика.
Що змінилось у 2024-2025: агенції почали вимірювати зусилля редагування на рівні сегмента. Вони оцінюють кожен кусок машинного виходу за тим, наскільки важко його насправді виправити, потім встановлюють ціни відповідно. Не як довільна знижка, а як дані-засновна модель, яка захищає дохід редактора, передбачає терміни проектів і дає клієнтам чесні кошти наперед.
Ось як побудувати одну.
Три виміри зусилля редагування¶
Коли редактор займається редагуванням машинного виходу, виникають три різні види роботи одночасно. Змішування їх разом дає розпливчату картину; виміри розділено розкривають, де живе складність.
Тимчасове зусилля - найпростіше: загальний час, витрачений на сегмент, у секундах або хвилинах. Таймер Matecat або логгер клавіш Translog II відстежує це автоматично. Проблема: сам час не надійний. Один редактор працює повільніше через сумлінність, інший поспішає, але все ще досягає якості. Час змішує темп з зусиллям.
Технічне зусилля підраховує фактичні зміни - натискання клавіш, вставлення, видалення, заміни, перестановки. Якщо редактор переписує все речення, це десятки натискань. Якщо змінює одне слово - це кілька. Логування натискання через Translog II або історію редагування Matecat фіксує це точно. Дослідження показують, що дані натискання варіюються на ~50% між різними двигунами MT, що робить це чутливим індикатором того, наскільки насправді було змінено. Час, навпаки, варіюється лише на 13-21% для того ж тексту - набагато слабший сигнал.
Когнітивне зусилля - це психічне навантаження: наскільки багато думання було потрібно для виправлення цього сегмента? Дослідники наближають це, підраховуючи паузи (моменти, коли редактор припиняє друкувати й думає). Якщо редактор зупиняється 10 разів у сегменті, той сегмент був когнітивно виснажливим. Якщо зупинець один - він був прямолінійним. Цей метрик складніше захопити в продакшені (потребує спеціалізованих інструментів як Translog II з гейз-трекінгом), але він вирівнюється з досвідом редактора: “Той сегмент змусив мене багато думати.”
От у чому клопіт: ці три виміри не завжди корелюють. Сегмент може мати високе технічне зусилля (багато натискань), але низьке когнітивне (“просто прибиранння”). Інший може мати низькі натискання, але високе когнітивне (“мне треба переписати весь смисл, тому що вихідний був двозначним”). Ось чому одиничні метрики не працюють. Справедлива праця-засновна модель повинна враховувати всі три.
Чому словна ціна розвалилась¶
До нещодавно більшість МТОО проектів ціноутворилась за словом: $0.03-0.06/слово залежно від мовної пари та рівня якості. Це просто, передбачуєм для клієнта, й прозоро. Це також повністю ігнорує те, що складність сегмента не має нічого спільного з його довжиною.
Розглянемо реальний випадок: технічний фармацевтичний документ, 10,000 слів. Якість машинного перекладу непоганна - модель була навчена на подібних документах. Більшість сегментів на 95% використовувані; редактор глянув, виправив термінологічну помилку й вперед. Зусилля за сегмент: 20 секунд. Вартість для клієнта: $300-600. Справедливо.
Тепер: креативна маркетингова кампанія, 10,000 слів. Машинний переклад - це структурна лажа - він буквально перекладав ідіоми, тон був повністю неправильним, і вигадав пунктуацію. Редактор практично повинен повторно перекласти половину документу. Зусилля за сегмент: 5-10 хвилин. Та ж $300-600 вартість для клієнта. Катастрофічна недоплата на стороні редактора.
Кількість слів не дбає. Редагування “виправити кому” та редагування “переписати цей параграф з нуля” обидва рахуються як одне слово. Ось чому у 2024-2025 роках відповідь GTS State of MTPE показала, що редактори відходять від словних ставок. Модель ігнорує фактичну виконану роботу.
Годинні ставки мають власну проблему: непередбачуваність для клієнта. Якщо ти цитуєш $25/годину й не знаєш, скільки сегментів буде легкими проти важких, ти можеш у підсумку виставити рахунок клієнту $800 за проект, який спочатку оцінив на $400. Клієнти ненавидять сюрпризи. Вони хочуть знати напочатку, що коштує проект. Годинні ставки дають їм ні те, ні інше.
Відстань редагування: модель, яка перемагає¶
Що замінює словну ціну - це не також час-заснована. Це відстань редагування - метрик, що захоплює, наскільки багато тексту було насправді змінено під час редагування.
Відстань редагування має кілька назв: постредагована відстань (PED), відстань редагування, або TER-засновна оцінка. Концепція прямолінійна: якщо редактор змінює 20% слів (через видалення, вставлення, заміни чи переписування), вони отримують компенсацію як за 80% збіг пам’яті перекладів. Якщо вони змінять 50%, вони отримують платню за 50% збіг. Якщо вони переписують 100% сегмента (в основному повторно перекладають його), вони отримують ставки повного перекладу.
Це вирівнює оплату з фактичною роботою. Неторкнутий сегмент (0% редакованих)? Мінімальна платня - по суті редакторські ставки ($0.01-0.02/слово). Переписування на 30%? МТОО ставки середнього рівня ($0.025-0.04). Повна переписування на 100%? Ставки повного перекладу ($0.06-0.12).
Як одна LSP висловилась у дослідженні, цитованому Taylor & Francis: “Якщо 20% було переписано, лінгвіст отримує ту ж суму, що й за 80% збіг у пам’яті перекладів.” Це редагування відстані на практиці - і це стає стандартом серед середніх та великих агенцій.
Як ти це вимірюєш? Більшість сучасних CAT інструментів це логує. Історія редагування Matecat показує кожне натискання й зміну. Trados Studio має відстежування історії редагування. SmartCAT, memoQ та інші також роблять. Витягніть відстань редагування за сегмент (зазвичай розраховується як: відредаговано_символів / усього_символів * 100), і у тебе є основа ціноутворення.
Вихід: відстань редагування сильно корелює з фактичним зусиллям. Сегмент з 20% редагування майже завжди займав 3-5x більше часу, ніж сегмент з 2% редагування, незалежно від того, чи був редактор швидким чи повільним. Це об’єктивна, повторювана міра.
Впровадження праці-заснованої оцінки у твій робочий процес¶
Перехід до праці-заснованого ціноутворення вимагає трьох кроків: виміри, передбачення, і маршрутизація.
Виміри: зберіть базові дані¶
Виберіть реальний проект - 20,000-50,000 слів є ідеальним - і відстежуйте його повністю протягом одного місяця. Попросіть своїх редакторів використовувати Matecat, Translog II або натичне логування вашого CAT інструменту. Захопліть:
- час за сегмент (загальний час від завантаження сегмента до його завершення)
- натискання клавіш або операції редагування за сегмент
- символи-рівневу відстань редагування за сегмент
В кінці експортуйте дані і корелюйте з вихідним текстом. Сегменти з низькоресурсних мов займали більше часу? Чи технічна термінологія спричинила більше редагування? Чи сегменти з нечіткими збігами потребували більше натискання?
Ви виявиш закономірності. Можливо, 60% ваших сегментів скупчуються в “легкій” зоні (<30 секунд, <10% редагування), 30% - “середні” (30 секунд-2 хвилини, 10-40% редагування), і 10% - “складні” (2+ хвилини, 40%+ редагування). Ці скупчення стають вашими рівнями ціноутворення.
Передбачення: використовуйте оцінку якості¶
Перед тим, як редактор торкнеться сегмента, ви можете передбачити його складність за допомогою оцінки якості (QE). Інструменти QE аналізують вихідний текст і машинний переклад, й виводять оцінку (зазвичай 0-1, або 0-100), вказуючи на ймовірність того, що сегмент буде складним для редагування.
Інструменти, які це роблять:
- Matecat включає плагін MTQE (MT Quality Estimator), що оцінює кожен сегмент вбудовано. Запустіть його перед призначенням роботи.
- ModernMT пропонує адаптивний машинний переклад з вбудованими оцінками QE за сегмент.
- TAUS EPIC (API оцінки якості Translation Automation User Society) оцінює сегменти за шкалою 0-1 і може автоматично маршрутизувати їх на легке чи повне редагування.
- Language Weaver (RWS) має модуль оцінки якості, вбудований у його корпоративну платформу.
Оцінка QE від 0.85-1.0 означає “цей сегмент, мабуть, хороший, мінімальні редагування очікуються” (легкий рівень). Оцінка 0.4-0.6 означає “невпевнено, ймовірно, потребує значної роботи” (середній рівень). Оцінка 0-0.4 означає “це, мабуть, розбито, очікуйте великого переписування” (складний рівень).
Запустіть QE перед призначенням, і ви ціноутворення проекту напочатку. Замість здогадування ви знаєте: “Цей 5,000-словний документ має 52% легких сегментів, 38% середніх, 10% складних. Виходячи з ваших історичних даних про зусилля, цей проект коштуватиме $450-550.”
Маршрутизація: узгодження складності зі здатністю¶
Після оцінки сегментів маршрутизуйте їх розумно.
- Легкі сегменти (висока оцінка QE, історично <10% редагування) → молоді редактори або високошвидкісні фрілансери. Зменшена ставка ($0.015-0.03/слово). Швидке передавання.
- Середні сегменти (оцінка QE 0.4-0.7, 10-40% редагування історично) → ваша основна команда редагування. Стандартні ставки МТОО ($0.03-0.06/слово).
- Складні сегменти (низька оцінка QE, 40%+ редагування історично) → досвідчені редактори або предметні спеціалісти. Премієм МТОО або близькі до повних ставок перекладу ($0.05-0.08/слово), бо вони можуть потребувати знання домену або творчого переписування.
Ця маршрутизація робить три речі:
- Передбачуваність вартості. Ви знаєте напочатку, що проект коштуватиме клієнту - не “близько $500”, а “$487-523 залежно від кінцевої відстані редагування.”
- Справедливе компенсування. Редактори бачать, що складність варіюється, і платня це відображає. Складні сегменти платять більше. Легкі сегменти платять менше. Немає довільної 40% знижки на весь борт.
- Контроль якості. Ви не призначаєте медичної термінології молодому редактору. Спеціалісти обробляють спеціалізовану роботу. Результат: менше помилок, швидші цикли виправлень, вища задоволеність клієнтів.
Побудова вашої моделі ціноутворення: числа, які вам потрібні¶
Щоб зробити це конкретним, ось як виглядає реальна карта ціноутворення на основі даних про зусилля:
| Рівень зусилля | Оцінка QE | Оцінена редакція % | Еквівалент годинної ставки | Ставка за слово | Мінімум за сегмент |
|---|---|---|---|---|---|
| Легко (редактура) | 0.80-1.0 | 0-10% | $15-18/год | $0.015-0.02 | $2-3 за сегмент |
| Легке МТОО | 0.60-0.80 | 10-30% | $18-24/год | $0.025-0.035 | $3-5 за сегмент |
| Стандартне МТОО | 0.40-0.60 | 30-50% | $24-30/год | $0.035-0.05 | $5-8 за сегмент |
| Важке МТОО | 0.20-0.40 | 50-80% | $30-36/год | $0.05-0.065 | $8-12 за сегмент |
| Повторний переклад (>80%) | <0.20 | 80-100% | $36-45/год | $0.065-0.12 | $15-25 за сегмент |
Це засноване на реальних даних середніх європейських LSP. Ваші цифри відрізнятимуться в залежності від мовної пари, домену та вартості редактора - але структура є однаковою: рівень складності визначає компенсацію.
Зауважте мінімальну плату за сегмент: це захищає дохід редактора на крихітних проектах. Документ із 100 словами не повинен платити $0.50 загалом; мінімум забезпечує базову життєздатність.
Реальний випадок: як редагування відстані працювало¶
Технічне перекладацька агенція (50-особова команда, 15 фрілансерів) перейшла від словного ціноутворення МТОО у Q4 2024. Ось що сталось:
Перед: усі МТОО роботи було $0.04/слово, бери-або-йди. Редактори постійно скаржилися, що деякі проекти платили $4/год (для складних сегментів) та інші $60/год ефективно (для легких). Плинність була 25% щорічно.
Під час: агенція вимірювала 10 проектів (128,000 слів загалом) протягом двох місяців за допомогою логування Matecat. Вони виявили: - 42% сегментів мали <10% редагування (легко) - 38% мали 10-40% редагування (середньо) - 20% мали 40%+ редагування (складно)
Після: вони реструктурували ціноутворення навколо редагування відстані: - Легкі сегменти: $0.018/слово ($18 ефективна годинна ставка) - Середні сегменти: $0.038/слово ($28-32 ефективна годинна ставка) - Складні сегменти: $0.065/слово ($36-42 ефективна годинна ставка)
Результат: загальна вартість для клієнтів зросла приблизно на 6% (тому що складні сегменти тепер платили справедливо, не субсидуючи легкі). Але утримання редакторів стрибнуло до 94%, цикли скоротилися на 12% (досвідчені редактори більше не уникали складної роботи), й помилки впали на 8% (маршрутизація рівня якості означала, що спеціалісти отримали спеціалізовану роботу).
“Модель редагування відстані здавалась революційною, тому що це просто… математика,” - зазначив один редактор. “Вперше я міг точно побачити, чому сегмент 47 платив більше, ніж сегмент 48. Це займало 8 разів довше. Тож це мало сенс.”
Обробка заперечення “Але мої клієнти хочуть передбачуваних витрат”¶
Клієнти дбають про одне: знання вартості перед тим, як вони вкладають. Редагування відстані здається змінною - в яку складність потрапить сегмент, залежить від машинного виходу - чи не будуть клієнти нервові?
Ні, якщо ви встановите межі.
Максимальна плата: “Якби кожен сегмент вимагав 100% повторного перекладу, проект коштував би $X.”
Мінімальна плата: “Навіть якби 80% сегментів не потребували редагування, проект коштуватиме щонайменше $Y.”
Очікувана вартість: “Виходячи з нашого аналізу оцінки якості, ми очікуємо $Z з варіацією ±10%.”
Це дає клієнту діапазон, й ваші дані це підтримують. У випадку дослідження вище, після двох місяців даних QE, агенції могли передбачити вартість проекту з 91-95% точністю. Клієнти це люблять. Це точніше за словні кошторис, які є чистим гаданням, як тільки ви враховуєте варіацію складності.
Ви також можете запропонувати гібрид: “Ми атакуватимемо редагування відстані (справедливо до наших редакторів), але обмежимо загальну вартість проекту до максимум $600” - тоді ви поглинаєте плюс, якщо MT краще, ніж очікується. Деякі агенції використовують це як тактику продажу для нових клієнтів. Як тільки клієнт бачить, наскільки справедлива модель, вони просять видалити обмеження в майбутніх проектах.
Коли праця-засновна ціна не працює (і що робити)¶
Праця-засновна ціна не панацея. Кілька сценаріїв, де вона розваліється:
Крихітні проекти (<500 слів). Ви не можете розрахувати значущу відстань редагування або оцінку QE з п’яти сегментів. Залишайтесь на плоских мінімумах за проект ($25-50). Годинні ставки тут також працюють.
Рукописні або деградовані скани. Оцінка якості OCR дає збій на поганих зображеннях. Ви не можете передбачити зусилля, тому що машинний вихід ненадійний. Тут оцінка зусилля стає “досвідченою здогадкою.” Встановіть фіксовані ставки за сторінку або за зображення на основі рівня якості (хороше/деградоване/погане).
Високоспеціалізовані домени без даних навчання. Перекладання медичного патенту для нішевої галузі? Ваша модель QE ніколи не бачила подібний текст, тому оцінки неточні. Запропонуйте фіксовані ставки за слово ($0.10-0.15) або годинні, оскільки ви не можете передбачити зусилля.
Клієнт відмовляється вказувати домен/термінологію. Ви не можете оцінити зусилля, якщо не знаєте предмета або глосарію клієнта. Переведіть на ставки за слово або по годинах. Як умова прийняття роботи вимагайте від клієнта надати інформацію про домен напочатку.
Для всіх цих граничних випадків ключова прозора комунікація. Скажіть клієнту: “На цьому проекті ми не можемо використовувати нашу предиктивну модель, тому що [причина], тож ми цитуємо [альтернативне ціноутворення].”
Інструменти, які роблять оцінку зусилля легкою¶
Вам не потрібно будувати оцінку зусилля з нуля. Кілька платформ це обробляють:
Matecat ($0/місяць безкоштовний рівень + $0.10-0.25 за сегмент платний режим) найдоступніша. Вона логує кожне натискання, автоматично розраховує відстань редагування й показує метрики post-editing effort (PEE) у реальному часі. Ви можете експортувати звіти про зусилля за проект або редактора. Для малих та середніх агенцій, Matecat може бути достатньою.
Translog II (€100-500 одночасно для ліцензії дослідження, $$$$ комерційна) є золотим стандартом академічної точності. Вона захоплює тимчасове зусилля (секунда-по-секунді), технічне зусилля (кожне натискання), й навіть когнітивне зусилля (гейз-трекінг із окуляр-трекером). Якщо ви хочете невідмисленних даних для переговорів клієнтів, Translog II доставляє. Але це надмірно для щоденних операцій.
ModernMT ($0-$500/місяць залежно від використання) включає адаптивний машинний переклад плюс вбудована оцінка якості. Ви отримуєте оцінки QE на рівні сегмента й можете маршрутизувати автоматично. Немає логування натискання, але передбачення QE стійкі для рішень маршрутизації.
TAUS EPIC ($200 за мільйон символів, доступна через API або веб-інтерфейс) є корпоративного гатунку QE. Якщо ви обробляєте 10M+ символів щомісячно, вона окупається в кращих рішеннях маршрутизації. Оцінки надійні; інтеграції є доступними для великих CAT інструментів.
ChatsControl (translator.chatscontrol.com) не є самостійним інструментом оцінки зусилля, але якщо ви робите МТОО на роботах перекладу документів (DOCX, PDF, скановані файли), вона робить авто-QA та означення зусилля через її двомовний інтерфейс перегляду. Ви можете побачити, які сегменти AI означила як проблемні (легші сегменти для виявлення перед редагуванням), що допомагає класифікувати складність.
Для малої LSP, яка щойно починає, Matecat + таблиця відстеження - це 80% вартості за 5% вартості. Для середніх агенцій Matecat + ModernMT QE - це твердий стек.
FAQ: праця-засновна ціна на практиці¶
П: Як я пояснюю це редакторам, які працювали на словних ставках протягом 10 років?
В: Покажіть їм дані. Витягніть чистий проект, з якого вони працювали, витягніть Matecat логи або дані Translog й розраховуйте їхню історичну ефективну годинну ставку за сегмент. Вони побачать: “Сегменти 1-10 платили $1-2 за сегмент, але займали 2-3 хвилини кожен = $20-40/год. Сегменти 11-20 платили те ж, але займали 10+ хвилин = $2-6/год.” Праця-засновна ціна це безправдяє.
П: Що якщо редактор просто повільний, і редагування відстані це не захоплює?
В: Це не. Редагування відстані захоплює те, що змінилось, не як швидко. Редактор, який повільний, але точний, буде показувати ті ж дані натискання/редагування-відстані, як швидкий редактор - вони просто витратили більше часу. Якщо ви хочете окремо враховувати швидкість, додайте індивідуальний множник продуктивності після першого місяця (деякі редактори легітимно працюють повільніше, деякі просто вчаться). Але оцінка зусилля повинна залишатися незмінною.
П: Чи можу я використовувати редагування відстані для вимірювання якості?
В: Ні. Редагування відстані - це метрик кількості (скільки змінилось), не якості (наскільки хороший результат). Низька відстань редагування не означає високої якості; це означає, що машинний вихід потребував кількох змін. Іноді це тому, що MT був хороший. Іноді тому, що редактор зробив мінімальну роботу (погано). Поєднуйте редагування відстани з вибіркою-перевіркою QA (випадкові зразки переглянуті старшим редактором), щоб виловити проблеми якості.
П: Чи повинен я впровадити це для редакторів, які працюють у мене, або фрілансерів?
В: Обидва. Редактори у компанії отримують бонуси за проект на основі оцінок зусилля (легкі сегменти = базова платня, складні сегменти = бонус +20%). Фрілансери отримують ставки за сегмент або за слово, пов’язані зі складністю. Обидві моделі прозорі, обидві справедливо нагороджують редакторів.
П: Як часто я повинен перекалібрувати свої рівні зусилля?
В: Щонайменше щоквартально. Нові двигуни MT (ви перейшли з Google на Claude), нові домени (ви приземлилися контракт фармацевтики), й нові команди редакторів все змінює закономірності зусилля. Перекалібруйте кожні 3-6 місяців на основі свіжих даних.
Висновок: праця-засновна ціна - це промисловий зсув¶
У 2026 році словна ціна МТОО виглядає настільки застарілою, як розплачуватись перекладачам за строку замість за слово. Це мало сенс в епоху, коли машинний переклад був одноманітно жахливим, й усі сегменти були однаково важкими. Але сучасний MT сегментований: деякий контент виходить 95% використовуваний, деякий 30%, деякий непридатний. Удаючи, що усі сегменти мають рівне зусилля, несправедливо до редакторів й коштує клієнтам грошей через приховані переробки й повільні цикли.
Праця-засновна ціна - оцінена за тимчасовими, технічними та когнітивними розмірами, передбачена за допомогою оцінки якості, й маршрутизована до правого редактора - заповнює той розрив. Вона захищає дохід редактора, дає клієнтам чесність, й дозволяє агенціям масштабуватися без жертвування якістю.
Якщо 86% ваших фрілансерів кажуть, що ціноутворення МТОО розбите, це не проблема редактора. Це проблема модель ціноутворення. Виправте модель, і проблема розходиться.
Почніть малим: виміряйте один проект, побудуйте один рівень зусилля, оплатіть одного редактора справедливо. Потім масштабуйте. Дані переконають всіх.