Оценка усилий редактора: как оценивать МТОО по сложности сегмента

Овладейте системным ценообразованием для МТОО. Измеряйте временные, технические и когнитивные усилия, оценивайте сложность сегментов, стройте справедливую модель, которую редакторы не отвергнут.

Также: RU EN UK
Оценка усилий редактора: как оценивать МТОО по сложности сегмента

Ты ценишь МТОО проект в $0.04 за слово (на 40% дешевле полного перевода), а редактор говорит тебе, что это самая сложная работа в месяце. Между тем, другой редактор пролетает через похожий по объему текст вдвое быстрее. Одинаковое количество слов, совершенно разные усилия - а ты платишь им одинаково.

Это ловушка, в которую попало 86% редакторов в 2024-2025 годах. Проблема не в самом МТОО, а в том, что словное ценообразование полностью игнорирует сложность. Сегмент с одной ошибкой терминологии занимает 30 секунд. Другой с поломанной грамматикой, неправильным тоном и упущенными смыслами требует 15 минут. Оба - это “100 слов”, оба платят одинаково. Это не ценообразование, это арифметика.

Что изменилось в 2024-2025: агентства начали измерять усилия редагирования на уровне сегмента. Они оценивают каждый кусок машинного вывода по тому, насколько сложно его на самом деле исправить, затем устанавливают цены соответственно. Не как произвольная скидка, а как основанная на данных модель, которая защищает доход редактора, предсказывает сроки проекта и дает клиентам честные затраты заранее.

Вот как ее построить.

Три измерения усилий редагирования

Когда редактор редактирует машинный вывод, одновременно происходят три различных вида работы. Их смешивание вместе дает размытую картину; измерение их отдельно раскрывает, где живет сложность.

Временные усилия - простейшие: общее время, затраченное на сегмент, в секундах или минутах. Таймер Matecat или средство записи нажатий клавиш Translog II отслеживают это автоматически. Проблема: одно время не надежно. Один редактор работает медленнее из честности, другой спешит, но все равно достигает качества. Время путает темп с усилиями.

Технические усилия подсчитывают фактические изменения - нажатия клавиш, вставки, удаления, замены, сдвиги. Если редактор переписывает целое предложение, это десятки нажатий. Если они меняют одно слово, это горстка. Логирование нажатий через Translog II или историю редактирования Matecat захватывает это точно. Исследования показывают, что данные нажатий варьируются примерно на 50% между различными двигателями MT, что делает это чувствительным индикатором того, сколько было фактически изменено. Время, напротив, варьируется только на 13-21% для того же текста - гораздо более слабый сигнал.

Когнитивные усилия - это умственная нагрузка: сколько размышлений было необходимо для исправления этого сегмента? Исследователи приближают это, подсчитывая паузы (моменты, когда редактор перестает печатать и думает). Если редактор делает паузу 10 раз в сегменте, этот сегмент был когнитивно утомительным. Если они делают паузу один раз, это было простым. Эту метрику сложнее захватить в продакшене (требуются специализированные инструменты типа Translog II с отслеживанием взгляда), но она совпадает с опытом редактора: “Тот сегмент заставил меня много думать.”

Вот в чем проблема: эти три измерения не всегда коррелируют. Сегмент может иметь высокие технические усилия (много нажатий), но низкие когнитивные усилия (“просто уборка”). Другой может иметь низкие нажатия, но высокие когнитивные усилия (“мне нужно переписать весь смысл, потому что исходный был двусмысленным”). Вот почему одиночные метрики не работают. Справедливая модель на основе усилий должна учитывать все три.

Почему словное ценообразование сломалось

До недавнего времени большинство работ МТОО ценились по слову: $0.03-0.06/слово в зависимости от языковой пары и уровня качества. Это просто, это предсказуемо для клиента, и это прозрачно. Это также полностью игнорирует, что сложность сегмента не имеет никакого отношения к его длине.

Рассмотрим реальный случай: технический фармацевтический документ, 10 000 слов. Качество машинного перевода приличное - модель была обучена на похожих документах. Большинство сегментов на 95% пригодны к использованию; редактор глянет, исправит ошибку терминологии и двигается дальше. Усилия за сегмент: 20 секунд. Стоимость для клиента: $300-600. Справедливо.

Теперь: креативная маркетинговая кампания, 10 000 слов. Машинный перевод - это структурная чушь - он буквально переводил идиомы, тон был совершенно неправильным, и придумал пунктуацию. Редактор должен практически переводить половину документа заново. Усилия за сегмент: 5-10 минут. Та же стоимость $300-600 для клиента. Катастрофическая недоплата со стороны редактора.

Количество слов не волнует. Редактирование “исправить запятую” и редактирование “переписать этот абзац с нуля” оба считаются за одно слово. Вот почему в 2024-2025 годах отчет GTS State of MTPE показал, что редакторы отходят от словных ставок. Модель игнорирует фактическую выполняемую работу.

Почасовые ставки имеют собственную проблему: непредсказуемость для клиента. Если ты цитируешь $25/час и не знаешь, сколько сегментов будет легких против сложных, ты можешь в итоге выставить клиенту счет в размере $800 за проект, который изначально оценил в $400. Клиенты ненавидят сюрпризы. Они хотят знать заранее, сколько стоит проект. Почасовые ставки не дают им ни того, ни другого.

Расстояние редактирования: модель, которая побеждает

Что заменяет словное ценообразование - это не также время-ориентированное. Это расстояние редактирования - метрика, которая захватывает, сколько текста было фактически изменено во время редактирования.

Расстояние редактирования имеет несколько названий: расстояние постредактирования (PED), расстояние редактирования или TER-ориентированная оценка. Концепция простая: если редактор изменяет 20% слов (через удаление, вставку, замену или переписывание), он получает компенсацию, как за совпадение 80% памяти переводов. Если они изменят 50%, они получат оплату за совпадение 50%. Если они переписывают 100% сегмента (в основном переводят его заново), они получают полные ставки перевода.

Это выравнивает оплату с фактической работой. Неправленый сегмент (0% отредактировано)? Минимальная оплата - по сути, редакторские ставки ($0.01-0.02/слово). Переписывание на 30%? МТОО ставки среднего уровня ($0.025-0.04). Полное переписывание на 100%? Полные ставки перевода ($0.06-0.12).

Как выразилась одна LSP в исследовании, цитируемом Taylor & Francis: “Если переписано 20%, лингвист получает ту же сумму, что за совпадение 80% в памяти переводов.” Это расстояние редактирования на практике - и оно становится стандартом для средних и крупных агентств.

Как ты это измеряешь? Большинство современных инструментов CAT это логируют. История редактирования Matecat показывает каждое нажатие и изменение. Trados Studio имеет отслеживание истории редактирования. SmartCAT, memoQ и другие тоже. Извлеки расстояние редактирования за сегмент (обычно рассчитывается как: отредактированные_символы / всего_символов * 100), и у тебя есть основа для ценообразования.

Выплата: расстояние редактирования сильно коррелирует с фактическими усилиями. Сегмент с 20% редактирования почти всегда требовал в 3-5 раз больше времени, чем сегмент с 2% редактирования, независимо от того, быстро ли работал редактор или медленно. Это объективная, повторяемая мера.

Внедрение оценки на основе усилий в твой рабочий процесс

Переход на ценообразование на основе усилий требует трех этапов: измерение, предсказание и маршрутизация.

Измерение: собирайте базовые данные

Выбери реальный проект - 20 000-50 000 слов - идеально - и отслеживай его полностью в течение одного месяца. Попроси своих редакторов использовать Matecat, Translog II или встроенное логирование твоего инструмента CAT. Захвати:

  • время за сегмент (общее время от загрузки сегмента до его завершения)
  • нажатия клавиш или операции редактирования за сегмент
  • расстояние редактирования на уровне символов за сегмент

В конце экспортируй данные и коррелируй с исходным текстом. Сегменты из языков с низкими ресурсами требовали больше времени? Техническая терминология вызвала больше редактирования? Сегменты с нечеткими совпадениями требовали больше нажатий?

Ты обнаружишь закономерности. Возможно, 60% ваших сегментов кластеризуются в “легкой” зоне (<30 секунд, <10% редактирования), 30% - “средней” (30 секунд-2 минуты, 10-40% редактирования), и 10% - “сложной” (2+ минут, 40%+ редактирования). Эти кластеры становятся твоими уровнями ценообразования.

Предсказание: используй оценку качества

До того, как редактор коснется сегмента, ты можешь предсказать его сложность с помощью оценки качества (QE). Инструменты QE анализируют исходный текст и машинный перевод, и выводят оценку (обычно 0-1 или 0-100), указывающую на вероятность того, что сегмент сложный для редактирования.

Инструменты, которые это делают:

  • Matecat включает плагин MTQE (MT Quality Estimator), который оценивает каждый сегмент встроенно. Запусти его перед назначением работы.
  • ModernMT предлагает адаптивный машинный перевод с встроенными оценками QE за сегмент.
  • TAUS EPIC (API оценки качества Translation Automation User Society) оценивает сегменты по шкале 0-1 и может автоматически маршрутизировать их на легкое или полное редактирование.
  • Language Weaver (RWS) имеет модуль оценки качества, встроенный в его корпоративную платформу.

Оценка QE 0.85-1.0 означает “этот сегмент, вероятно, хороший, минимальное редактирование ожидается” (легкий уровень). Оценка 0.4-0.6 означает “неясно, вероятно, требует значительной работы” (средний уровень). Оценка 0-0.4 означает “это, вероятно, сломано, ожидайте масштабного переписывания” (сложный уровень).

Запусти QE перед назначением, и ты устанавливаешь цену проекта заранее. Вместо угадывания ты знаешь: “Этот 5,000-словный документ имеет 52% легких сегментов, 38% средних, 10% сложных. Основываясь на ваших исторических данных об усилиях, этот проект будет стоить $450-550.”

Маршрутизация: согласование сложности с возможностью

После оценки сегментов маршрутизируй их разумно.

  • Легкие сегменты (высокая оценка QE, исторически <10% редактирования) → молодые редакторы или быстрые фрилансеры. Пониженная ставка ($0.015-0.03/слово). Быстрая пропускная способность.
  • Средние сегменты (оценка QE 0.4-0.7, 10-40% редактирования исторически) → ваша основная команда редактирования. Стандартные ставки МТОО ($0.03-0.06/слово).
  • Сложные сегменты (низкая оценка QE, 40%+ редактирования исторически) → опытные редакторы или предметные специалисты. Премиум МТОО или близкие к полным ставкам перевода ($0.05-0.08/слово), поскольку они могут требовать предметных знаний или творческого переписывания.

Эта маршрутизация делает три вещи:

  1. Предсказуемость стоимости. Ты знаешь заранее, сколько проект будет стоить клиенту - не “около $500”, а “$487-523 в зависимости от окончательного расстояния редактирования.”
  2. Справедливая компенсация. Редакторы видят, что сложность варьируется, и оплата это отражает. Сложные сегменты платят больше. Легкие сегменты платят меньше. Никаких произвольных 40% скидок по доске.
  3. Контроль качества. Ты не назначаешь медицинскую терминологию молодому редактору. Специалисты обрабатывают специализированную работу. Результат: меньше ошибок, более быстрые циклы исправлений, выше удовлетворенность клиентов.

Построение твоей модели ценообразования: числа, которые тебе нужны

Чтобы сделать это конкретным, вот как может выглядеть реальная карта ценообразования на основе данных об усилиях:

Уровень усилия Оценка QE Оценочное редактирование % Эквивалент почасовой ставки Ставка за слово Минимум за сегмент
Легко (вычитка) 0.80-1.0 0-10% $15-18/ч $0.015-0.02 $2-3 за сегмент
Легкое МТОО 0.60-0.80 10-30% $18-24/ч $0.025-0.035 $3-5 за сегмент
Стандартное МТОО 0.40-0.60 30-50% $24-30/ч $0.035-0.05 $5-8 за сегмент
Тяжелое МТОО 0.20-0.40 50-80% $30-36/ч $0.05-0.065 $8-12 за сегмент
Переперевод (>80%) <0.20 80-100% $36-45/ч $0.065-0.12 $15-25 за сегмент

Это основано на реальных данных среднестоящих европейских LSP. Твои числа будут отличаться в зависимости от языковой пары, домена и затрат на редактора - но структура одна и та же: уровень сложности определяет компенсацию.

Обратите внимание на минимальный сбор за сегмент: это защищает доход редактора в крошечных проектах. Документ со 100 словами не должен платить $0.50 всего; минимум обеспечивает базовую жизнеспособность.

Реальный случай: как расстояние редактирования сработало

Техническое переводческое агентство (50-человеческая команда, 15 фрилансеров) перешло от словного ценообразования МТОО в Q4 2024. Вот что произошло:

До: все проекты МТОО стоили $0.04/слово, бери или уходи. Редакторы постоянно жаловались, что некоторые проекты платили $4/ч (за сложные сегменты) и другие эффективно $60/ч (за легкие). Текучесть была 25% ежегодно.

Во время: агентство измеряло 10 проектов (128 000 слов всего) в течение двух месяцев, используя логирование Matecat. Они обнаружили: - 42% сегментов имели <10% редактирования (легко) - 38% имели 10-40% редактирования (средне) - 20% имели 40%+ редактирования (сложно)

После: они реструктурировали ценообразование вокруг расстояния редактирования: - Легкие сегменты: $0.018/слово ($18 эффективная почасовая ставка) - Средние сегменты: $0.038/слово ($28-32 эффективная почасовая ставка) - Сложные сегменты: $0.065/слово ($36-42 эффективная почасовая ставка)

Результат: общая стоимость для клиентов выросла примерно на 6% (потому что сложные сегменты теперь платили справедливо, не субсидируя легкие). Но удержание редактора подскочило до 94%, циклы сократились на 12% (опытные редакторы больше не избегали сложную работу), и ошибки упали на 8% (маршрутизация уровня качества означала, что специалисты получали специализированную работу).

“Модель расстояния редактирования казалась революционной, потому что это просто… математика,” - отметил один редактор. “Впервые я мог точно видеть, почему сегмент 47 платил больше, чем сегмент 48. Это заняло в 8 раз больше времени. Так что это имело смысл.”

Обработка возражения “Но мои клиенты хотят предсказуемых затрат”

Клиентов волнует одно: узнать стоимость до того, как они примут обязательство. Расстояние редактирования кажется изменчивым - в какой уровень сложности попадет сегмент, зависит от машинного выпуска - разве клиенты не будут беспокойными?

Нет, если ты установишь границы.

Максимальный сбор: “Если бы каждый сегмент требовал 100% переперевода, проект стоил бы $X.”

Минимальный сбор: “Даже если 80% сегментов не требуют редактирования, проект будет стоить минимум $Y.”

Ожидаемая стоимость: “На основе нашего анализа оценки качества мы ожидаем $Z с отклонением ±10%.”

Это дает клиенту диапазон, и твои данные его поддерживают. В приведенном выше случае исследования, после двух месяцев данных QE, агентства могли предсказать стоимость проекта с точностью 91-95%. Клиентам это нравится. Это точнее, чем словные кошторисы, которые - чистое угадывание, как только ты учитываешь вариацию сложности.

Ты также можешь предложить гибрид: “Мы будем взимать расстояние редактирования (справедливо к нашим редакторам), но ограничим общую стоимость проекта максимум $600” - затем ты поглощаешь плюсовое значение, если MT лучше, чем ожидалось. Некоторые агентства используют это как тактику продаж для новых клиентов. Как только клиент видит, насколько справедлива модель, они просят убрать лимит в будущих проектах.

Когда ценообразование на основе усилий дает сбой (и что делать)

Ценообразование на основе усилий - не панацея. Несколько сценариев, где оно дает сбой:

Крошечные проекты (<500 слов). Ты не можешь рассчитать значимое расстояние редактирования или оценку QE из пяти сегментов. Придерживайся фиксированных минимумов за проект ($25-50). Почасовые ставки здесь тоже работают.

Рукописные или деградированные сканы. Оценка качества OCR дает сбой на плохих изображениях. Ты не можешь предсказать усилия, потому что машинный вывод ненадежен. Здесь оценка усилия становится “опытным предположением.” Установи фиксированные ставки за страницу или за изображение на основе уровня качества (хорошее/деградированное/плохое).

Высоко специализированные домены без данных обучения. Переводишь медицинский патент для узкой области? Твоя модель QE никогда не видела подобный текст, поэтому оценки неточны. Предложи фиксированные ставки за слово ($0.10-0.15) или почасовые, поскольку ты не можешь предсказать усилия.

Клиент отказывается указывать домен/терминологию. Ты не можешь оценить усилия, если не знаешь тему или глоссарий клиента. Вернись к ставкам за слово или почасовым. Как условие принятия работы требуй от клиента предоставить информацию о домене заранее.

Для всех этих граничных случаев прозрачная коммуникация - ключ. Скажи клиенту: “На этом проекте мы не можем использовать нашу предиктивную модель, потому что [причина], поэтому мы цитируем [альтернативное ценообразование].”

Инструменты, которые упрощают оценку усилия

Тебе не нужно строить оценку усилия с нуля. Несколько платформ это обрабатывают:

Matecat ($0/месяц бесплатный уровень + $0.10-0.25 за сегмент платный режим) - самый доступный. Он логирует каждое нажатие, автоматически рассчитывает расстояние редактирования и показывает метрики post-editing effort (PEE) в реальном времени. Ты можешь экспортировать отчеты об усилиях по проектам или редакторам. Для малых и средних агентств Matecat может быть достаточным.

Translog II (€100-500 один раз для исследовательской лицензии, $$$$ коммерческая) - золотой стандарт академической строгости. Он захватывает временные усилия (секунда за секундой), технические усилия (каждое нажатие), и даже когнитивные усилия (отслеживание взгляда с помощью окулографа). Если ты хочешь пуленепробиваемых данных для переговоров клиентов, Translog II доставляет. Но это избыточно для повседневных операций.

ModernMT ($0-$500/месяц в зависимости от использования) включает адаптивный машинный перевод плюс встроенную оценку качества. Ты получаешь оценки QE на уровне сегмента и можешь маршрутизировать автоматически. Нет логирования нажатий, но предсказания QE надежны для решений маршрутизации.

TAUS EPIC ($200 за миллион символов, доступна через API или веб-интерфейс) - корпоративного класса QE. Если ты обрабатываешь 10M+ символов ежемесячно, она окупается в лучших решениях маршрутизации. Оценки надежны; интеграции доступны для основных инструментов CAT.

ChatsControl (translator.chatscontrol.com) не является автономным инструментом оценки усилий, но если ты делаешь МТОО на работах перевода документов (DOCX, PDF, отсканированные файлы), она делает авто-QA и помечает усилия через свой двуязычный интерфейс просмотра. Ты можешь видеть, какие сегменты AI пометила как проблемные (легче выявить сложные перед редактированием), что помогает класифицировать сложность.

Для малого LSP, который только начинает, Matecat + отслеживание электронной таблицы - это 80% значения за 5% стоимости. Для средних агентств Matecat + ModernMT QE - это солидный стек.

FAQ: ценообразование на основе усилий на практике

В: Как мне объяснить это редакторам, которые работали на словных ставках в течение 10 лет?

О: Покажи им данные. Возьми прошлый проект, над которым они работали, извлеки логи Matecat или данные Translog и рассчитай их историческую эффективную почасовую ставку за сегмент. Они увидят: “Сегменты 1-10 платили $1-2 за сегмент, но занимали 2-3 минуты каждый = $20-40/ч. Сегменты 11-20 платили то же самое, но занимали 10+ минут = $2-6/ч.” Ценообразование на основе усилий это исправляет.

В: Что если редактор просто медленный, и расстояние редактирования это не захватывает?

О: Оно не захватывает. Расстояние редактирования захватывает, что изменилось, не как быстро. Редактор, который медленный, но точный, показа те же данные нажатий/расстояния-редактирования, что и быстрый редактор - он просто потратил больше времени. Если ты хочешь отдельно учитывать скорость, добавь индивидуальный множитель производительности после первого месяца (некоторые редакторы законно работают медленнее, некоторые просто учатся). Но оценка усилия должна остаться неизменной.

В: Могу ли я использовать расстояние редактирования для измерения качества?

О: Нет. Расстояние редактирования - это метрика количества (сколько изменилось), не качества (как хорош результат). Низкое расстояние редактирования не означает высокое качество; это означает, что машинный вывод нуждался в нескольких изменениях. Иногда это потому, что MT был хорош. Иногда потому, что редактор сделал минимальную работу (плохо). Сопряги расстояние редактирования с выборочным QA (случайные образцы, просмотренные старшим редактором), чтобы поймать проблемы качества.

В: Должен ли я внедрить это для штатных редакторов или фрилансеров?

О: Оба. Штатные редакторы получают бонусы за проект на основе оценок усилий (легкие сегменты = базовая оплата, сложные сегменты = +20% бонус). Фрилансеры получают ставки за сегмент или за слово, привязанные к сложности. Обе модели прозрачны, обе справедливо вознаграждают редакторов.

В: Как часто я должен калибровать свои уровни усилий?

О: Как минимум ежеквартально. Новые двигатели MT (ты переключился с Google на Claude), новые домены (ты приземлил контракт фармы), и новые команды редакторов - все меняет закономерности усилий. Перекалибруй каждые 3-6 месяцев на основе свежих данных.


Вывод: ценообразование на основе усилий - это сдвиг индустрии

В 2026 году словное ценообразование МТОО выглядит так же устаревшим, как оплата переводчикам за строку вместо слова. Это имело смысл в эпоху, когда машинный перевод был единообразно ужасен, и все сегменты были одинаково сложны. Но современный MT сегментирован: некоторый контент выходит 95% пригодным к использованию, некоторый 30%, некоторый непригодным. Претворяться, что все сегменты имеют равные усилия, несправедливо к редакторам и обходится клиентам в деньги через скрытые переделки и медленные циклы.

Ценообразование на основе усилий - оценено по временным, техническим и когнитивным измерениям, предсказано с помощью оценки качества, и маршрутизировано нужному редактору - заполняет этот разрыв. Оно защищает доход редактора, дает клиентам честность, и позволяет агентствам масштабироваться без жертвования качеством.

Если 86% твоих фрилансеров говорят, что ценообразование МТОО сломано, это не проблема редактора. Это проблема модели ценообразования. Исправь модель, и проблема исчезнет.

Начни с малого: измерь один проект, построй один уровень усилия, оплати одного редактора справедливо. Затем масштабируй. Данные убедят всех.

Попробуйте ChatsControl

AI-платформа для профессиональных переводчиков

Попробовать бесплатно →