Для агенцій та фріланс-перекладачів

Помилки, що доходять до клієнта, ловимо до видачі

Кожна проблема нижче - це та, яка за словами перекладачів і агенцій коштувала клієнта, переробки або годин неоплачуваної вичитки. Ось що з кожною робить ChatsControl.

Ваш текст лишається в ЄС, не використовується для навчання AI-моделей і за замовчуванням видаляється через 30 днів після завантаження; безкоштовні перевірки не надсилають його у зовнішній AI - див. наші субпроцесори та політику даних OpenRouter.

Шум хибних спрацьовувань, через який перевірки вимикають

98% попереджень QA - хибні, тому їх перестають читати
Перевірки враховують локаль (справжні правила CLDR, а не грубі регекси) і мають MQM-серйозність, тому короткий список варто читати - а цілі класи відомих хибних спрацьовувань можна вимкнути самому, для кожного проєкту.
Розділювачі тисяч і десяткові - нескінченна боротьба з регексами
Десяткові й розрядні розділювачі перевіряються по локалі (1,000.50 проти 1.000,50), включно з OCR-розривом десяткової - більше не треба писати правила вручну.
Нумерація розділів на кшталт 3.2.1 читається як змінене число
Числова перевірка явно пропускає номери розділів і пунктів, тому структура документа ніколи не дає хибної помилки точності.
Цифра в назві продукту, як «Gizmo 1000», позначається як змінене число
Ми точно зіставляємо символи, тому цифра в назві не спрацьовує - і свідомо не додаємо евристику, яка могла б заглушити реальну зміну дозування чи суми в CRITICAL-перевірці чисел.
«Source is same as target» спрацьовує на бренді клієнта знову і знову
Бренд, залишений як є по всьому файлу, згортається в одну знахідку з лічильником повторів замість того самого попередження N разів.
Чужа термбаза, повна слів «home», «in», «of» - і з опечатками
Гігієна глосарія позначає стоп-слова, надто короткі й надчастотні записи, дублікати й конфлікти; окрема перевірка ловить імовірні опечатки в термінах.
Через шум пропускаються СПРАВЖНІ помилки
У цьому й суть: менше шуму - реальні дефекти не тонуть, а AI-семантика ловить смислові помилки, яких детерміновані перевірки не бачать.

Те, що їде клієнту зламаним - найдорожча категорія

Неперекладений сегмент поїхав клієнту
Неперекладені й порожні сегменти позначаються до видачі - той промах в один клік, що доходить до клієнта в будь-якому CAT.
«X is not Y» повернулося як «X is Y» і пройшло вичитку
Семантична перевірка ловить інверсію сенсу, підміну суб’єкта та зворотний напрям - той гладкий, але хибний MT, що проходить людське око.
Текст усередині картинки так і не переклали - 44 слова, рахунок €780 за верстку
Ми розпізнаємо image-PDF та фото, які CAT взагалі не імпортує; ловити текст усередині embedded-картинок у редагованому файлі - наступне в роадмапі.
Сторінки після порожньої пропустили цілком, і про це сказав клієнт
Пайплайн обробляє всі сторінки; явний сигнал повноти («можливо пропущено контент на стор. N») - у роадмапі, поверх даних, які OCR уже видає.
100% збіг із пам’яті притягнув чужу назву продукту - £315 з коректора
Перевірки глосарія й заборонених термінів ловлять чужий бренд чи заборонений термін у таргеті; окремий сигнал про TM-контамінацію заплановано.
Число, написане словом («2» → «twice»), позначається як пропущене
Числова перевірка вже глушить багато таких випадків; ширше покриття спелл-ауту перевіряємо на реальних корпусах, а не обіцяємо наосліп.

Скани, OCR і верстка - те, чого CAT не вміє

Image-PDF не можна імпортувати, хоча всі впевнені, що можна
Ми розпізнаємо image-PDF і фото - саме ті файли, які CAT відхиляє - і перетворюємо їх на перекладні документи з відновленою версткою.
Відновлення верстки скану з’їдає неоплачувані години
Ми відновлюємо верстку 1:1 автоматично, наносячи переклад назад на оригінал скану - ту роботу, що зазвичай не оплачується.
Гіперпосилання зламалися при поверненні з CAT у Word
Наша конвертація PDF→DOCX зберігає гіперпосилання, тож вони не зникають тихо під час зворотного шляху.
Символи нульової ширини зламали відсоток збігів - невидимі, й ніхто їх не перевіряє
Ми позначаємо символи нульової ширини та bidi (U+200B, BOM, м’який перенос, RLO), на які більшість QA-інструментів навіть не дивиться.
Запаролений PDF приходить у п’ятницю ввечері й тихо ламає імпорт
Ми виявляємо запаролений PDF одразу при завантаженні й чесно кажемо про це, а не повертаємо порожній результат, який ви помітите в понеділок.
Ніхто не перевіряє OCR - індекси, степені, грецькі літери у формулах
Overlay лишає оригінал скану видимим для звірки; флаг низької впевненості OCR (per-token score, грецьке-у-формулі) - у роадмапі, на даних, які ми вже збираємо.
Числа, суми й дати не входять у підрахунок слів, тому ця робота неоплачувана
Наш калькулятор рахує за символами (числа, дати й суми включно), а OCR дає реальний підрахунок прямо зі скану.

Особливості машинного перекладу

Один термін повертається перекладеним чотирма різними способами в одному документі
AI-перевірка консистентності позначає один вихідний термін, перекладений по-різному по документу - без обов’язкового глосарія.
Термінологічний розбій по документу - репутаційний ризик
Дотримання глосарія й заборонених термінів плюс консистентність на рівні сегмента й терміна тримають термінологію узгодженою по всьому документу.
MT-вихід гладкий, але неправильний, і проходить вичитку
Семантична перевірка націлена саме на це - сенс, що читається добре, але каже не те - а не лише на поверхневу гладкість.
Перевірки термінології не відрізняють іменник від дієслова, тож валідна форма читається як пропущений термін
Глосарій morphology-aware для російської та української, тож один запис покриває відмінені форми, а не спрацьовує на кожному варіанті.
AI знає свої типові помилки, але сам їх не ловить
Семантична перевірка позначає ці повторювані збої MT, щоб їх побачила людина, замість довіряти моделі стежити за собою.

Побачте на власному файлі

Завантажте готовий переклад і прочитайте знахідки менш ніж за хвилину. Без акаунта.

Перевірити документ

Питання, які ставлять перекладачі

Це заміна моєму CAT-інструменту?
Ні. Це шар QA та сканування навколо будь-якого CAT, яким ви вже користуєтесь - проганяйте готовий переклад перед видачею.
Чим це відрізняється від Verifika чи Xbench?
Це сильні детерміновані QA-інструменти. Ми додаємо locale-aware подавлення хибних спрацьовувань, AI-семантику та консистентність термінів, а також відновлення верстки сканів 1:1, якого в них немає.
Які мови підтримуються?
QA-перевірки враховують локаль для основних європейських та СНД-мов; скан/OCR працює з будь-яким письмом.
Чи обов’язково надсилати документ клієнта на ваші сервери?
Ви завантажуєте документ, щоб запустити перевірки; термін зберігання ви керуєте в налаштуваннях. Для швидкого погляду QA-валідатор працює без акаунта.
Чи є безкоштовна версія?
Так - QA-валідатор і калькулятор вартості працюють безкоштовно й без акаунта.