Помилки, що доходять до клієнта, ловимо до видачі
Кожна проблема нижче - це та, яка за словами перекладачів і агенцій коштувала клієнта, переробки або годин неоплачуваної вичитки. Ось що з кожною робить ChatsControl.
Ваш текст лишається в ЄС, не використовується для навчання AI-моделей і за замовчуванням видаляється через 30 днів після завантаження; безкоштовні перевірки не надсилають його у зовнішній AI - див. наші субпроцесори та політику даних OpenRouter.
Шум хибних спрацьовувань, через який перевірки вимикають
✕98% попереджень QA - хибні, тому їх перестають читати
✓Перевірки враховують локаль (справжні правила CLDR, а не грубі регекси) і мають MQM-серйозність, тому короткий список варто читати - а цілі класи відомих хибних спрацьовувань можна вимкнути самому, для кожного проєкту.
✕Розділювачі тисяч і десяткові - нескінченна боротьба з регексами
✓Десяткові й розрядні розділювачі перевіряються по локалі (1,000.50 проти 1.000,50), включно з OCR-розривом десяткової - більше не треба писати правила вручну.
✕Нумерація розділів на кшталт 3.2.1 читається як змінене число
✓Числова перевірка явно пропускає номери розділів і пунктів, тому структура документа ніколи не дає хибної помилки точності.
✕Цифра в назві продукту, як «Gizmo 1000», позначається як змінене число
✓Ми точно зіставляємо символи, тому цифра в назві не спрацьовує - і свідомо не додаємо евристику, яка могла б заглушити реальну зміну дозування чи суми в CRITICAL-перевірці чисел.
✕«Source is same as target» спрацьовує на бренді клієнта знову і знову
✓Бренд, залишений як є по всьому файлу, згортається в одну знахідку з лічильником повторів замість того самого попередження N разів.
✕Чужа термбаза, повна слів «home», «in», «of» - і з опечатками
✓Гігієна глосарія позначає стоп-слова, надто короткі й надчастотні записи, дублікати й конфлікти; окрема перевірка ловить імовірні опечатки в термінах.
✕Через шум пропускаються СПРАВЖНІ помилки
✓У цьому й суть: менше шуму - реальні дефекти не тонуть, а AI-семантика ловить смислові помилки, яких детерміновані перевірки не бачать.
Те, що їде клієнту зламаним - найдорожча категорія
✕Неперекладений сегмент поїхав клієнту
✓Неперекладені й порожні сегменти позначаються до видачі - той промах в один клік, що доходить до клієнта в будь-якому CAT.
✕«X is not Y» повернулося як «X is Y» і пройшло вичитку
✓Семантична перевірка ловить інверсію сенсу, підміну суб’єкта та зворотний напрям - той гладкий, але хибний MT, що проходить людське око.
✕Текст усередині картинки так і не переклали - 44 слова, рахунок €780 за верстку
✓Ми розпізнаємо image-PDF та фото, які CAT взагалі не імпортує; ловити текст усередині embedded-картинок у редагованому файлі - наступне в роадмапі.
✕Сторінки після порожньої пропустили цілком, і про це сказав клієнт
✓Пайплайн обробляє всі сторінки; явний сигнал повноти («можливо пропущено контент на стор. N») - у роадмапі, поверх даних, які OCR уже видає.
✕100% збіг із пам’яті притягнув чужу назву продукту - £315 з коректора
✓Перевірки глосарія й заборонених термінів ловлять чужий бренд чи заборонений термін у таргеті; окремий сигнал про TM-контамінацію заплановано.
✕Число, написане словом («2» → «twice»), позначається як пропущене
✓Числова перевірка вже глушить багато таких випадків; ширше покриття спелл-ауту перевіряємо на реальних корпусах, а не обіцяємо наосліп.
Скани, OCR і верстка - те, чого CAT не вміє
✕Image-PDF не можна імпортувати, хоча всі впевнені, що можна
✓Ми розпізнаємо image-PDF і фото - саме ті файли, які CAT відхиляє - і перетворюємо їх на перекладні документи з відновленою версткою.
✕Відновлення верстки скану з’їдає неоплачувані години
✓Ми відновлюємо верстку 1:1 автоматично, наносячи переклад назад на оригінал скану - ту роботу, що зазвичай не оплачується.
✕Гіперпосилання зламалися при поверненні з CAT у Word
✓Наша конвертація PDF→DOCX зберігає гіперпосилання, тож вони не зникають тихо під час зворотного шляху.
✕Символи нульової ширини зламали відсоток збігів - невидимі, й ніхто їх не перевіряє
✓Ми позначаємо символи нульової ширини та bidi (U+200B, BOM, м’який перенос, RLO), на які більшість QA-інструментів навіть не дивиться.
✕Запаролений PDF приходить у п’ятницю ввечері й тихо ламає імпорт
✓Ми виявляємо запаролений PDF одразу при завантаженні й чесно кажемо про це, а не повертаємо порожній результат, який ви помітите в понеділок.
✕Ніхто не перевіряє OCR - індекси, степені, грецькі літери у формулах
✓Overlay лишає оригінал скану видимим для звірки; флаг низької впевненості OCR (per-token score, грецьке-у-формулі) - у роадмапі, на даних, які ми вже збираємо.
✕Числа, суми й дати не входять у підрахунок слів, тому ця робота неоплачувана
✓Наш калькулятор рахує за символами (числа, дати й суми включно), а OCR дає реальний підрахунок прямо зі скану.
Особливості машинного перекладу
✕Один термін повертається перекладеним чотирма різними способами в одному документі
✓AI-перевірка консистентності позначає один вихідний термін, перекладений по-різному по документу - без обов’язкового глосарія.
✕Термінологічний розбій по документу - репутаційний ризик
✓Дотримання глосарія й заборонених термінів плюс консистентність на рівні сегмента й терміна тримають термінологію узгодженою по всьому документу.
✕MT-вихід гладкий, але неправильний, і проходить вичитку
✓Семантична перевірка націлена саме на це - сенс, що читається добре, але каже не те - а не лише на поверхневу гладкість.
✕Перевірки термінології не відрізняють іменник від дієслова, тож валідна форма читається як пропущений термін
✓Глосарій morphology-aware для російської та української, тож один запис покриває відмінені форми, а не спрацьовує на кожному варіанті.
✕AI знає свої типові помилки, але сам їх не ловить
✓Семантична перевірка позначає ці повторювані збої MT, щоб їх побачила людина, замість довіряти моделі стежити за собою.
Побачте на власному файлі
Завантажте готовий переклад і прочитайте знахідки менш ніж за хвилину. Без акаунта.
Перевірити документПитання, які ставлять перекладачі
Це заміна моєму CAT-інструменту?
Ні. Це шар QA та сканування навколо будь-якого CAT, яким ви вже користуєтесь - проганяйте готовий переклад перед видачею.
Чим це відрізняється від Verifika чи Xbench?
Це сильні детерміновані QA-інструменти. Ми додаємо locale-aware подавлення хибних спрацьовувань, AI-семантику та консистентність термінів, а також відновлення верстки сканів 1:1, якого в них немає.
Які мови підтримуються?
QA-перевірки враховують локаль для основних європейських та СНД-мов; скан/OCR працює з будь-яким письмом.
Чи обов’язково надсилати документ клієнта на ваші сервери?
Ви завантажуєте документ, щоб запустити перевірки; термін зберігання ви керуєте в налаштуваннях. Для швидкого погляду QA-валідатор працює без акаунта.
Чи є безкоштовна версія?
Так - QA-валідатор і калькулятор вартості працюють безкоштовно й без акаунта.