Как перевести нередактируемый PDF: OCR, проверка и верстка

Разбираем, как перевести PDF без выделяемого текста: распознать скан, проверить OCR, сохранить таблицы и выбрать подходящий рабочий процесс.

Также: EN UK RU
Как перевести нередактируемый PDF: OCR, проверка и верстка

Как перевести нередактируемый PDF: OCR, проверка и верстка

Пятьдесят страниц договора выглядят как обычный PDF, но курсор не выделяет ни слова, а поиск не находит номер пункта. Перед вами не текстовый документ, а изображения страниц; без распознавания переводчик может вернуть исходные картинки, пропустить текст или нарушить структуру.

Рабочий процесс состоит из нескольких отдельных задач: проверить, есть ли в файле текстовый слой, распознать скан, вычитать результат OCR, перевести и проверить верстку. Смешивание этих этапов мешает понять, где именно возникла ошибка: при чтении исходника, переводе или сборке файла.

Для агентства переводов, фрилансера или команды, которая обрабатывает документы клиентов, такая диагностика экономит время на повторную работу. Ниже разберем варианты, ограничения и контрольные точки без предположения, что один инструмент одинаково хорошо решает все задачи.

Почему PDF не переводится как обычный документ

Нередактируемый, или уплощенный, PDF хранит страницу как изображение, а не как набор доступных для выделения слов. Визуально такой файл может быть неотличим от обычного документа: на странице видны заголовки, абзацы и таблицы, но программа не получает текст для перевода.

PDF не обязательно целиком состоит из сканов. В одном файле могут соседствовать страницы с текстовым слоем и страницы, сохраненные как изображения. Бывает и так, что основной текст выделяется, а подписи, печати или таблицы вставлены отдельными картинками. Поэтому до выбора способа перевода стоит проверить сам файл, а не судить только по его расширению.

Как проверить, есть ли в PDF текстовый слой

Откройте файл и попробуйте выделить несколько слов мышью. Затем скопируйте небольшой фрагмент и вставьте его в текстовый редактор. Проверьте поиск по характерному слову или номеру раздела. Если выделение, копирование и поиск работают, перед вами, вероятно, текстовый PDF хотя бы на этих страницах.

Если мышь выделяет целую область как одну картинку, вставка дает пустой результат или поиск ничего не находит, страницам требуется распознавание текста. Проверяйте несколько страниц, а не только первую: смешанный PDF может содержать и распознанные страницы, и сканы.

Текстовый слой тоже не равен корректному тексту. Документ мог быть распознан ранее, но содержать ошибки, неправильный порядок чтения колонок или невидимые символы. Выделение подтверждает, что машинно-читаемый текст есть, но не подтверждает, что этот текст правильно соответствует изображению страницы.

Что делает OCR и чего он не делает

OCR, или оптическое распознавание символов, превращает изображение букв в машинно-читаемый текст. На скане программа определяет, где находятся строки, пытается распознать символы и может сформировать поисковый или редактируемый PDF. После этого текст можно передать в переводческую систему.

Распознавание не переводит содержимое и не подтверждает правильность каждой буквы. Программа может перепутать похожие символы, неверно прочитать размытый номер или принять часть печати за текст. Подпись от руки и нечеткий штамп обычно сложнее для автоматического чтения, чем хорошо напечатанный абзац; их нужно проверять по изображению.

У Adobe описан процесс подготовки скана: открыть изображение или скан, выбрать инструменты Scan & OCR, улучшить или выровнять изображение и запустить распознавание. Adobe поясняет, что результат становится поисковым и редактируемым PDF, а распознавание остается именно подготовительным преобразованием, а не переводом: руководство Adobe по сканированию и OCR.

В документации Adobe встречается формулировка: Adobe описывает результат распознавания так:

“The file is now a searchable, editable PDF file.”

Проще говоря, слова становятся доступными для поиска и редактирования. Перевод и проверка правильности распознанных слов все еще впереди.

Подготовка изображения влияет на распознавание: наклон, слабый контраст, тень от сгиба и низкое качество мешают определить границы букв. В настольном процессе Adobe предусмотрены улучшение изображения скана или снимка, автоматическая очистка и выравнивание перед распознаванием. Такие функции могут помочь подготовить страницу, но не заменяют сверку сложных мест с исходным изображением.

Что именно нужно сделать: схема рабочего процесса

Перевод нередактируемого PDF лучше рассматривать как последовательность операций с отдельной проверкой после каждой. Такой подход помогает локализовать проблему: если цифра стала неверной еще до перевода, исправлять нужно OCR, а не целевой текст.

  1. Сохраните исходный PDF отдельно. Не перезаписывайте оригинал после очистки или распознавания. Исходная картинка нужна для сверки и для восстановления пропущенных деталей.
  2. Проверьте текстовый слой по нескольким страницам. Выделите, скопируйте и найдите фрагменты в начале, середине и конце файла. Отметьте полностью сканированные и смешанные страницы.
  3. Подготовьте изображение к распознаванию. Проверьте ориентацию, перекос, резкость, контраст и обрезанные края. Если приложение предлагает выровнять и очистить скан, оцените результат до запуска OCR.
  4. Запустите распознавание. Получите текстовый слой, редактируемый PDF или документ, который можно вычитать. Не считайте сам факт создания выходного файла подтверждением качества.
  5. Сверьте OCR с картинкой. Исправьте имена, числа, даты, суммы, номера пунктов, заголовки колонок и содержимое таблиц. Особое внимание уделите символам, которые меняют смысл при одной ошибке.
  6. Переведите проверенный текст. Если доступен исходный редактируемый документ, сравните его с PDF и отдайте в работу источник, а не скан. Если источник только один, согласуйте формат результата: Word, PDF или оба файла.
  7. Проверьте перевод и структуру. Сопоставьте исходник и целевой текст, затем проверьте порядок блоков, таблицы, заголовки, переносы и примечания.
  8. Сохраните связанный комплект. Храните исходное изображение, распознанный и исправленный текст, перевод и итоговый файл под понятными именами. Так редактор сможет вернуться к конкретной ошибке без повторения всего процесса.

На каждом переходе фиксируйте статус файла: «исходный скан», «OCR выполнен», «OCR вычитан», «переведен», «проверен». Если несколько человек работают над документом, такая отметка не дает принять сырой результат распознавания за готовый к переводу источник.

Типичная ситуация: скан договора выглядит чистым, но таблица с суммами снята под небольшим углом. В основной части OCR читает абзацы хорошо, а числа в узких ячейках переставляет местами или соединяет с соседней строкой. Если перевести документ сразу, редактор будет исправлять одновременно ошибки чтения и ошибки перевода, а их источник окажется неясным.

Чем отличаются бюро, фрилансер и онлайн-инструмент

Выбор зависит не только от числа страниц. Важны состояние скана, цена ошибки, нужный формат выдачи, доступность редактируемого исходника и объем ручной проверки. Одни и те же страницы можно передать в бюро, отдельному переводчику или в онлайн-процесс, но контроль и ответственность будут устроены по-разному.

Вариант Когда подходит Что остается проверить Основное ограничение
Бюро переводов Документ сложный, формальный или требует участия нескольких специалистов OCR, термины, имена, цифры, верстку и соответствие требованиям получателя Перед началом нужно согласовать, входит ли распознавание и вычитка скана в процесс
Фрилансер Нужен один специалист, понятный объем и прямое согласование правок Есть ли у переводчика доступ к исходному изображению и редактируем ли файл Распознавание, редактура и верстка могут требовать отдельных этапов
Онлайн-инструмент Нужен рабочий черновик документа и возможность самостоятельно проверить результат OCR, неоднозначные места, форматирование и терминологию Слабый скан или рукописный текст может потребовать ручной работы

Вариант 1: бюро переводов

Бюро может организовать распознавание, перевод, редактуру и верстку как связанные этапы. Такой вариант удобен, если документ деловой и ошибки в таблицах или терминах приведут к повторной подаче либо затруднят работу получателя.

До передачи файла уточните, кто исправляет OCR, сравнивает текст с картинкой и проверяет готовую верстку. Спросите, получит ли переводчик изображения всех страниц, включая печати и поля, или только извлеченный текст. Без исходного изображения переводчик не сможет надежно проверить, правильно ли прочитано спорное слово.

Отдельно согласуйте формат результата. Перевод в Word удобен для правок, а PDF сохраняет вид готового документа; иногда нужны оба формата. Не обещайте себе, что исходный PDF будет выглядеть точно так же после автоматического восстановления: перевод меняет длину строк, а таблицы и колонки требуют дополнительного внимания.

Вариант 2: фрилансер

Фрилансер подходит, когда проект можно вести напрямую и вы готовы согласовать роли: кто распознает, кто исправляет ошибки OCR, кто переводит и кто собирает итоговый файл. В небольшом проекте один человек может выполнять несколько задач, но это не отменяет необходимости явно разделить их при проверке.

Передавайте не только редактируемый текст, но и оригинальный скан. При спорной дате, фамилии или номере переводчик сможет посмотреть на страницу и не будет вынужден угадывать по результату OCR. Если скан поврежден или содержит рукописные вставки, заранее договоритесь, как отмечать неразборчивые места и кто подтверждает их содержание.

Обсудите структуру выдачи до старта: нужен перевод без верстки, редактируемый DOCX, PDF или файл с расположением текста поверх исходного изображения. Фраза «сохранить форматирование» может означать разные вещи. Например, сохранение логики таблицы не всегда означает повторение точных переносов строк и координат каждого блока.

Вариант 3: онлайн-процесс

Онлайн-инструмент может соединить распознавание скана, перевод и подготовку редактируемого результата, но оценивать нужно весь процесс, а не только кнопку загрузки. Проверьте, как система показывает сомнительные фрагменты, можно ли сопоставить перевод с оригиналом и что именно она возвращает.

Типовая задача для агентства: перевести сканированную форму, сохранив понятные поля и порядок таблицы. В ChatsControl загруженный скан сначала проходит распознавание, затем система собирает редактируемый Word-документ и формирует копию, где перевод размещен поверх изображения исходной страницы. Такая копия помогает сохранить визуальную связь с оригиналом, но текст в ней набирается заново, а не остается исходными пикселями.

Для контроля результата в ChatsControl предусмотрен двуязычный просмотр, где исходный текст показан рядом с переводом. Переводчик может пройти по фрагментам и проверить имена, числа и термины, вместо того чтобы сравнивать два файла вслепую. Ограничение важно: рукописный текст и сильно испорченные сканы распознаются ненадежно, поэтому их нужно проверять по оригиналу, а для некоторых документов удобнее ручная работа специалиста.

Критерий Бюро Фрилансер Онлайн-процесс
Распознавание скана Согласуйте, включено ли в заказ Согласуйте, кто выполняет OCR Может быть частью обработки документа
Проверка по изображению Зависит от согласованного процесса Зависит от доступа к оригиналу и роли исполнителя Нужен просмотр результата рядом с источником или отдельная сверка
Правки терминов Обсуждаются с командой проекта Напрямую с переводчиком Проверьте, можно ли задать контекст и терминологию
Работа с версткой Может включать отдельную подготовку макета Зависит от навыков и формата заказа Проверьте готовый файл, а не обещание сохранить макет
Рукописные и плохие сканы Можно оценить вручную Можно согласовать ручную проверку Автоматическое распознавание может не справиться

Цена онлайн-обработки и цена профессиональной вычитки отвечают на разные вопросы. Автоматический черновик не становится проверенным переводом только потому, что его можно скачать; для критичных документов закладывайте отдельное время на вычитку и сверку исходника.

Как сохранить таблицы, колонки и читаемую верстку

PDF не хранит страницу так же, как редакторский документ. В нём элементы могут быть расположены по координатам, а не организованы в знакомые абзацы, строки таблицы и колонки. Поэтому система, которая извлекает слова, может получить последовательность текста без ясного указания, какой заголовок относится к какой ячейке.

Документация Google Cloud предупреждает, что сложные макеты PDF могут терять форматирование, в частности таблицы, несколько колонок и графики с подписями или легендами: описание ограничений перевода документов в Google Cloud. Это не значит, что любой PDF непременно испортится. Это значит, что структуру нужно проверять отдельно от перевода.

В той же документации Google Cloud советует по возможности брать исходный PDF, а не скан, для лучшей обработки форматирования. Если существует редактируемый DOCX или PPTX, документация рекомендует перевести исходный формат до преобразования в PDF, поскольку он лучше сохраняет макет и стиль. Когда исходник доступен, поиск по нему, как правило, практичнее, чем восстановление структуры со страницы-картинки.

Официальная справка Google Translate прямо различает видимый текст и переведенный текст. Google пишет: в справке Google Translate сказано:

“You can find text in images and scanned .pdf pages in the output document but they aren’t translated.”

То есть слова с картинки могут присутствовать в выходном документе, оставаясь непереведенными. Для сканированной страницы проверяйте не только наличие текста, но и то, что целевая версия действительно перевела его.

Для таблиц используйте отдельный контрольный проход:

  • Сравните количество строк и столбцов, а не только наличие всех слов.
  • Убедитесь, что заголовок столбца остался над правильными данными.
  • Проверьте объединенные ячейки, сноски и пустые поля.
  • Сверьте числа и единицы измерения с той же ячейкой в оригинале.
  • Посмотрите, не перешел ли длинный перевод в соседнюю колонку.
  • Проверьте, не отделились ли подписи от графика или иллюстрации.

Что делать, если в PDF есть текст и сканы

Смешанный PDF требует раздельной проверки страниц и фрагментов. Текстовый слой можно извлечь обычным способом, а страницы или отдельные блоки в виде изображений нужно распознать отдельно. После обработки соберите полный текст в том порядке, который соответствует исходнику.

Документация Google Cloud указывает, что сканированное содержимое смешанного PDF может не переводиться. Не делайте вывод о полном переводе только по тому, что в выходном файле есть целевой текст: сопоставьте каждую страницу с оригиналом и найдите фрагменты, которые остались на исходном языке.

Сложный пример: на странице договора основной текст набран электронно, а подпись и рукописная дата вставлены как изображение. Обычное извлечение может корректно получить абзацы, но пропустить подпись и не разобрать дату. Переводчик должен сохранить ее как нераспознанный элемент, запросить подтверждение или обозначить нечитаемое место, а не подставлять догадку.

Пошаговая инструкция: от проверки файла до готового перевода

Ниже приведен рабочий процесс, который можно использовать для документов компании или входящих файлов клиента. Он не зависит от конкретного переводчика, но помогает отделить техническую подготовку от языковой проверки.

Шаг 1. Сохраните оригинал и зафиксируйте задачу

Сделайте отдельную копию исходного PDF и не редактируйте единственный экземпляр. Запишите, на какой язык нужен перевод, кто его будет читать, нужен ли редактируемый файл и требуется ли сохранить внешний вид страницы.

Проверьте, есть ли ограничения на передачу документа в облачный сервис. Если файл содержит конфиденциальную информацию, согласуйте допустимый способ обработки до загрузки. Онлайн-процесс может быть удобным, но выбор инструмента должен учитывать требования вашей организации к хранению данных.

Шаг 2. Найдите страницы, которые требуют OCR

Попробуйте выделить и скопировать текст на нескольких страницах. Проверьте поиск по конкретному слову, номеру или дате. Отметьте страницы, где копирование работает частично: например, обычные абзацы доступны, а таблица представляет собой изображение.

Не переносите результат проверки одной страницы на весь документ. Разные листы могли быть отсканированы и собраны из разных источников, а текстовый слой мог сохраниться только в части файла.

Шаг 3. Подготовьте скан

Посмотрите, не повернута ли страница, не срезаны ли края и достаточно ли четко видны буквы. Если изображение перекошено, затемнено или содержит заметный фон, используйте функции улучшения и выравнивания перед OCR. Руководство Adobe описывает улучшение и автоматическое выравнивание скана как часть процесса подготовки к распознаванию: инструкция Adobe Scan & OCR.

После обработки еще раз откройте изображение и проверьте, не исчезли ли края текста, линии таблицы или мелкие подписи. Очистка страницы должна сделать буквы читаемее, а не стереть тонкие элементы.

Шаг 4. Выполните OCR и вычитайте распознанный текст

Сначала получите текст, затем исправьте очевидные ошибки распознавания до перевода. Если документ длинный, организуйте проверку блоками: заголовки, основной текст, таблицы, сноски, печати и подписи. Отмечайте нечитаемые фрагменты отдельно, не заменяя их предположительным содержанием.

Проверяйте каждое важное значение по исходному изображению. В названиях, номерах и суммах даже одна неверно прочитанная цифра может изменить смысл документа. Переводчик не всегда сможет догадаться, что OCR подменил символ.

После вычитки сохраните исправленную версию отдельно от сырого результата. Такая версия становится источником для перевода и позволяет понять, на каком этапе исправили конкретный фрагмент.

Шаг 5. Переведите проверенный текст

Если нашли DOCX или другой редактируемый источник, сначала оцените его. Google Cloud рекомендует переводить DOCX или PPTX до преобразования в PDF, если исходный файл доступен, поскольку редактируемые форматы лучше сохраняют макет и стиль: документация Google Cloud по переводу документов.

При переводе OCR-текста заранее сообщите исполнителю о таблицах, сокращениях, именах и терминах компании. Текстовая выгрузка без контекста может перемешать колонки, отделить сноску от примечания или не показать, к какому полю относится значение.

Для онлайн-процесса в ChatsControl скан можно передать на распознавание и перевод, а затем проверить в двуязычном режиме. Сервис учитывает формат документа и возвращает редактируемый Word-файл; ограничения на рукописные и сильно поврежденные сканы остаются важными, поэтому сложные места нужно сверять вручную. Возможность задать предметную область, аудиторию, тон и предпочтительную терминологию полезна, если одинаковые термины встречаются в разных разделах.

Шаг 6. Проверьте перевод и верстку

Сначала проверьте смысл и соответствие исходнику: все ли абзацы переведены, не пропущены ли сноски, одинаково ли написаны имена и термины. Затем проверьте числа, даты и коды. После языковой проверки просмотрите страницы визуально, особенно таблицы, колонки, подписи к изображениям и нижние колонтитулы.

Не исправляйте только внешний вид, если ошибка могла возникнуть раньше. Например, число, которое не совпало с оригиналом, нужно проверить в OCR и переводе отдельно. Если распознанный текст был неверным, косметическая правка макета проблему не решит.

Шаг 7. Передайте итоговый комплект

Подготовьте итоговый перевод в согласованном формате и сохраните исходный скан вместе с исправленным текстом. Для внутренней передачи полезно указать, какие места не удалось надежно прочитать и какие значения подтвердил заказчик.

Если документ пойдет в государственный орган или другую организацию с формальными требованиями, проверьте правила получателя. Технически удачный OCR и аккуратный перевод не означают, что документ соответствует процедуре подачи или требованиям к заверению.

Подводные камни и контроль качества

Большинство проблем возникает не из-за одной большой ошибки, а из-за незаметного перехода между стадиями. OCR прочитал неправильную цифру, переводчик не увидел изображения, автоматический перевод оставил кусок текста на исходном языке, а редактор решил, что файл уже проверен. Контрольные точки не дают такой цепочке остаться незамеченной.

Ошибка OCR превращается в ошибку перевода

Распознавание текста не является гарантией правильного чтения. В качестве редакторского вывода из описанного Adobe процесса важно помнить: поисковый текст становится доступен, но его все равно нужно сверить с изображением. Сравните имена, цифры, даты, суммы и ячейки таблиц до перевода. Проверка после перевода может не показать, что исходная цифра была прочитана неверно.

Сканированный текст может остаться непереведенным

Если инструмент показывает исходный текст в выходном файле, это еще не означает, что он обработал его переводом. Справка Google Translate предупреждает, что слова на изображениях и страницах сканированного PDF могут быть видны в выходном документе, но не переведены: описание перевода документов в Google Translate.

Проверяйте результат по каждому фрагменту, а не по одному заголовку или первой странице. Если часть страницы осталась на исходном языке, выясните, была ли она изображением, текстовым слоем или элементом смешанного PDF.

Пользователи сообщали в обсуждении Google Translate Community об ошибке с переводом сканированных PDF о сообщении “Can’t translate scanned PDFs”. Это пользовательское обсуждение, а не официальное описание ограничений сервиса; оно показывает, почему полезно иметь отдельный план распознавания, а не полагаться только на прямую загрузку скана.

Таблица превратилась в поток строк

Когда система извлекает текст из страницы, она может не сохранить связи между ячейками. В результате цифра, название услуги и примечание окажутся в правильной последовательности, но неправильной строке. Сравните структуру таблицы на оригинале и переводе, а не просто наличие всех слов.

Документация Google Cloud отдельно упоминает таблицы, несколько колонок и графики с подписями среди элементов, форматирование которых может теряться при обработке сложных PDF: официальная документация Google Cloud. Для таких страниц планируйте отдельную проверку макета.

Скан слишком плохой или содержит рукописные записи

Если буквы смазаны, края обрезаны или на странице есть пометки от руки, OCR может предложить правдоподобный, но неверный вариант. Помечайте такие места как требующие ручной проверки. Не восстанавливайте фамилию или номер по догадке, даже если слово «похоже» на известное.

Руководство Adobe рассматривает улучшение и выравнивание изображения перед распознаванием, но эта подготовка не подтверждает точность каждого символа. Для поврежденного документа сохраняйте исходник и привлекайте человека, который сможет сверить сомнительные фрагменты с более качественной копией.

Форматирование выглядит аккуратно, но смысловая связь потерялась

Заголовок может оказаться над неправильной колонкой, а подпись графика - рядом с другим изображением. Поэтому после перевода проверьте не только внешнюю похожесть, но и связь элементов: заголовок к разделу, подпись к рисунку, примечание к строке таблицы.

Если важна визуальная сверка, в ChatsControl доступна копия перевода поверх изображения оригинальной страницы. Такой вариант сохраняет исходный вид печатей и других элементов изображения, но переводной текст набирается заново и не является точным исходным пикселем. Для полноценной проверки просмотрите как такую копию, так и редактируемый Word-файл.

Прямая загрузка в онлайн-переводчик не решает задачу OCR

Google Translate предлагает загрузить документы и выполнить перевод через раздел Documents. Согласно его справке, документный перевод доступен в настольном браузере, а не на небольшом экране или в мобильном сценарии; там же указаны ограничения загрузки PDF: до 10 МБ и до 300 страниц по состоянию на текущую справочную страницу, проверенную в 2026 году (справка Google Translate). Эти лимиты могут меняться, поэтому перед обработкой крупного файла сверяйтесь с актуальной страницей.

Даже когда загрузка проходит, сканированное содержимое может остаться непереведенным. Справка описывает загрузку документа, выбор языков, команду Translate и скачивание результата, но отдельно предупреждает о тексте с изображений. Значит, сам факт успешной обработки PDF не подтверждает, что страницы распознаны и переведены.

Для Google Cloud Document Translation также требуется настроить проект Cloud, включить API и пройти аутентификацию; пакетная обработка с Cloud Storage может потребовать настройки прав на хранилище. Это отдельный технический путь, а не простая замена загрузке файла в веб-форму. В документации Google Cloud для онлайн-перевода PDF указаны предел до 20 МБ, до 300 страниц для нативных PDF при включенной соответствующей настройке и до 20 страниц для сканированных PDF по состоянию документации, проверенной в 2026 году (документация Google Cloud). Перед использованием проверьте действующие лимиты и подготовку доступа.

Частые вопросы

Как перевести PDF, если в нем нельзя выделить текст?

Сначала запустите OCR, чтобы превратить изображение страницы в машинно-читаемый текст. Затем вычитайте распознанный результат по оригиналу, переведите его и проверьте структуру готового файла.

Нужно ли запускать OCR перед переводом сканированного PDF?

Да, если текст существует только как изображение. OCR создает текстовый слой или редактируемый результат, который можно передать в текстовый переводчик; распознавание не заменяет перевод и вычитку.

Переводит ли Google Translate текст на страницах сканированного PDF?

Справка Google сообщает, что текст со сканированных страниц может появиться в выходном документе, но остаться непереведенным. Перед работой проверьте наличие текстового слоя и не считайте загрузку файла подтверждением полного перевода: справка Google Translate.

Как сохранить таблицы и верстку при переводе сканированного PDF?

Проверьте соответствие каждой строки и колонки, затем отдельно вычитайте графики, подписи, сноски и длинные переносы. Если существует редактируемый DOCX или PPTX, документация Google Cloud советует переводить исходный редактируемый формат до преобразования в PDF, поскольку он лучше сохраняет макет и стиль: документация Google Cloud.

Как проверить ошибки OCR в деловом документе?

Сверьте распознанный текст с изображением оригинала и проверьте имена, даты, суммы, номера, заголовки таблиц и коды. Исправьте ошибки распознавания до перевода, чтобы неверный исходный символ не перешел в целевой текст.

Можно ли доверять результату после автоматического OCR и перевода?

Не без проверки. OCR преобразует изображение в текст, но не гарантирует правильное чтение каждого символа; перевод также не подтверждает точность исходного скана. Сверьте сомнительные места с изображением и проверьте готовую верстку.

Что делать, если часть PDF сканированная, а часть содержит обычный текст?

Проверьте каждую страницу отдельно, извлеките доступный текст и распознайте фрагменты-изображения. Документация Google Cloud предупреждает, что сканированное содержимое смешанного PDF может остаться непереведенным, поэтому сопоставьте все страницы с исходником: руководство Google Cloud по переводу документов.

Sources:

  • (n/a)

Попробуйте ChatsControl

AI-платформа для профессиональных переводчиков

Попробовать бесплатно →