Как перевести PDF без потери форматирования и верстки

Разбираем, как перевести PDF и сохранить таблицы, изображения и структуру страниц: от проверки текстового слоя до OCR, редактирования и контроля результата.

Также: EN UK RU
Как перевести PDF без потери форматирования и верстки

Срок сдачи не сдвигается, а в PDF лежат таблица, подписи, примечания и текст, который нельзя просто скопировать. Переводить файл как сплошной текст рискованно: можно получить правильные слова, но потерять структуру, перепутать подписи или оставить часть скана без перевода.

Сохранить форматирование PDF реально, если сначала понять, какой именно файл у вас в руках. PDF с текстовым слоем и сканированный PDF требуют разных действий. Затем нужно выбрать способ перевода, проверить полноту извлечения и отдельно оценить, помещается ли перевод в исходную верстку.

Для агентства или переводчика рабочий процесс не заканчивается кнопкой «Перевести». Нужны исходник, контроль OCR при сканах, проверка терминологии и постраничный просмотр результата. Ниже разберем варианты и дадим чек-лист, который можно использовать перед отправкой файла клиенту.

Что именно значит «сохранить форматирование PDF»

PDF фиксирует расположение текста и графики на странице, но не гарантирует, что текст доступен для редактирования. Один файл может содержать настоящие текстовые блоки, другой - только изображения страниц. Внешне документы похожи, а переводятся по-разному.

Текстовый слой - это данные, из которых можно выделить и скопировать слова. Если вы можете поставить курсор в абзац, выделить фразу и вставить ее в текстовый редактор, файл, скорее всего, содержит распознаваемый текст. Если выделяется вся страница как картинка или ничего не выделяется, перед переводом нужно проверить, не является ли PDF сканом.

Сохранение форматирования тоже состоит из нескольких задач:

  • сохранить последовательность страниц и разделов;
  • оставить таблицы, списки, заголовки и подписи на своих местах;
  • не потерять текст внутри изображений, сносок и небольших блоков;
  • подобрать размер и переносы так, чтобы перевод не выходил за границы исходных элементов;
  • проверить, что в готовом файле не появились пустые страницы или наложения.

На практике перевод может быть полным по смыслу, но неудачным визуально. Например, исходная подпись занимает одну строку, а перевод - две. В коротком поле формы вторая строка может закрыть соседнее поле. В таблице увеличившаяся фраза может сместить границы ячеек или стать слишком мелкой после подгонки.

Проверка текста и проверка верстки поэтому не заменяют друг друга. Первая отвечает на вопрос «все ли переведено и правильно ли передан смысл?», вторая - «читается ли результат и не нарушено ли расположение элементов?».

Если PDF создан из Word или презентации, запросите редактируемый исходник. Работа с исходным DOCX часто дает больше контроля, чем попытка извлечь текст из готовой страницы. Если доступен только PDF, экспорт в редактируемый формат может быть промежуточным шагом, но конвертация сама по себе не гарантирует точного восстановления исходной верстки.

Чтобы сравнить подходы для двух распространенных форматов, пригодится материал о переводе Word и PDF онлайн с сохранением форматирования. Разница не только в расширении файла: важны доступ к исходнику, структура документа и наличие сканов.

Как выбрать способ перевода: бюро, фрилансер или онлайн-инструмент

Способ перевода выбирают не по одному признаку «нужен PDF», а по сочетанию требований: какой текст внутри, насколько сложна верстка, кто будет проверять перевод и требуется ли официальное заверение. Ниже - короткая таблица для первичного решения.

Ситуация Подходящий вариант Что проверить заранее
Документ для публикации, сложная графика или несколько языков Бюро с переводчиком и верстальщиком Кто отвечает за текст и кто собирает финальный PDF
Нужен контроль одного языка, терминов и оформления Фрилансер с опытом работы с PDF Умеет ли специалист работать с исходным файлом, OCR и финальной версткой
Нужен черновик или быстрый перевод документа с последующей проверкой Онлайн-инструмент Поддерживает ли он ваш тип файла, сканы и нужные элементы макета
PDF представляет собой скан OCR, затем перевод и ручная сверка Полнота распознавания, имена, числа, даты, символы
Документ должен быть официально заверен Переводчик, который соответствует требованиям принимающей организации Какой именно вид заверения требует получатель

Бюро удобно, когда нужен единый исполнитель для перевода и верстки. Уточните, включена ли в работу проверка результата после экспорта, кто сверяет таблицы и как согласуются изменения, если текст не помещается. Формулировка «перевод PDF» может означать только перевод текста, без подготовки финального макета.

Фрилансер может подойти для отдельного языка, специальной тематики или задачи, где заказчик хочет напрямую согласовывать термины. До старта запросите план: специалист будет переводить PDF напрямую, извлекать текст или работать с DOCX? Кто отвечает за OCR и что произойдет, если часть текста нельзя распознать?

Онлайн-инструмент полезен для рабочего черновика, больших пачек типовых файлов и задач, где формат нужно сохранить без ручной сборки каждой страницы. Но интерфейс загрузки документа не означает автоматическую проверку качества. После выгрузки все равно проверяйте текст и макет.

Для онлайн-перевода Google Translate описывает процесс через браузер: открыть раздел Documents, выбрать исходный и целевой языки или Detect language, загрузить файл, запустить перевод и скачать результат. В справке, проверенной 1 июня 2026 года, указана загрузка файлов до 10 МБ и ограничение PDF до 300 страниц; та же страница сообщает, что функция недоступна на маленьких экранах и мобильных устройствах (справка Google Translate).

Лимиты сервиса стоит проверить перед планированием процесса. Если файл не подходит по размеру или числу страниц, не тратьте время на повторные попытки загрузки: обратитесь к варианту, рассчитанному на более крупные документы, или разделите задачу по согласованной процедуре. Справка Google предлагает пользователям, которым нужно переводить больше или большие документы, ознакомиться с документацией Cloud Translation API (справка Google Translate).

Перевод PDF с помощью машинного перевода имеет смысл, когда вы готовы вычитать результат. Если документ нужен для подписания, публикации, подачи в учреждение или использования как юридически значимого текста, согласуйте требования к проверке с ответственным специалистом. Одна только аккуратная верстка не подтверждает точность содержания.

В ChatsControl можно загрузить PDF и получить перевод с сохранением структуры документа. Для скана инструмент сначала выполняет OCR, то есть распознает текст на изображении, а затем формирует переведенный документ. В результате можно просматривать исходный и переведенный текст рядом и проверять спорные места; слабые или рукописные сканы все равно требуют ручной проверки, а сервис не заменяет систему управления переводческими проектами.

Типичная ситуация для такого сценария - переводчик получает несколько PDF с таблицами и повторяющимися разделами, а потом вычитывает перевод по страницам. Параллельный просмотр оригинала и перевода помогает быстрее находить расхождения, но ответственность за имена, числа и контекст остается у проверяющего.

Какой вариант выбрать, если доступен исходный DOCX?

Если автор сохранил файл Word, начните с него, а не с экспорта в PDF. Исходный файл обычно дает более прямой доступ к заголовкам, таблицам и абзацам, чем готовая страница PDF. После перевода экспортируйте финальную версию в PDF и проверьте результат в том виде, в котором его увидит получатель.

PDF остается полезным контрольным образцом: сравните исходную и переведенную версии постранично. Если доступен только PDF, сначала оцените качество экспорта или OCR, а затем решите, стоит ли возвращать текст в DOCX для правки или редактировать PDF напрямую.

Сканы и OCR: что проверить до перевода

OCR - оптическое распознавание символов, которое превращает текст на изображении в текстовый слой. Без такого слоя PDF может выглядеть как документ, но для программы его содержание будет набором изображений.

W3C объясняет, что PDF, состоящий из сканированных изображений текста, не содержит поискового текстового слоя. Поэтому вспомогательные технологии не могут прочитать или извлечь его слова; до появления текстового слоя содержимое нельзя выбирать, редактировать или перекомпоновывать как обычный текст (описание техники PDF7 от W3C).

Как пишет W3C в описании PDF7: “A document that consists of scanned images of text is inherently inaccessible because the content of the document is images, not searchable text.”

Иными словами, изображение букв не заменяет доступный текстовый слой. Переводчик или программа сначала должны получить текст из изображения, а затем проверить, что OCR не исказил содержание.

Справка Google прямо предупреждает, что текст на изображениях и сканированных страницах PDF может появиться в выходном документе, но не будет переведен (справка Google Translate). Поэтому загрузка скана в обычную функцию перевода документа может создать опасную иллюзию готового результата: страница останется на месте, но текст внутри нее сохранится на исходном языке.

Перед OCR сделайте копию оригинала. Затем проверьте, все ли страницы читаемы, не перекошены ли они, нет ли бликов, теней или обрезанных краев. Размытые символы, бледная печать и сложные таблицы увеличивают риск ошибок распознавания. W3C отмечает, что точность OCR зависит от разрешения скана и четкости текста, а неуверенно распознанные элементы могут требовать отдельной проверки (W3C PDF7).

Справка Google формулирует ограничение так: “You can find text in images and scanned .pdf pages in the output document but they aren’t translated.”

Для производственного процесса эта фраза означает: наличие страницы в скачанном документе не доказывает, что ее текст переведен. Проверьте каждую страницу, на которой есть изображение с надписями.

Самый безопасный порядок действий выглядит так:

  1. Сохраните исходный PDF без изменений.
  2. Проверьте, выделяются ли слова и ищутся ли они через поиск по документу.
  3. Если обычный текстовый слой отсутствует, выполните OCR.
  4. Сверьте распознанный текст с изображением оригинала.
  5. Исправьте распознавание до перевода, а не после него.
  6. Переведите текст, затем проверьте итоговую верстку по каждой странице.

На этапе сверки сосредоточьтесь на именах, числах, датах, адресах, номерах документов и специальных символах. OCR может сделать строку поисковой, но это не доказывает, что программа правильно распознала каждую букву. Ошибка в названии организации или цифре может быть важнее, чем десятки правильно распознанных абзацев.

В описании W3C указано, что OCR может не распознать часть текста, а сомнительные элементы могут отмечаться как подозрительные результаты распознавания (W3C PDF7).

Пометка сомнительного символа - не формальность. Проверяющий должен вернуться к изображению и сверить конкретный фрагмент, прежде чем передавать его переводчику или включать в готовую версию.

Иногда OCR добавляет поисковый слой поверх изображения, не меняя внешний вид страницы. Такой PDF удобен для чтения и поиска, но проверка внешнего вида не заменяет проверку распознанных данных: изображение может выглядеть правильно, пока скрытый текст содержит ошибку. Сравнивайте текстовый слой с изображением отдельно.

Если в документе много мелких подписей, сносок или рукописных пометок, не рассчитывайте на полную автоматизацию. Рукописный текст и сильно поврежденные сканы требуют ручной оценки. Когда символ нельзя надежно прочитать, отметьте его для уточнения, а не подставляйте предполагаемое слово.

Сравнение способов: качество, макет и контроль

У каждого метода своя точка риска. Бюро может объединить перевод и верстку, самостоятельный перевод дает прямой контроль, а онлайн-инструмент ускоряет подготовку черновика. Сравнивайте не только удобство загрузки, но и то, как вы проверите результат и исправите проблемы.

Критерий Бюро Фрилансер Онлайн-инструмент
Работа с исходником Может организовать перевод и верстку Зависит от навыков и согласованного процесса Зависит от поддержки формата и структуры
Сканированный PDF Уточните, кто делает OCR и сверяет результат Уточните наличие опыта OCR и ручной проверки OCR может быть встроен или отсутствовать
Контроль терминологии Согласуйте глоссарий и этап проверки Можно напрямую согласовывать термины Проверьте, можно ли задать контекст и предпочтительную терминологию
Финальная верстка Уточните, входит ли постраничная проверка Зафиксируйте, кто исправляет переносы и блоки Проверьте файл после выгрузки вручную
Официальная подача Запросите нужный вид заверения отдельно Проверьте статус и требования к исполнителю Не считайте машинный перевод заверенным
Типичное ограничение Состав работы и этапы нужно согласовать Один специалист может не закрывать весь процесс Автоматизация не снимает ответственность за проверку

В онлайн-сценарии удобно получить черновик и сохранить общий каркас документа, но финальный файл надо сравнить с исходником. В документации Google описаны перевод и скачивание файлов, однако она не обещает точное сохранение каждого шрифта, переноса строки или элемента макета. Поэтому проверка экспортированного файла - часть процесса, а не необязательный бонус (справка Google Translate).

Для работы с переводом важна и терминология. Если в PDF повторяются названия продуктов, подразделений или технических деталей, составьте список предпочтительных вариантов до начала перевода. Одна и та же организация не должна менять написание от страницы к странице, особенно в договоре, инструкции или форме.

В ChatsControl переводчик может задать контекст, аудиторию, тон и предпочтительные термины перед запуском. Такой бриф помогает направлять обработку всего документа, но не отменяет проверки спорных терминов и имен. Для документа с утвержденной терминологией сравните выбранные варианты с глоссарием клиента перед сдачей.

Как понять, что инструмент не подходит?

Проверьте, совпадает ли тип файла с поддерживаемыми форматами, можно ли извлечь текст и не состоит ли документ из схем, чертежей или сложных графических страниц. Отдельные сервисы ограничивают типы PDF, даже если обычные текстовые документы переводят. Например, в справке Google описаны конкретные форматы и лимиты, поэтому сначала сверяйте требования с источником (справка Google Translate).

Если перевод должен сохранить сложную графику, а автоматический результат меняет расположение элементов, передайте задачу специалисту по верстке или работайте с исходным файлом. Не пытайтесь исправлять разъехавшиеся блоки случайными переносами в самом конце: структурные проблемы проще обнаружить на раннем тестовом фрагменте.

Пошаговый рабочий процесс для переводчика или агентства

Четкая процедура снижает риск пропуска страницы и помогает заранее договориться с заказчиком о результате. Ниже - последовательность, которую можно использовать как рабочий чек-лист.

  1. Зафиксируйте требования. Уточните целевой язык, назначение перевода, желаемый формат сдачи и необходимость заверения. Спросите, требуется ли внешний вид, максимально близкий к оригиналу, или достаточно читабельного документа с той же структурой.
  2. Запросите исходные материалы. Попросите оригинальный PDF и, если он существует, исходный DOCX, презентацию или другой редактируемый файл. Сохраните обе версии, чтобы можно было сравнить результат.
  3. Определите тип PDF. Проверьте выделение текста и поиск по документу. Отметьте страницы, где текст находится внутри изображения или где слой доступен только частично.
  4. Оцените качество сканов. Посмотрите на резкость, контраст, поворот, тени, края страниц и мелкие подписи. Если фрагменты трудно прочитать, заранее согласуйте ручную сверку или запросите более качественный оригинал.
  5. Подготовьте текст. Для сканов проведите OCR, затем сверьте распознанное с изображениями. Для редактируемого файла проверьте заголовки, списки, таблицы и текстовые блоки перед переводом.
  6. Согласуйте термины и имена. Соберите написание организаций, должностей, продуктов, фамилий и сокращений. Уточните, какие элементы нужно оставить без перевода.
  7. Переведите документ. Выберите ручной, автоматизированный или комбинированный процесс в зависимости от задачи. Если перевод делается инструментом, назначьте отдельного проверяющего и не считайте машинный результат готовым без вычитки.
  8. Проверьте содержание. Сверьте полноту страниц и блоков, числа, имена, даты, единицы измерения, подписи и ссылки. Убедитесь, что ни одна сноска или строка таблицы не выпала.
  9. Проверьте макет. Откройте финальный файл и просмотрите все страницы. Найдите обрезанный текст, наложения, пустые блоки, изменившиеся переносы и элементы, оказавшиеся не рядом с нужной подписью.
  10. Сдайте понятный комплект. Передайте финальный PDF и, если это предусмотрено задачей, редактируемый файл. Укажите, какие места потребовали ручной проверки и что нужно уточнить у заказчика.

Не ждите финальной сборки, чтобы впервые проверить макет. Переведите и проверьте несколько репрезентативных страниц: страницу с обычными абзацами, таблицу, страницу со сканом и страницу с мелкими подписями. Такой тест помогает увидеть проблемы с переносами и OCR до того, как они повторятся по всему документу.

Пример: в инструкции есть основное описание, таблица характеристик и подпись внутри изображения. Обычный текстовый слой покрывает описание и таблицу, но подпись остается частью картинки. Если проверить только возможность поиска, файл покажется готовым к переводу, хотя одно из трех содержательных мест не попадет в текстовую обработку.

В ChatsControl исходный и переведенный текст можно просматривать рядом, а отдельный инструмент проверки качества помогает искать проблемы с числами, именами, терминами и пропусками. Такой контроль полезен после перевода, но визуальную проверку PDF все равно проводите в экспортированном файле: анализ текста не показывает все проблемы с расположением элементов.

Для агентства этот процесс стоит закрепить в карточке заказа: кто проверяет OCR, кто утверждает терминологию, кто исправляет верстку и в каком виде заказчик получает результат. Назначенные роли предотвращают ситуацию, когда каждый считает, что финальную страницу проверит кто-то другой.

Подводные камни и контроль качества после экспорта

В PDF легко спутать несколько видов ошибок. Не каждый перенос строки - проблема перевода, и не каждое правильное предложение означает, что документ готов. Проверяйте отдельно полноту, точность и внешний вид.

Пропущенный текст на изображении

Подпись, печать, примечание или заголовок может находиться внутри изображения, а не в текстовом слое. Обычный поиск по документу не найдет такие элементы. Составьте список страниц с изображениями и просмотрите их вручную после OCR и перевода.

Ошибка OCR, которая выглядит правдоподобно

Распознанная цифра или буква может превратиться в другое значение, которое внешне похоже на исходное. Не ограничивайтесь автоматической проверкой орфографии. Сверяйте имена, числа, даты и символы прямо с изображением, особенно если они влияют на идентификацию или содержание документа. W3C указывает, что OCR способен пропускать текст и ошибаться при распознавании (W3C PDF7).

Перевод не помещается

Длина фразы меняется при переводе, а ширина исходной колонки остается прежней. Если автоматическая подгонка уменьшает шрифт, проверьте, остается ли текст читаемым. Если программа обрезает конец строки, исправьте блок или вернитесь к редактируемому исходнику.

Таблица потеряла смысловую связь

В таблицах проверяйте не только текст ячеек, но и то, к какой строке и колонке относится каждый показатель. При экспорте могут измениться ширина колонок и переносы. Даже небольшое смещение способно связать подпись не с тем значением.

Скрытый текст расходится с картинкой

PDF со сканами может одновременно показывать изображение страницы и содержать невидимый текстовый слой для поиска. Если после OCR исправить только видимый текст или только слой, две версии документа могут расходиться. Проверяйте, что экспортированный файл и его текстовый слой соответствуют друг другу.

Загрузка не означает контроль результата

Перевод файла и скачивание результата - это этапы обработки, не сертификат точной верстки. Справка Google описывает загрузку, перевод и скачивание документа, но не обещает пиксельного совпадения шрифтов и переносов; это ограничение нужно учитывать при планировании контроля (справка Google Translate).

Полезный финальный контроль можно разделить на три прохода:

  • Содержание: все ли страницы и элементы попали в перевод, нет ли пропусков и необъяснимых фрагментов на исходном языке.
  • Точность: совпадают ли имена, числа, даты, единицы, термины и подписи с исходником и согласованной терминологией.
  • Верстка: читается ли текст, не закрывает ли он графику, не обрезан ли и находится ли рядом с соответствующим элементом.

Если результат не проходит проверку, сначала установите источник проблемы. Пропуск текста требует проверки извлечения или OCR. Неверный термин требует редакторской правки. Обрезанная строка требует исправления макета. Разные ошибки лечатся на разных этапах, поэтому повторный запуск перевода не всегда решает задачу.

Для дополнительных приемов пригодится руководство о сохранении форматирования при переводе Word, PDF и Excel. Если нужно понять, почему машинная обработка меняет структуру, прочитайте материал о том, как машинный перевод разрушает форматирование документов.

Как выбрать безопасный маршрут для конкретного PDF

Выбор становится проще, если начать с трех вопросов: есть ли редактируемый исходник, доступен ли текст для выделения и насколько строгими должны быть требования к финальной верстке.

Есть исходный DOCX и обычная текстовая верстка? Переводите редактируемый файл, затем экспортируйте PDF и проверьте результат. Не конвертируйте PDF обратно без причины: лишний переход формата может создать дополнительные проблемы.

Есть только PDF, но текст выделяется? Проверьте таблицы, изображения и колонтитулы, затем выберите инструмент, который обрабатывает документ как файл, а не только переводит вставленный текст. После экспорта сравните оригинал и перевод постранично.

Есть только скан? Выполните OCR, сверьте текст с изображением и лишь после этого переводите. Если OCR ошибается или часть текста рукописная, передайте эти места на ручную проверку либо запросите новый источник.

Нужно сохранить макет для публикации? Согласуйте, кто отвечает за верстку и какие изменения допустимы. «Сохранить форматирование» может означать сохранение структуры, а не точное совпадение каждого элемента. Уточните, важны ли шрифты, номера страниц, положение графики и размеры полей.

Документ предназначен для официальной подачи? Узнайте требования у организации-получателя. Машинный перевод и аккуратно оформленный PDF не подтверждают наличие заверения. Если нужен заверенный перевод, согласуйте отдельный человеческий этап и форму, которую принимает конкретное учреждение.

Для быстрого рабочего черновика онлайн-инструмент может сэкономить время, если у файла есть текстовый слой и вы готовы проверить результат. Для сканов сначала добавьте OCR и сверку. Для сложного макета и критичных документов заранее включите в процесс человека, который отвечает за содержание и финальную верстку.

При оценке задачи не обещайте заказчику «тот же PDF на другом языке» до просмотра файла. Дайте ему список входных данных: исходник, язык, требования к оформлению, список терминов и требования получателя. Если в документе есть изображения с текстом, обозначьте их отдельно. Такой бриф превращает расплывчатое пожелание в проверяемый результат.

Частые вопросы

Как перевести PDF и сохранить исходное форматирование?

Сначала проверьте, выделяется ли текст. Для обычного PDF используйте перевод документа или редактируемый исходник, а для скана выполните OCR, сверьте текст и отдельно проверьте верстку после экспорта.

Можно ли перевести сканированный PDF через Google Translate?

Нет. Справка Google сообщает, что текст на изображениях и сканированных страницах может появиться в выходном файле, но не переводится (справка Google Translate). Сначала нужен OCR, затем проверка распознанного текста.

Нужно ли конвертировать PDF в Word перед переводом?

Не всегда. Если доступен исходный DOCX, работайте с ним; если исходника нет, экспорт PDF в редактируемый формат может помочь, но после конвертации проверьте таблицы, текстовые блоки и изображения. Перевод из скопированного текста не сохранит верстку сам по себе.

Как проверить перевод PDF на пропущенный текст и ошибки верстки?

Просмотрите каждую страницу, сравните заголовки, таблицы, подписи и изображения с оригиналом, а затем проверьте, что строки не обрезаны и не накладываются на другие элементы. Для скана отдельно сверьте OCR с изображением, особенно имена, числа, даты и символы.

Что сделать перед переводом сканированного PDF?

Сохраните оригинал, проверьте четкость страниц и наличие текстового слоя, затем проведите OCR. До перевода сверьте распознанные фрагменты с изображениями; сомнительные или рукописные места отметьте для ручной проверки.

Почему переведенный PDF выглядит иначе, чем оригинал?

Переведенная фраза может быть длиннее исходной, а размер текстового блока не меняется автоматически. После перевода проверьте переносы, масштаб шрифта, положение таблиц и подписи; для точной верстки может потребоваться ручное редактирование.

Подходит ли автоматический перевод PDF для официальной подачи?

Сам по себе автоматический перевод не подтверждает соответствие требованиям учреждения. До начала работы уточните у получателя, нужен ли заверенный перевод, какой формат документа требуется и допустима ли электронная копия.

Что выбрать, если PDF не удается перевести целиком?

Сначала проверьте текстовый слой и тип файла, затем разделите проблему на части: слишком большой файл, скан, неподдерживаемая структура или ограничение инструмента. Для Google Translate проверьте актуальные условия загрузки в справке, где на 1 июня 2026 года указаны пределы до 10 МБ и до 300 страниц для PDF (справка Google Translate).

Попробуйте ChatsControl

AI-платформа для профессиональных переводчиков

Попробовать бесплатно →