Документы
Конвертер PDF
Конвертируйте PDF в другие форматы или создавайте PDF из файлов других типов.
Что делают из PDF
Документы
Изображения
Электронные книги
Векторная графика
Что превращают в PDF
Документы
Электронные книги
Формат PDF
PDF — формат, в котором документ отдают «на выход»: подписанный договор, счёт, макет в типографию, резюме. Читать и печатать его удобно, править — почти невозможно, поэтому ищут обычно не редактор PDF, а конвертер в Word, Excel или картинки. Обратная задача — собрать PDF из документов, сканов и фотографий — решается заметно надёжнее.
PDF уместен там, где получатель должен увидеть ровно то, что вы отправили, и ничего не сдвинуть: счета и акты, инструкции, презентации для рассылки, портфолио, работы в печать. Отдельные профили закрывают частные задачи — PDF/A для архива, где файл должен открыться и через двадцать лет, PDF/X для типографии с обязательными вылетами и цветовым профилем.
Типичные сложности начинаются, когда PDF пытаются использовать как рабочий файл. Отсканированный документ выглядит как текст, но текстом не является — это картинки страниц, из них ничего не копируется и не ищется без распознавания. Файлы из фотоаппаратов и сканеров весят сотни мегабайт из-за изображений в 600 dpi. Документы бывают защищены паролем на открытие или на изменение. А текст внутри разложен на позиционированные фрагменты, а не на абзацы, — отсюда и приблизительность любого обратного преобразования.
Чаще всего из PDF идут в четырёх направлениях: в Word — чтобы дописать и переформатировать, в Excel — чтобы посчитать таблицу, в JPG и PNG — чтобы вставить страницу в презентацию, отправить в мессенджере или показать на сайте, в EPUB — чтобы читать с телефона. В обратную сторону PDF собирают из JPG и PNG (сканы паспорта или чеки в один файл), из Word и Excel (зафиксировать вёрстку перед отправкой) и из электронных книг. При переводе в изображения полезен диапазон страниц — не нужно превращать в картинки все двести листов, если требуется только третья.
Что спрашивают о формате PDF
Почему после конвертации PDF в Word «съезжает» вёрстка?
В PDF нет абзацев и таблиц как таковых — есть текстовые фрагменты с координатами. Конвертер восстанавливает структуру по расположению: где-то верно, где-то нет. Хуже всего распознаются многоколоночная вёрстка, таблицы без линий, колонтитулы и сложные врезки. Результат почти всегда требует вычитки, зато набирать документ заново не приходится.
Из PDF не копируется текст — только выделяется картинка. Что делать?
Это отсканированный документ: внутри лежат изображения страниц, а текстового слоя нет. Конвертация в JPG или PNG вернёт те же изображения, а перевод в Word даст страницы-картинки без текста. Чтобы получить редактируемый текст, нужно распознавание (OCR) — отдельная задача, которую решают Adobe Acrobat, ABBYY FineReader или Tesseract.
Можно ли конвертировать PDF, защищённый паролем?
Нет. Файл, зашифрованный паролем на открытие, сервис не сможет прочитать — ключ есть только у вас. Снимите защиту в программе, где документ открывается (в Acrobat это «Свойства → Защита»), и загрузите файл заново. Ограничение только на печать и копирование иногда не мешает конвертации, но полагаться на это не стоит.