Обновлено 25.09.2026
Два вида PDF
PDF с текстом создаётся программой: Word, бухгалтерской системой, браузером при сохранении страницы. В файле записаны сами буквы, шрифты и их положение на странице. Такой текст можно выделить, скопировать, найти поиском, прочитать программой экранного доступа.
Скан — это изображение страницы, упакованное в PDF. Сканер или камера телефона видят лист как набор точек и не знают, что на нём буквы. Для компьютера такой файл — фотография, даже если на ней отчётливо напечатан текст.
Есть и промежуточный вариант — PDF с поиском: изображение скана, под которым лежит невидимый текстовый слой. Внешне это скан, но текст выделяется и ищется.
Как проверить файл
Три быстрых способа:
- Выделите строку мышью. В PDF с текстом выделяется строка или слово. В скане выделяется вся страница прямоугольником или ничего.
- Воспользуйтесь поиском (Ctrl+F, на Mac — Cmd+F). Введите слово, которое точно есть на странице. Если оно не находится — текста в файле нет.
- Увеличьте масштаб до 300–400 %. Буквы в PDF с текстом остаются чёткими при любом увеличении. Буквы в скане расплываются и распадаются на точки.
Почему это важно
- Поиск и цитаты. По скану нельзя найти нужный пункт договора или скопировать реквизиты.
- Редактирование. Перевести скан в редактируемый Word без распознавания невозможно — получатся картинки.
- Требования организаций. Например, порядки подачи документов в суды рекомендуют PDF с копируемым текстом.
- Размер. Скан обычно весит больше, чем PDF с текстом того же объёма.
Что даёт распознавание
Распознавание (OCR) анализирует изображение страницы и превращает его в текст. Инструмент «Распознать скан» работает с русским и английским языком и выдаёт результат в одном из трёх видов:
- документ Word — с абзацами, выравниванием, размером шрифта и жирным начертанием, для редактирования;
- PDF с поиском по тексту — вид скана сохраняется полностью, добавляется невидимый текстовый слой;
- TXT — только текст без оформления.
Качество зависит от исходника. Лучше всего распознаются сканы 300 dpi, ровные и без теней. Перевёрнутые страницы и небольшой перекос сервис исправляет сам. Рукописный текст не распознаётся. За раз обрабатывается до 30 страниц — диапазон задаётся в поле «Страницы».
Если нужен сразу редактируемый документ, можно воспользоваться «PDF в Word» в режиме «С сохранением вёрстки»: если PDF окажется сканом, текст распознается автоматически.
PDF в WordРедактируемый .docx с таблицами и вёрсткойОткрытьЕсли текст в файле уже есть
Чтобы получить весь текст одним файлом, используйте «PDF в TXT». Инструмент работает в браузере и предлагает два режима: «Абзацами (склеить строки)» — для чтения и дальнейшей правки, «Построчно, как в PDF» — если важно сохранить разбивку строк. Для сканов он не подходит: без текстового слоя извлекать нечего.
PDF в TXTВесь текст документа в файл .txtОткрытьПодробнее о причинах, по которым текст не копируется, — в инструкции «Почему из PDF не копируется текст».