pdfhelp.ru Все инструменты Инструкции
Без регистрации. Серверы и обработка данных — в России

Чем скан отличается от PDF с текстом

Два PDF могут выглядеть одинаково, но внутри один содержит текст, а другой — только фотографию страницы. Разбираемся, как их отличить и что с этим делать.

Что нужно сделать сегодня?

Обновлено 25.09.2026

Два вида PDF

PDF с текстом создаётся программой: Word, бухгалтерской системой, браузером при сохранении страницы. В файле записаны сами буквы, шрифты и их положение на странице. Такой текст можно выделить, скопировать, найти поиском, прочитать программой экранного доступа.

Скан — это изображение страницы, упакованное в PDF. Сканер или камера телефона видят лист как набор точек и не знают, что на нём буквы. Для компьютера такой файл — фотография, даже если на ней отчётливо напечатан текст.

Есть и промежуточный вариант — PDF с поиском: изображение скана, под которым лежит невидимый текстовый слой. Внешне это скан, но текст выделяется и ищется.

Как проверить файл

Три быстрых способа:

  1. Выделите строку мышью. В PDF с текстом выделяется строка или слово. В скане выделяется вся страница прямоугольником или ничего.
  2. Воспользуйтесь поиском (Ctrl+F, на Mac — Cmd+F). Введите слово, которое точно есть на странице. Если оно не находится — текста в файле нет.
  3. Увеличьте масштаб до 300–400 %. Буквы в PDF с текстом остаются чёткими при любом увеличении. Буквы в скане расплываются и распадаются на точки.

Почему это важно

  • Поиск и цитаты. По скану нельзя найти нужный пункт договора или скопировать реквизиты.
  • Редактирование. Перевести скан в редактируемый Word без распознавания невозможно — получатся картинки.
  • Требования организаций. Например, порядки подачи документов в суды рекомендуют PDF с копируемым текстом.
  • Размер. Скан обычно весит больше, чем PDF с текстом того же объёма.

Что даёт распознавание

Распознавание (OCR) анализирует изображение страницы и превращает его в текст. Инструмент «Распознать скан» работает с русским и английским языком и выдаёт результат в одном из трёх видов:

  • документ Word — с абзацами, выравниванием, размером шрифта и жирным начертанием, для редактирования;
  • PDF с поиском по тексту — вид скана сохраняется полностью, добавляется невидимый текстовый слой;
  • TXT — только текст без оформления.
Распознать сканOCR: текст из скана на русскомОткрыть

Качество зависит от исходника. Лучше всего распознаются сканы 300 dpi, ровные и без теней. Перевёрнутые страницы и небольшой перекос сервис исправляет сам. Рукописный текст не распознаётся. За раз обрабатывается до 30 страниц — диапазон задаётся в поле «Страницы».

Если нужен сразу редактируемый документ, можно воспользоваться «PDF в Word» в режиме «С сохранением вёрстки»: если PDF окажется сканом, текст распознается автоматически.

PDF в WordРедактируемый .docx с таблицами и вёрсткойОткрыть

Если текст в файле уже есть

Чтобы получить весь текст одним файлом, используйте «PDF в TXT». Инструмент работает в браузере и предлагает два режима: «Абзацами (склеить строки)» — для чтения и дальнейшей правки, «Построчно, как в PDF» — если важно сохранить разбивку строк. Для сканов он не подходит: без текстового слоя извлекать нечего.

PDF в TXTВесь текст документа в файл .txtОткрыть

Подробнее о причинах, по которым текст не копируется, — в инструкции «Почему из PDF не копируется текст».

Другие инструкции

Другие инструменты

Из PDF

В PDF

Страницы и файлы

Оптимизация

Оформление

Защита