Как распознать скан PDF
- Загрузите PDF со сканом или фото страниц.
- ЯсноДок определит, есть ли в файле текстовый слой.
- Если это скан, сервис распознает текст и подготовит DOCX.
Превратите скан PDF или фото-страницы внутри PDF в редактируемый DOCX. Распознавание читает русский и английский текст, а режим макета помогает сохранить примерное расположение строк.
Распознавание нужно, если PDF состоит из изображений: сканов договора, акта, счета, паспорта страницы или фото документа. Без распознавания такой PDF не станет редактируемым Word, даже если буквы отлично читаются глазами.
Выберите режим макета, если в скане есть таблицы, колонки или строки с суммами. DOCX будет собран так, чтобы отступы и строки были ближе к исходной странице, а не просто перечислены абзацами подряд.
Четкий скан распознается лучше. Наклон, тени, рукописный текст и сложные таблицы могут потребовать ручной правки после скачивания DOCX - ни один OCR-сервис, включая наш, не гарантирует стопроцентно точный результат на плохом исходнике.
Быстрая проверка без специальных инструментов: откройте PDF в любой программе для чтения и попробуйте выделить текст мышью или нажать Ctrl+F и найти слово, которое точно есть на странице. Если текст выделяется и находится - перед вами текстовый PDF, распознавание не нужно, конвертация пройдёт быстрее и, скорее всего, бесплатно (подробнее - на странице PDF в Word). Если выделить ничего не получается, а поиск ничего не находит - это скан: страница хранится как картинка, и буквы для компьютера не существуют, пока их не распознают.
Сканом в этом смысле считается не только файл с настоящего сканера, но и PDF, собранный из фото на телефон, а также документ, который когда-то распечатали, а потом отсканировали заново - даже если качество печати было хорошим. Смешанный вариант тоже возможен: часть страниц текстовые, часть - картинки (например, скан подписанного листа среди набранного текста договора).
По умолчанию сервис распознаёт текст локальным движком Tesseract с языковыми моделями «русский + английский» - этого достаточно для большинства сканов деловых документов: договоров, актов, справок, писем. Рядом с результатом сервис показывает уровень уверенности распознавания - если он низкий, стоит проверить текст внимательнее или пересканировать документ, прежде чем использовать его дальше.
Галочка «Умное распознавание» подключает более точный внешний алгоритм (на основе Google Document AI) для сложных случаев - таблиц, счетов с рамками, документов с колонками. Он полезнее, чем базовое распознавание, но требует больше времени и применяется в пределах отдельного лимита по размеру и числу страниц файла. Если файл этому лимиту не соответствует, сервис использует локальное распознавание.
До оплаты сервис показывает предпросмотр - фрагмент текста с одной-двух страниц, распознанный локальным алгоритмом, чтобы вы могли оценить качество, прежде чем платить за весь файл. Полная обработка всех страниц (и внешнее «умное распознавание», если оно выбрано) запускается уже после подтверждения оплаты.
Точность распознавания напрямую зависит от качества исходного изображения. Если ошибок много, попробуйте включить «Умное распознавание» - для сложных сканов оно точнее базового. Если это не помогло, вероятная причина - низкое качество самого скана, а не настроек сервиса, и здесь поможет только пересканировать документ заново.
Наклон и перспективные искажения (типично для фото с телефона) сильно снижают точность распознавания, особенно на краях страницы. По возможности переснимите документ ровно, с камерой строго над страницей и без посторонних предметов в кадре.
Яркий блик от лампы или тень от руки на части текста мешают распознать буквы под ним, даже если остальная страница читается отлично. Снимайте при равномерном рассеянном свете, без вспышки, направленной прямо в глянцевую бумагу.
Если исходный скан сохранён с низким разрешением, мелкий текст (сноски, примечания, печати) может быть физически неразличим даже для лучшего алгоритма распознавания. При повторном сканировании увеличьте разрешение (обычно от 300 dpi для убористого текста).
Распознавание рассчитано на печатный текст. Рукописные пометки, подписи и заполненные от руки поля могут распознаться неточно или не распознаться вовсе - это стоит перепроверить и при необходимости вписать вручную уже в готовом DOCX.
Для таблиц в сканах включите режим «Сохранить расположение» вместо «Обычный текст» - он старается удержать строки и колонки ближе к оригиналу, а не рассыпать их отдельными абзацами. Подробный разбор режима - на странице PDF в Word с таблицами.
Распознавание сейчас доступно для PDF до 20 страниц за один раз. Если документ длиннее, разделите его на части на странице разделить PDF и распознайте каждую часть отдельно, а потом при необходимости соберите текст DOCX-файлов вручную в один документ.
Файл с паролем на открытие сервис не сможет прочитать даже для определения типа. Сначала снимите защиту на странице разблокировать PDF, а затем загрузите получившийся файл сюда для распознавания.
| Способ | Русский язык | Что нужно | Когда удобнее |
|---|---|---|---|
| ЯсноДок онлайн | Да, есть языковая модель для русского | Браузер, ничего не устанавливать | Разовое распознавание, нужен результат в DOCX |
| Google Диск (открыть PDF как Google Документ) | Да | Аккаунт Google | Уже пользуетесь Google Диском, нужен текст в облаке |
| Adobe Acrobat (распознавание текста) | Да, с корректными настройками языка | Лицензия Acrobat Pro | Регулярная работа с PDF в компании, где Acrobat уже есть |
| Специализированные OCR-программы (ABBYY FineReader и похожие) | Да, часто с более тонкими настройками | Платная лицензия, установка | Постоянный большой поток сканов, нужна максимальная точность |
Ни один из способов не даёт стопроцентно точного распознавания на плохом скане - качество исходного изображения определяет результат сильнее, чем выбор инструмента. Разница между сервисами обычно в удобстве (нужен ли аккаунт, установка, лицензия) и в том, что делать с текстом дальше: если нужен именно редактируемый DOCX и не хочется вручную переносить текст из другого формата, онлайн-конвертер с прямым экспортом в Word экономит лишний шаг.
Распознавание скана - платная обработка: от 99 ₽ за файл в режиме обычного текста, от 149 ₽ с сохранением таблиц и расположения, цена зависит от числа страниц и показывается до оплаты. Распознавание доступно для PDF до 20 страниц, максимальный размер загружаемого файла - 100 МБ. Дополнительная опция «PDF с поиском» (текстовый слой поверх скана) доступна для файлов до 20 страниц.
Загруженный скан используется только для распознавания и конвертации, не публикуется в открытом доступе и не применяется для обучения каких-либо моделей. После скачивания результата файлы задачи удаляются с сервера автоматически.
Оплата разовая, через ЮKassa, без подписки: если распознали один скан сегодня, это не означает автоматических списаний завтра. Итоговый файл - всегда DOCX, его можно открыть в Word, LibreOffice или Google Документах.
Если документ ещё предстоит отсканировать или сфотографировать, несколько простых правил заметно повышают точность распознавания: держите камеру строго над страницей, без наклона по горизонтали и вертикали; снимайте при ровном рассеянном свете, без прямой вспышки и без резких теней от рук или предметов рядом; убедитесь, что вся страница попала в кадр целиком, включая края с номерами и печатями; используйте разрешение сканера от 300 dpi для убористого текста и мелких примечаний.
Если сканировали несколько страниц в один файл, проверьте после сборки PDF, что страницы идут в правильном порядке и ни одна не перевёрнута - перевёрнутый текст распознавание обычно не читает вовсе. Поправить порядок и поворот страниц можно на страницах порядок страниц PDF и повернуть PDF перед распознаванием.
Если фото или скан получился со слишком большим весом (несколько десятков мегабайт на страницу), стоит сначала сжать файл на странице сжать PDF - это ускорит загрузку и не должно заметно повлиять на распознавание текста.
Сервис распознает текст на сканах PDF и собирает редактируемый DOCX.
Лучше всего распознаются четкие страницы без сильного наклона, бликов, размытости и обрезанных строк.
Да, распознавание рассчитано на русский и английский текст в сканах и фото-страницах PDF.
Обычный PDF уже содержит текстовый слой, а скан хранит страницу как изображение, поэтому ему нужно распознавание.
Режим макета сохраняет примерные отступы и порядок строк. Это помогает с таблицами, но не заменяет ручную верстку сложного документа.
Да. Сервис работает с русским и английским текстом. Лучше всего подходят четкие сканы без сильного наклона.
Точность зависит от качества изображения: мелкий шрифт, тени, печати, таблицы и фото под углом могут снижать результат.
Да. Если в PDF уже есть текстовый слой, сервис может собрать DOCX без распознавания. Маленькие текстовые PDF доступны бесплатно.
Файл нужен только для распознавания и конвертации. Исходник и результат удаляются автоматически.
Распознавание рассчитано на печатный текст. Рукописные пометки и подписи могут распознаться неточно или не распознаться вовсе.
До 20 страниц в одном файле. Более длинный документ нужно разделить на части перед распознаванием.
Материал обновлён 21 августа 2026 года.
Если файл не скан, откройте обычный PDF в Word. После DOCX можно разобрать договор, проверить реквизиты или подготовить документы.
Обычные PDF, сканы, DOCX и бесплатный лимит.
Без аккаунта, с приватностью загруженных файлов.
Пошаговый разбор всех режимов обработки.
Распознавание текста и PDF с поиском.
Строки, колонки, счета и акты в DOCX.
Сделайте файл DOCX для Word и LibreOffice.
Сделайте PDF из DOCX после правок.
Сохраните скан страницами-картинками.
Соберите несколько PDF в один файл.
Извлеките нужные страницы из документа.
Сделайте PDF легче для отправки.
Удалите лишние страницы или поверните скан.
Соберите фото документов в один PDF.
Если текст со скана нужен как основа для договора, претензии или другого документа, в ЯсноДок можно сразу собрать его по шаблону, не перепечатывая вручную - с подсказками по формулировкам и ссылками на нормы там, где они уместны.