Яснодок
Гайд
Гайд по PDF

Как конвертировать скан в Word онлайн - пошаговая инструкция

Отсканированный документ нельзя просто открыть в Word - скан это изображение, а не текст. Чтобы получить редактируемый DOCX, нужно пройти через OCR (оптическое распознавание символов). В этом гайде - что такое OCR, от чего зависит качество распознавания и как конвертировать скан в Word онлайн.

Материал обновлён: 21 августа 2026

Юридическая гарантия

Гарантия качества разбора по вашему документу

  • Если в разборе есть фактическая ошибка чтения текста документа, исправляем отчёт бесплатно и в приоритете.
  • Если подтверждённую ошибку нельзя устранить, возвращаем оплату за разбор.
  • Методика построена на практиках договорной работы по документам РФ и регулярно обновляется.

Почему скан нельзя просто открыть в Word

Когда вы сканируете документ или фотографируете страницу, получается файл-изображение. Внутри PDF со сканом нет текстового слоя - только картинка пикселей. Word умеет работать с текстом, но не с изображениями страниц. Поэтому «Открыть в Word» даст нечитаемый результат или вообще ошибку.

Для конвертации скана в Word нужен промежуточный шаг - OCR (Optical Character Recognition, оптическое распознавание символов). Программа анализирует пиксели на изображении, определяет буквы, цифры и знаки, и собирает из них текстовый слой. Только после этого текст можно поместить в DOCX.

Важно не путать два похожих, но разных сценария. Если у вас обычный PDF, созданный из текстового файла (например, экспортированный из Word или сформированный сайтом), - в нем уже есть текстовый слой, и конвертация в DOCX происходит без OCR, почти мгновенно и часто бесплатно. Если же PDF - это отсканированная бумага или фото документа, текстового слоя нет, и без OCR не обойтись.

Что влияет на качество распознавания

1. Разрешение скана

Оптимальное разрешение для OCR - 300 dpi (точек на дюйм) или выше. При 150 dpi распознавание работает, но ошибок больше. При 72-96 dpi (типичное для экранных скриншотов) - качество заметно падает. Если вы контролируете сканирование - выставляйте 300-600 dpi.

2. Качество оригинала

Грязный или пятнистый лист, помятые края, неравномерное освещение при фотографировании - всё это снижает точность OCR. Лучший результат дает чистый контрастный текст на белом фоне.

3. Поворот страницы

Страница, отсканированная под углом - частая проблема. Современные OCR-сервисы умеют автоматически выравнивать текст, но это не всегда идеально. Лучше положить документ ровно при сканировании.

4. Язык документа

Убедитесь, что сервис распознает нужный язык. ЯсноДок поддерживает русский и английский. Смешанные документы (например, технический текст с английскими терминами) - распознаются корректно в многоязычном режиме.

5. Шрифты и форматирование

Стандартные рукописные шрифты (Times New Roman, Arial) распознаются хорошо. Декоративные шрифты, рукописный текст и плохо напечатанные документы с игольчатой матричной печатью - распознаются хуже.

Пошаговая инструкция: конвертировать скан в Word онлайн

  1. Перейдите на страницу «Скан PDF в Word»

    Адрес: yasnodoc.ru/scan-pdf-v-word/

  2. Загрузите файл

    Перетащите PDF или JPG/PNG в зону загрузки. Максимальный размер - 50 МБ.

  3. Выберите режим OCR

    Стандартный режим - для обычных сканов. Режим с сохранением расположения - если нужно сохранить структуру таблиц и колонок (стоит 149 рублей).

  4. Дождитесь обработки

    OCR занимает от нескольких секунд до минуты в зависимости от объема документа.

  5. Проверьте результат

    Посмотрите превью распознанного текста. Если качество устраивает - оплатите и скачайте DOCX.

Как улучшить качество распознавания

Несколько практических приемов перед конвертацией:

  • Скан, а не фото - отсканированный документ лучше сфотографированного. Сканер дает равномерное освещение и разрешение.
  • 300 dpi минимум - при сканировании выставьте разрешение не ниже 300 dpi.
  • Черно-белый или оттенки серого - для текстовых документов достаточно. Цветной скан дает больший файл без пользы для OCR.
  • Прямые линии - положите документ ровно, без перегиба страниц.
  • Разделите большой документ - если скан 100+ страниц, лучше разбить его на части для быстрой обработки.

Чего ожидать от результата

OCR не дает 100% точности - это нужно принять как данность. Для чистых сканов точность составляет 95-99%. Ошибки чаще всего встречаются в:

  • похожих символах: «1» и «l» (эль), «0» и «О», «с» и «o»
  • специальных знаках и знаках пунктуации
  • числовых таблицах с мелким шрифтом

Поэтому после конвертации рекомендуется просмотреть документ и исправить ошибки. При работе с юридически значимыми документами (договоры, накладные, акты) - проверяйте все числа и ключевые реквизиты.

Альтернативы онлайн-OCR

Microsoft Word (Office 365)

Word умеет открывать PDF и запускать встроенное OCR. Результат - средний, особенно для кириллицы. Для использования нужна подписка на Microsoft 365.

Adobe Acrobat

Профессиональный инструмент с хорошим OCR. Дорогая подписка. Для разовых задач избыточен.

FineReader

Один из лучших OCR-инструментов для кириллицы. Есть онлайн-версия (ABBYY FineReader Online). Подписка или платное распознавание.

Онлайн-сервисы

ЯсноДок, ilovepdf, smallpdf - удобны для разовых задач без установки программ. Плюс: не нужна подписка, работают с любого устройства.

DOCX, TXT или сохранение верстки - что выбрать

После распознавания результат можно получить в разных форматах, и выбор зависит от того, что вы собираетесь делать с текстом дальше.

Формат результатаКогда подходит
DOCX (обычный)Нужен редактируемый документ для дальнейшей правки в Word - абзацы и базовое форматирование сохраняются
DOCX с сохранением расположенияВ оригинале есть таблицы, колонки или сложная верстка, которую важно не потерять - например, бланк с полями
Обычный текст (TXT)Нужен только текст без форматирования - например, для вставки в другую систему или базу данных
PDF с текстовым слоемВажно сохранить внешний вид оригинала, но при этом сделать текст доступным для копирования и поиска

Кейс: бухгалтер переводит архив старых накладных в Word

В компании накопился архив бумажных ТОРГ-12 за прошлые годы, отсканированных в свое время на обычном МФУ в разрешении 200 dpi. Бухгалтеру нужно было получить редактируемые версии нескольких накладных для внесения исправлений и пересылки контрагенту.

Первая попытка с исходным разрешением дала много ошибок в цифрах табличной части - разрешения не хватило для мелкого шрифта граф. После пересканирования тех же документов на 300 dpi и выбора режима с сохранением расположения таблицы распознались заметно точнее, а числа в графах "количество" и "сумма" пришлось сверить вручную с оригиналом перед отправкой.

Вывод для похожей задачи: если после первой попытки распознавания результат разочаровывает - часто дело не в сервисе, а в исходном разрешении скана, и стоит пересканировать документ заново.

Как отсканировать документ телефоном для лучшего результата

Если под рукой нет сканера, телефон вполне подойдет - но с несколькими оговорками, которые сильно влияют на итоговое качество распознавания.

  • Используйте режим «Документ» или «Сканер», а не обычную фотосъемку - в большинстве приложений камеры и заметок такой режим уже есть и сам выравнивает перспективу.
  • Снимайте при дневном свете или ровном искусственном освещении - тени от руки или лампы создают темные пятна, которые OCR может принять за символы.
  • Держите камеру строго над листом, без наклона - перспективные искажения хуже поддаются автоматическому выравниванию, чем небольшой поворот.
  • Снимайте на ровной темной поверхности - контраст между листом и фоном помогает автоматическому определению границ страницы.
  • Проверьте, что весь текст в фокусе, особенно углы листа - смазанные края читаются хуже, а именно там часто оказываются даты и подписи.

Уже есть скан или фото документа? Загрузите его для распознавания - превью покажет результат до оплаты.

OCR по типам документов: на что обратить внимание

Тип документаОсобенность распознавания
Договор, многостраничный текстОбычно распознается хорошо - ровные абзацы, стандартный шрифт. Проверяйте номера пунктов и даты.
Таблицы (накладные, счета, реестры)Сложнее всего для OCR - границы ячеек и выравнивание цифр легко сбиваются. Используйте режим с сохранением структуры, если он есть.
Чеки и квитанцииМелкий шрифт и низкое качество печати термопринтера - точность ниже, особенно после того как чек начинает выцветать со временем.
Рукописный текстРаспознается заметно хуже печатного - точность сильно зависит от почерка, для важных документов лучше перепечатать вручную.
Печати и штампы поверх текстаСимволы под печатью или штампом могут не распознаться - при возможности сканируйте экземпляр без наложений или сверяйте эти места вручную.

OCR для документов с печатью и подписью

Отдельный частый случай - нужно распознать не пустой бланк, а уже подписанный и проштампованный документ (договор, акт, доверенность). Здесь стоит учитывать несколько особенностей.

  • Рукописная подпись не распознается как текст - она остается изображением (при сохранении расположения) или просто пропадает (при обычном текстовом режиме). Если подпись важно сохранить визуально, выбирайте формат PDF с текстовым слоем, а не «чистый» DOCX.
  • Печать поверх текста может закрыть часть символов - если под печатью оказались важные цифры (например, сумма или дата), эти места нужно свериться с оригиналом вручную.
  • Синие чернила на светлом фоне обычно распознаются не хуже черного текста - контраст важнее цвета как такового.
  • Если нужен именно текст документа для работы (например, вставить формулировки договора в новый шаблон) - распознавайте только текстовую часть, а подпись и печать оставьте на скане как визуальное подтверждение, приложенное отдельно.

Что делать, если результат распознавания получился плохим

  1. Проверьте исходный скан - если само изображение размыто или слишком темное, любой OCR даст плохой результат независимо от сервиса.
  2. Пересканируйте с более высоким разрешением - минимум 300 dpi, а для мелкого шрифта лучше 400-600 dpi.
  3. Разделите документ на части, если это большой файл смешанного качества - иногда несколько страниц портят общий результат.
  4. Сверьте вручную ключевые данные - суммы, даты, реквизиты - именно они чаще всего искажаются при распознавании, даже если весь остальной текст читается верно.
  5. Для критичных документов используйте оригинал, а не восстановленный через OCR текст, как источник истины при спорах - результат распознавания это удобная рабочая копия, а не замена подлиннику.

Типичные ошибки при конвертации скана в Word

  • Сканируют в низком разрешении «для скорости» - экономия пары секунд на сканировании оборачивается минутами ручной правки текста после распознавания.
  • Фотографируют документ под углом без использования режима «Документ» - перспективные искажения снижают точность даже у хорошего OCR.
  • Не проверяют результат перед использованием - особенно опасно для документов с цифрами: суммами, датами, номерами договоров.
  • Пытаются распознать документ с водяными знаками или на цветном фоне без предварительной подготовки - фон может «зашуметь» и испортить распознавание чистого текста.
  • Загружают файл целиком, если нужен только один раздел - для больших многостраничных сканов дешевле и быстрее распознать только нужные страницы, если сервис это позволяет.

Несколько файлов сразу: как быть с пакетной обработкой

Если нужно распознать не один документ, а сразу несколько (например, партию однотипных счетов или накладных), есть два практических подхода.

  • Объединить сканы в один PDF перед загрузкой, если документы похожи по формату - это удобнее, чем загружать каждый файл отдельно, особенно если сервис берет оплату за операцию, а не за количество страниц.
  • Обрабатывать по одному, если документы разного типа или качества - так проще оценить результат по каждому и не тратить время на пересканирование всей пачки из-за одной неудачной страницы.

Нужно быстро собрать несколько сканов в один файл перед распознаванием? Загляните в гайд как объединить PDF - это можно сделать за пару кликов.

Безопасность: что происходит с загруженным файлом

Часто спрашивают, можно ли доверять онлайн-сервису загрузку скана с личными данными - паспортом, договором, финансовыми документами. Несколько практических принципов, на которые стоит смотреть у любого такого сервиса, включая ЯсноДок:

  • Файл используется только для формирования результата распознавания - конвертации в DOCX или текст, а не для иных целей.
  • Передача файла на сервер и обратно идет по защищенному соединению (HTTPS).
  • Не публикуйте скан документа в открытых источниках и не пересылайте по незащищенным каналам, если в нем есть чувствительные данные - это общее правило, а не специфика конкретного сервиса.
  • Если документ содержит особо чувствительные данные (паспорт, медицинские сведения) - при возможности закрасьте или уберите не относящиеся к задаче поля перед загрузкой.

Вопросы и ответы

Почему скан PDF нельзя просто открыть в Word?

Скан - это изображение страницы, а не текст. Word работает с текстом. Нужно сначала распознать скан через OCR.

Конвертация скана в Word бесплатна?

На ЯсноДок маленькие текстовые PDF конвертируются бесплатно. Для сканов OCR - 99 рублей, так как распознавание требует серьезных вычислительных ресурсов.

Какой формат скана подойдет для OCR?

PDF, JPG, PNG. Оптимально - PDF со сканом 300 dpi. Фото с телефона работает, но хуже сканера.

Поддерживается ли русский язык при распознавании?

Да. Сервис ЯсноДок распознает русский и английский текст, включая смешанные документы.

Можно ли распознать фото документа с телефона, а не скан со сканера?

Да, но результат обычно хуже, чем со сканера. Используйте режим «Документ» в камере, снимайте при хорошем освещении строго сверху, без наклона.

Почему таблицы распознаются хуже обычного текста?

OCR должен не только прочитать символы, но и правильно определить границы ячеек и порядок столбцов - это сложнее, чем распознать сплошной текст, поэтому в таблицах чаще встречаются ошибки выравнивания.

Безопасно ли загружать паспорт или договор с личными данными для распознавания?

Файл используется только для формирования результата, передача идет по защищенному соединению. Дополнительно можно закрасить не относящиеся к задаче поля перед загрузкой, если данные особо чувствительны.

Что делать, если после распознавания в тексте есть ошибки?

Просмотрите документ и исправьте вручную - особенно числа, даты и реквизиты. OCR не дает 100% точности даже на чистых сканах, поэтому финальная проверка человеком обязательна для важных документов.

Можно ли распознать рукописный текст?

Технически да, но точность заметно ниже, чем для печатного текста, и сильно зависит от почерка. Для важных рукописных документов результат лучше перепроверить построчно или перепечатать вручную.

Действие

Распознать скан прямо сейчас

Загрузите скан PDF и получите редактируемый DOCX.
Распознать скан PDF