Перейти к содержимому
DCDiplomCraft
Заказать реферат →

Бесплатно · без регистрации

Распознать текст со скана

Скан PDF или фото страницы станет текстом: PDF с поиском по тексту, редактируемый Word или TXT.

  • Русский и английский
  • PDF, Word или TXT
  • До 30 страниц
или перетащите файлы сюдаPDF-скан или фото · до 30 страниц

Русский и английский. Точность зависит от скана – готовый текст стоит вычитать.

Цена и лимиты
  • Бесплатно, без регистрации
  • Конвертация – до 20 файлов в день с одного IP-адреса
  • Проверка структуры – до 5 файлов в день с одного IP-адреса
  • Файл до 25 МБ, до 20 картинок в один PDF
  • Готовый файл хранится сутки, потом удаляется
  • Вёрстка сложных PDF после перевода в Word может отличаться
до 20 файлов в день

Когда нужно распознавание

В скане нет текста – только картинки страниц. Его нельзя скопировать, найти в нём слово, перевести в редактируемый Word. Так выглядят отсканированные методички, старые статьи из библиотеки, фото конспекта или договора с практики. Распознавание (OCR) находит буквы на картинке и превращает их в текст.

Сервер рисует каждую страницу в разрешении 300 DPI и распознаёт её программой Tesseract с русским и английским языками. За раз – до 30 страниц: один PDF или несколько фото, порядок фото – как вы их добавили.

Какой результат выбрать

PDF с текстовым слоем выглядит как исходный скан, но в нём работает поиск и выделение текста – удобно для списка литературы и цитат. Word (.docx) даёт редактируемый текст абзацами, каждая страница скана начинается с новой страницы документа. TXT – просто текст без оформления, например чтобы вставить его в другую программу.

Если у PDF уже есть текстовый слой, инструмент предупредит об этом до запуска: распознавание такому файлу обычно не нужно, текст можно скопировать или перевести в Word напрямую. А в конвертере PDF в Word и в других PDF-инструментах скан определяется по отсутствию текста и отмечается плашкой со ссылкой сюда.

Насколько точно

Точность зависит от скана. Чёткий печатный текст распознаётся хорошо, а размытое фото, рукопись, мелкий шрифт, таблицы и формулы – с ошибками. Поэтому готовый текст обязательно стоит вычитать. Перед распознаванием помогает выровнять скан: повернуть страницы в инструменте «Упорядочить страницы» и снять фото при хорошем свете, без тени и наклона.

Если на сервере распознавание временно недоступно, инструмент скажет об этом сразу, до загрузки.

Все инструменты – на странице «PDF-инструменты». Конвертировать Word, Excel и картинки или проверить структуру документа можно в «Инструментах для файлов».

Частые вопросы

Сколько это стоит?

Бесплатно и без регистрации: до 20 обработок в день с одного IP-адреса – общий лимит с конвертером файлов. Файл до 25 МБ.

Распознаётся ли рукописный текст?

Плохо: программа рассчитана на печатный текст. Рукопись и неразборчивые сканы дадут много ошибок.

Какие языки поддерживаются?

Русский и английский – одновременно, в одном документе.

Где хранятся мои файлы?

Исходник и результат хранятся сутки, потом удаляются. Удалить их раньше можно кнопкой «Удалить с сервера сейчас» под результатом.

Нужна не обработка PDF, а работа целиком?

DiplomCraft напишет курсовую, диплом или реферат: реальные источники, оформление по ГОСТ; план курсовой и диплома – бесплатно до оплаты.

Заказать работу – от 50 ₽/стр.

Условия и цена: курсовая работа на заказ

Другие PDF-инструменты