Ваши файлы остаются на устройстве

Файлы обрабатываются в браузере и не загружаются на наши серверы. Сайт может скачивать движки и отправлять события использования или обратной связи без содержимого файлов.

Как мы обращаемся с данными →

PDF с поиском по тексту

Добавьте выделяемый текст на английском, испанском или русском в скан отчёта PDF до 10 страниц и 10 МиБ, чтобы его можно было искать и цитировать. Файлы остаются в браузере.

Файлы распознавания ≈ 26 МБ при первом использовании, плюс языковые данные.

PDF до 10 МиБ и 10 страниц. Текст до 1 МиБ; PDF с поиском до 30 МиБ.

Распознанный текст

Проверить на примере

Скачать пример

Выберите язык «Русский». Скачайте PDF и найдите СЧЁТ, 148,50, Пётр Иванов, ДОСТАВКА и 2048. Обе страницы должны выглядеть как в примере, а текст должен выделяться и копироваться.

Какой будет результат

Страницы по порядку распознаются как изображения. Доступны английский, русский и смешанный режим. OCR может ошибаться в буквах, числах, столбцах и таблицах: проверяйте результат. Создаётся новый PDF из изображений страниц и невидимого текстового слоя. Размер и поворот страниц сохраняются; формы, ссылки, закладки, вложения и цифровые подписи — нет. Существующий текст распознаётся заново; качество ограничено разрешением отрисовки.

Каждая страница отрисовывается до 4 мегапикселей. Загрузка и отдельный этап ограничены 90 секундами, всё задание — 10 минутами. Пустые страницы отмечаются в тексте. При ошибке или отсутствии распознанного текста файл не предлагается для скачивания.

PDF защищён?Сначала разблокируйте его известным паролем.

При первом запуске могут загрузиться файлы конвертера. Если произошёл сбой, проверьте соединение или выберите меньший файл. Отмена останавливает обработку; затем можно выбрать другой файл и повторить.

Лицензии и исходный код движков

Практическое руководство

Ищите и цитируйте текст из скана.

  1. Выберите отсканированный отчёт в пределах 10 страниц и 10 МиБ.
  2. Выберите английский, испанский или русский язык распознавания.
  3. Найдите в результате заголовок, чтобы убедиться, что текстовый слой есть.

Проверить на этом примере

Распознайте скан сводки совещания на 4 страницы на русском; поиск заголовка решения на странице 3 должен найти его в получившемся PDF.

Прежде чем начать: Распознавание охватывает только английский, испанский и русский языки, в пределах 10 страниц и 10 МиБ; сканы низкого разрешения могут давать ошибки распознавания.