Ваши файлы остаются на устройстве

Файлы обрабатываются в браузере и не загружаются на наши серверы. Сайт может скачивать движки и отправлять события использования или обратной связи без содержимого файлов.

Как мы обращаемся с данными →

PDF в HTML

Преобразуйте PDF-отчёт с поиском в HTML: автономная текстовая копия для лёгкой проверки в любом браузере. Типографика, схемы и таблицы не сохраняются.

Учебный пример: проверьте настройки операции перед запуском.

Документы остаются на устройстве. Загрузка движков и статистика не включают содержимое файлов.

Локальные лимиты: Максимальный размер файла: 10 MB

Файлы обрабатываются в вашем браузере. Они не загружаются на этот сайт.

Практическое руководство

Проверьте формулировки отчёта в локальном файле HTML.

  1. Выберите отчёт с выделяемым текстом.
  2. Экспортируйте HTML и откройте сохранённый файл локально.
  3. Проверьте раздел каждой страницы и сверьте ключевые утверждения с PDF.

Попробуйте этот пример

Экспортируйте предложение на четыре страницы в HTML. Откройте его локально и убедитесь, что условия объёма и цены остались в разделах своих страниц, прежде чем рассылать текстовую версию.

До

  • Страницы PDF с текстом

После

  • Разделы HTML по страницам
Исходный файл и ожидаемый результат этой задачи. Наглядный пример.

Перед началом: Типографика отчёта, схемы и таблицы при экспорте не сохраняются; текст, существующий только в виде изображения, не распознаётся.

Продолжить с исходным PDF
Результат

Экспортируйте встроенный текст в отдельный документ HTML с одним разделом на страницу. Текст экранируется и не выполняется как HTML. Исходные шрифты, изображения, таблицы и макет не сохраняются; OCR нет. Ограничения: 10 МиБ на входе, 200 страниц, 4 МиБ на выходе.

Ограничения

Не более 10 МиБ на входе, 200 страниц и 4 МиБ текста на выходе. Для сканированных документов без текстового слоя выдаётся ошибка вместо ложного успешного извлечения. Порядок чтения, колонки и шрифты могут не совпадать с визуальным макетом. Это не OCR и не PDF в Word.

Пример

Экспортируйте отчёт с текстовым слоем и откройте скачанный HTML локально. Разделы следуют порядку страниц PDF; пустые и сканированные страницы помечаются, а не молча считаются распознанным текстом.