Ваши файлы остаются на устройстве
Файлы обрабатываются в браузере и не загружаются на наши серверы. Сайт может скачивать движки и отправлять события использования или обратной связи без содержимого файлов.
Как мы обращаемся с данными →PDF в HTML
Преобразуйте PDF-отчёт с поиском в HTML: автономная текстовая копия для лёгкой проверки в любом браузере. Типографика, схемы и таблицы не сохраняются.
Учебный пример: проверьте настройки операции перед запуском.
Документы остаются на устройстве. Загрузка движков и статистика не включают содержимое файлов.
Локальные лимиты: Максимальный размер файла: 10 MB
Файлы обрабатываются в вашем браузере. Они не загружаются на этот сайт.
Практическое руководство
Проверьте формулировки отчёта в локальном файле HTML.
- Выберите отчёт с выделяемым текстом.
- Экспортируйте HTML и откройте сохранённый файл локально.
- Проверьте раздел каждой страницы и сверьте ключевые утверждения с PDF.
Попробуйте этот пример
Экспортируйте предложение на четыре страницы в HTML. Откройте его локально и убедитесь, что условия объёма и цены остались в разделах своих страниц, прежде чем рассылать текстовую версию.
До
- Страницы PDF с текстом
После
- Разделы HTML по страницам
Перед началом: Типографика отчёта, схемы и таблицы при экспорте не сохраняются; текст, существующий только в виде изображения, не распознаётся.
Продолжить с исходным PDFРезультат
Экспортируйте встроенный текст в отдельный документ HTML с одним разделом на страницу. Текст экранируется и не выполняется как HTML. Исходные шрифты, изображения, таблицы и макет не сохраняются; OCR нет. Ограничения: 10 МиБ на входе, 200 страниц, 4 МиБ на выходе.
Ограничения
Не более 10 МиБ на входе, 200 страниц и 4 МиБ текста на выходе. Для сканированных документов без текстового слоя выдаётся ошибка вместо ложного успешного извлечения. Порядок чтения, колонки и шрифты могут не совпадать с визуальным макетом. Это не OCR и не PDF в Word.
Пример
Экспортируйте отчёт с текстовым слоем и откройте скачанный HTML локально. Разделы следуют порядку страниц PDF; пустые и сканированные страницы помечаются, а не молча считаются распознанным текстом.