Ваши файлы остаются на устройстве

Файлы обрабатываются в браузере и не загружаются на наши серверы. Сайт может скачивать движки и отправлять события использования или обратной связи без содержимого файлов.

Как мы обращаемся с данными →

PDF в Markdown

Экспортируйте текст отчёта с поиском в Markdown, сохранив ссылки на страницы. Подходит для черновиков; таблицы и заголовки не восстанавливаются.

Учебный пример: проверьте настройки операции перед запуском.

Документы остаются на устройстве. Загрузка движков и статистика не включают содержимое файлов.

Локальные лимиты: Максимальный размер файла: 10 MB

Файлы обрабатываются в вашем браузере. Они не загружаются на этот сайт.

Практическое руководство

Сохраните текст отчёта сгруппированным по исходным страницам.

  1. Выберите PDF-отчёт с выделяемым встроенным текстом.
  2. Экспортируйте в Markdown и просмотрите заголовки страниц и блоки кода.
  3. Проверьте имена, суммы и последовательность страниц, прежде чем использовать текст повторно.

Попробуйте этот пример

Экспортируйте предложение на три страницы с поиском в Markdown. Сверьте условия цены со страницей 2 и оставьте созданные разделы по страницам при цитировании в черновике проверки.

До

  • PDF: Привет

После

  • Заголовок страницы + буквальный блок текста
Исходный файл и ожидаемый результат этой задачи. Наглядный пример.

Пример файла .md

## Page 1

    Привет из PDF, Пётр Иванов!

Выделяемый исходный текст: Привет из PDF.

Перед началом: Таблицы, схемы и оформленные заголовки из макета PDF при экспорте не восстанавливаются.

Продолжить с исходным PDF
Результат

Экспортируйте встроенный текст как буквальные блоки кода Markdown, сгруппированные по страницам. Заголовки, таблицы, изображения и исходный макет не восстанавливаются. Страницы без текста помечаются; OCR нет. Ограничения: 10 МиБ на входе, 200 страниц, 4 МиБ на выходе.

Ограничения

Не более 10 МиБ на входе, 200 страниц и 4 МиБ текста на выходе. Для сканированных документов без текстового слоя выдаётся ошибка вместо ложного успешного извлечения. Порядок чтения, колонки и шрифты могут не совпадать с визуальным макетом. Это не OCR и не PDF в Word.

Пример

Экспортируйте выделяемый текст отчёта в .md. Заголовки страниц создаются; текст PDF остаётся буквальным внутри блоков кода и не превращается в исполняемый HTML или предполагаемые таблицы. Проверьте порядок чтения, прежде чем использовать текст повторно.