Fájljai az eszközén maradnak

A fájlokat a böngészőjében dolgozzuk fel, és nem töltjük fel a szervereinkre. Az oldal letölthet feldolgozómotorokat, és a fájlok tartalma nélkül küldhet használati vagy visszajelzési eseményeket.

Hogyan kezeljük az adatait →

PDF-ből HTML

Alakítson egy kereshető jelentés-PDF-et HTML-lé: önálló szöveges másolat könnyű átnézéshez bármely böngészőben. Tipográfia és táblázatok nélkül.

Szintetikus példa – futtatás előtt ellenőrizze a művelet beállításait.

A dokumentumai ezen az eszközön maradnak. Az eszközök letöltése és a használati statisztikák nem tartalmazzák a fájlok tartalmát.

Korlátok az eszközén: Legnagyobb fájlméret: 10 MB

A fájlokat a böngésző dolgozza fel. Nem kerülnek feltöltésre erre a webhelyre.

Gyakorlati útmutató

A jelentés szövegének átnézése helyi HTML-fájlban.

  1. Válasszon egy kijelölhető szöveget tartalmazó jelentést.
  2. Exportáljon HTML-t, és nyissa meg a mentett fájlt helyben.
  3. Nézze át az egyes oldalszakaszokat, és a kritikus állításokat vesse össze a PDF-fel.

Próbálja ki ezt a példát

Exportáljon egy négyoldalas ajánlatot HTML-be. Nyissa meg helyben, és a szöveges nézet terjesztése előtt ellenőrizze, hogy a terjedelmi és az árra vonatkozó kijelentések az oldalszakaszaikban maradnak.

Előtte

  • PDF-oldalak szöveggel

Utána

  • HTML oldalszakaszok
A feladat bemeneti fájlja és a várt eredmény. Szemléltető példa.

Mielőtt elkezdi: Az exportálás nem őrzi meg a jelentés tipográfiáját, ábráit és táblázatait; a csak képként létező szöveget nem ismeri fel.

Folytatás a forrás-PDF-fel
Mit kap

A beágyazott szöveget önálló HTML-dokumentumba exportálja, oldalanként egy szakasszal. A szöveg escape-elt, nem HTML-ként fut le. Az eredeti betűtípusok, képek, táblázatok és az elrendezés nem maradnak meg; nincs OCR. Korlátok: 10 MiB bemenet, 200 oldal, 4 MiB kimenet.

Korlátok és fontos részletek

Legfeljebb 10 MiB bemenet, 200 oldal és 4 MiB szövegkimenet. A szövegréteg nélküli beolvasott dokumentumoknál hibaüzenet jelenik meg látszatsikeres kinyerés helyett. Az olvasási sorrend, az oszlopok és a betűtípusok eltérhetnek a vizuális elrendezéstől. Ez nem OCR, és nem PDF-ből Word átalakítás.

Példa

Exportáljon egy szövegalapú jelentést, és nyissa meg a letöltött HTML-t helyben. A szakaszok a PDF oldalsorrendjét követik; az üres és a beolvasott oldalak jelölést kapnak, nem kezeli őket csendben felismert szövegként.