Je bestanden blijven op je apparaat

Bestanden worden in je browser verwerkt en niet naar onze servers geüpload. De site kan verwerkingsengines downloaden en gebruiks- of feedbackgebeurtenissen verzenden zonder bestandsinhoud.

Zo gaan we met je gegevens om →

PDF naar HTML

Zet een doorzoekbare rapport-PDF om naar HTML: een zelfstandige tekstkopie voor een lichte beoordeling in elke browser. Opmaak en tabellen vervallen.

Synthetisch voorbeeld – controleer de instellingen van de bewerking voordat je die uitvoert.

Je documenten blijven op dit apparaat. Downloads van de tools en gebruiksstatistieken bevatten geen bestandsinhoud.

Limieten op je apparaat: Max. grootte van één bestand: 10 MB

Je bestanden worden in je browser verwerkt. Ze worden niet naar deze site geüpload.

Praktische gids

Bekijk de rapporttekst in een lokaal HTML-bestand.

  1. Kies een rapport met selecteerbare tekst.
  2. Exporteer HTML en open het opgeslagen bestand lokaal.
  3. Controleer elke paginasectie en vergelijk cruciale uitspraken met de PDF.

Probeer dit voorbeeld

Exporteer een voorstel van vier pagina's naar HTML. Open het lokaal en controleer of de uitspraken over reikwijdte en prijs in hun paginasecties blijven staan voordat je de tekstweergave rondstuurt.

Voor

  • PDF-pagina's met tekst

Na

  • HTML-paginasecties
Invoer en verwacht resultaat van deze taak. Illustratief voorbeeld.

Voordat je begint: De export behoudt de typografie, diagrammen of tabellen van het rapport niet; tekst die alleen als afbeelding bestaat wordt niet herkend.

Verdergaan met de bron-PDF
Resultaat

Exporteer ingebedde tekst naar een zelfstandig HTML-document met één sectie per pagina. Tekst wordt geëscaped en niet als HTML uitgevoerd. Oorspronkelijke lettertypen, afbeeldingen, tabellen en opmaak blijven niet behouden; geen OCR. Limieten: 10 MiB invoer, 200 pagina's, 4 MiB uitvoer.

Limieten en belangrijke details

Maximaal 10 MiB invoer, 200 pagina's en 4 MiB tekstuitvoer. Gescande documenten zonder tekstlaag geven een foutmelding in plaats van een schijnbaar geslaagde extractie. Leesvolgorde, kolommen en lettertypen komen mogelijk niet overeen met de zichtbare opmaak. Dit is geen OCR en geen PDF naar Word.

Voorbeeld

Exporteer een rapport op tekstbasis en open de gedownloade HTML lokaal. De secties volgen de paginavolgorde van de PDF; lege of gescande pagina's krijgen een label en worden niet stilzwijgend als herkende tekst behandeld.