OCR PDF: učini PDF pretraživim
OCR PDF: dodaj tekst za označavanje na hrvatskom, engleskom, španjolskom ili ruskom u skenirani PDF izvješća do 10 stranica i 10 MiB radi pretraživanja. Tvoje datoteke ostaju u tvom pregledniku.
Datoteke za prepoznavanje ≈ 26 MB pri prvom korištenju, uz jezične podatke.
Prepoznati tekst
Je li ti ovaj alat bio koristan?
Isprobaj primjer
Preuzmi primjerNeka odabrani jezik bude Hrvatski. Preuzmi PDF i potraži RAČUN, 148,50, Đurić, DOSTAVA i 2048. Obje stranice trebaju izgledati kao primjer, s tekstom koji možeš označiti i kopirati; č, ć, đ, š i ž ostaju sačuvani.
Što možeš očekivati
Svaka se stranica redom prepoznaje kao slika. Dostupno je prepoznavanje engleskog, ruskog i mješovitog teksta. OCR može pogrešno pročitati slova, brojeve, stupce i tablice: pregledaj rezultat. Time se izrađuje novi PDF od renderiranih slika stranica i nevidljivog tekstnog sloja. Vidljiva veličina stranice i rotacija se zadržavaju; obrasci, poveznice, knjižne oznake, privici i digitalni potpisi ne zadržavaju se. Postojeći tekst prepoznaje se ponovno; kvaliteta slike ograničena je razlučivošću renderiranja.
Svaka se stranica renderira u do 4 megapiksela. Učitavanje i svaki korak obrade smiju trajati do 90 sekundi; cijeli se posao prekida nakon 10 minuta. Prazne stranice označene su u tekstu. Preuzimanje se ne nudi ako obrada ne uspije ili nijedan tekst nije prepoznat.
PDF zaštićen lozinkom?Prvo ga otključaj njegovom lozinkom.
Prvo pokretanje može preuzeti datoteke pretvornika i potrajati. Ako ne uspije, provjeri vezu ili probaj manju datoteku. „Odustani“ zaustavlja obradu u tijeku; možeš odabrati drugu datoteku i pokušati ponovno.
Licencije i izvorni kod motora
Praktičan vodič
Pretražuj i citiraj tekst iz skena.
- Odaberi skenirano izvješće, do 10 stranica i 10 MiB.
- Za prepoznavanje odaberi hrvatski, engleski, španjolski ili ruski.
- Potraži naslov u rezultatu kako bi potvrdio tekstni sloj.
Isprobaj ovaj primjer
Prepoznaj skenirani sažetak sastanka od 4 stranice na hrvatskom; pretraživanje naslova odluke na stranici 3 treba ga pronaći u dobivenom PDF-u.
Prije početka: Prepoznavanje obuhvaća samo hrvatski, engleski, španjolski i ruski, do 10 stranica i 10 MiB; skenovi niske razlučivosti mogu uzrokovati pogreške prepoznavanja.