OCR ל-PDF: יצירת PDF הניתן לחיפוש
הוסיפו טקסט הניתן לבחירה באנגלית, בספרדית או ברוסית ל-PDF של דוח סרוק של עד 10 דפים ו-10 MiB, כדי שאפשר יהיה לחפש ולצטט את תוכנו. הקבצים נשארים בדפדפן שלכם.
קובצי הזיהוי ≈ 26 MB בשימוש הראשון, בתוספת נתוני שפה.
טקסט שזוהה
האם הכלי הזה היה שימושי?
נסו דוגמה
הורידו דוגמההשאירו את השפה “עברית”. הורידו את ה-PDF וחפשו חשבונית, 148.50, משלוח ו-2048. שני הדפים אמורים להיראות כמו הדוגמה, עם טקסט שאפשר לבחור ולהעתיק.
למה לצפות
כל דף מזוהה כתמונה, לפי הסדר. זמינים זיהוי באנגלית, ברוסית ובשילוב שפות. OCR עלול לקרוא לא נכון אותיות, מספרים, עמודות וטבלאות: בדקו את התוצאה. נוצר PDF חדש מתמונות הדפים שעובדו ומשכבת טקסט בלתי נראית. גודל הדף הגלוי והסיבוב נשמרים; טפסים, קישורים, סימניות, קבצים מצורפים וחתימות דיגיטליות אינם נשמרים. טקסט קיים מזוהה מחדש; איכות התמונה מוגבלת על ידי רזולוציית העיבוד.
הדפים מעובדים לתמונות של עד 4 מגה-פיקסלים כל אחד. הטעינה וכל שלב עיבוד מוגבלים ל-90 שניות; המשימה כולה נעצרת לאחר 10 דקות. דפים ריקים מסומנים בטקסט. אם העיבוד נכשל או לא זוהה טקסט, לא מוצעת הורדה.
PDF מוגן בסיסמה?בטלו קודם את הנעילה באמצעות הסיסמה שלו.
בהפעלה הראשונה ייתכן שיורדים קובצי הממיר והדבר ייקח רגע. אם הפעולה נכשלת, בדקו את החיבור או נסו קובץ קטן יותר. “ביטול” עוצר את העיבוד הפעיל; אפשר לבחור קובץ אחר ולנסות שוב.
מדריך מעשי
חיפוש וציטוט טקסט מהסריקה.
- בחרו את הדוח הסרוק, בגבולות 10 דפים ו-10 MiB.
- בחרו אנגלית, ספרדית או רוסית לזיהוי.
- חפשו כותרת בתוצאה כדי לאשר את שכבת הטקסט.
נסו את הדוגמה הזו
בצעו זיהוי טקסט בסיכום פגישה סרוק בן 4 דפים באנגלית; חיפוש כותרת של החלטה בדף 3 אמור למצוא אותה ב-PDF שנוצר.
לפני שמתחילים: הזיהוי כולל אנגלית, ספרדית ורוסית בלבד, בגבולות 10 דפים ו-10 MiB; סריקות ברזולוציה נמוכה עלולות לגרום לשגיאות זיהוי.