הקבצים שלכם נשארים במכשיר שלכם

הקבצים מעובדים בדפדפן שלכם ואינם מועלים לשרתים שלנו. האתר עשוי להוריד מנועי עיבוד ולשלוח אירועי שימוש או משוב ללא תוכן הקבצים.

כיצד אנו מטפלים בנתונים שלכם →

OCR ל-PDF: יצירת PDF הניתן לחיפוש

הוסיפו טקסט הניתן לבחירה באנגלית, בספרדית או ברוסית ל-PDF של דוח סרוק של עד 10 דפים ו-10 MiB, כדי שאפשר יהיה לחפש ולצטט את תוכנו. הקבצים נשארים בדפדפן שלכם.

קובצי הזיהוי ≈ 26 MB בשימוש הראשון, בתוספת נתוני שפה.

PDF · עד 10 MiB, 10 דפים. טקסט עד 1 MiB; PDF הניתן לחיפוש עד 30 MiB.

טקסט שזוהה

נסו דוגמה

הורידו דוגמה

השאירו את השפה “עברית”. הורידו את ה-PDF וחפשו חשבונית, 148.50, משלוח ו-2048. שני הדפים אמורים להיראות כמו הדוגמה, עם טקסט שאפשר לבחור ולהעתיק.

למה לצפות

כל דף מזוהה כתמונה, לפי הסדר. זמינים זיהוי באנגלית, ברוסית ובשילוב שפות. OCR עלול לקרוא לא נכון אותיות, מספרים, עמודות וטבלאות: בדקו את התוצאה. נוצר PDF חדש מתמונות הדפים שעובדו ומשכבת טקסט בלתי נראית. גודל הדף הגלוי והסיבוב נשמרים; טפסים, קישורים, סימניות, קבצים מצורפים וחתימות דיגיטליות אינם נשמרים. טקסט קיים מזוהה מחדש; איכות התמונה מוגבלת על ידי רזולוציית העיבוד.

הדפים מעובדים לתמונות של עד 4 מגה-פיקסלים כל אחד. הטעינה וכל שלב עיבוד מוגבלים ל-90 שניות; המשימה כולה נעצרת לאחר 10 דקות. דפים ריקים מסומנים בטקסט. אם העיבוד נכשל או לא זוהה טקסט, לא מוצעת הורדה.

PDF מוגן בסיסמה?בטלו קודם את הנעילה באמצעות הסיסמה שלו.

בהפעלה הראשונה ייתכן שיורדים קובצי הממיר והדבר ייקח רגע. אם הפעולה נכשלת, בדקו את החיבור או נסו קובץ קטן יותר. “ביטול” עוצר את העיבוד הפעיל; אפשר לבחור קובץ אחר ולנסות שוב.

רישיונות מנועים וקוד מקור

מדריך מעשי

חיפוש וציטוט טקסט מהסריקה.

  1. בחרו את הדוח הסרוק, בגבולות 10 דפים ו-10 MiB.
  2. בחרו אנגלית, ספרדית או רוסית לזיהוי.
  3. חפשו כותרת בתוצאה כדי לאשר את שכבת הטקסט.

נסו את הדוגמה הזו

בצעו זיהוי טקסט בסיכום פגישה סרוק בן 4 דפים באנגלית; חיפוש כותרת של החלטה בדף 3 אמור למצוא אותה ב-PDF שנוצר.

לפני שמתחילים: הזיהוי כולל אנגלית, ספרדית ורוסית בלבד, בגבולות 10 דפים ו-10 MiB; סריקות ברזולוציה נמוכה עלולות לגרום לשגיאות זיהוי.