זיהוי טקסט מקובצי PDF סרוקים מבוססי תמונה באופן מקומי בדפדפן — רב-לשוני, בחירת טווח עמודים, ייצוא TXT. ללא העלאה לשרת כלשהו, חינמי לחלוטין, ללא הרשמה.
איך להשתמש
1
העלה קובץ PDF סרוק
העלה קובץ PDF סרוק או מבוסס תמונה, ולאחר מכן בחר את השפה וטווח העמודים
2
זיהוי מקומי
העמודים מעובדים ומזוהים ב-OCR אחד אחד בדפדפן שלך — שום דבר לא מועלה, ההתקדמות מוצגת בזמן אמת
3
העתק או הורד
התוצאות זורמות לתצוגה המקדימה — העתק או הורד כקובץ TXT, אין צורך בהתחברות
שאלות נפוצות
למה כל עמוד לוקח 5-15 שניות?
מנוע ה-OCR פועל כולו בתוך הדפדפן שלך (ללא מעורבות שרת). כל עמוד דורש עיבוד, עיבוד מקדים וזיהוי, כך שהמהירות תלויה במכשיר שלך. ההרצה הראשונה עבור שפה מסוימת מורידה גם את נתוני השפה שלה פעם אחת (ונשמרת בזיכרון מטמון לאחר מכן).
במה זה שונה מ-PDF לטקסט?
הכלי PDF לטקסט קורא את שכבת הטקסט המובנית של הקובץ — מיידי, אבל לסריקות אין שכבה כזו. הכלי הזה קורא את תמונות העמודים באמצעות OCR, ומיועד למסמכים סרוקים ומצולמים. שני הכלים משלימים זה את זה.
עד כמה זה מדויק?
טקסט מודפס נקי מזוהה היטב; כתב יד, תמונות מטושטשות וטבלאות מורכבות מפחיתים את הדיוק. בחרו את השפה הנכונה, סרקו ב-300 DPI, ובדקו היטב מספרים ושמות חשובים לאחר מכן.
האם הקבצים שלי מועלים לשרת?
לא. העיבוד והזיהוי מתבצעים במלואם בדפדפן שלך. קבצים לעולם לא עוזבים את המכשיר שלך והזיכרון מנוקה בעת רענון. מגבלות: 30 מגה-בייט ו-30 עמודים לקובץ.
אתה מחליט אילו כלים נבנה בהמשךשלח משאלה →