Canon TR8520: טקסט OCR חסר או משובש בסריקה

Canon TR8520: טקסט OCR חסר או משובש בסריקה

סריקה לתמונה אינה יוצרת בהכרח טקסט שניתן לערוך. בדגם TR8520 וכלי IJ Scan Utility מתאים בודקים את יעד OCR ואת שפת המסמך, ואז מאמתים ידנית את התוצאה.

מתאים ל: Canon TR8520, Windows ו-IJ Scan Utility עם Start OCR נתמך. הוראות אלה אינן ל-IJ Scan Utility Lite ב-Mac או לכל דגם Canon.

איך מזהים את התקלה?

  • הסריקה תקינה כתמונה אך אין טקסט לעריכה
  • OCR מחזיר אותיות שגויות או פסקאות לא קריאות

מה יכול לגרום לכך?

  • נבחרה פעולת תמונה במקום OCR
  • שפת המסמך אינה נתמכת או נבחרה אחרת
  • מקור נטוי, מטושטש או כתב יד

לפני שמתחילים

  • ההליך מבוסס על Canon TR8520 ו-IJ Scan Utility ב-Windows המתואר במקור.
  • הכינו דוגמה מודפסת קצרה בשפה שקיימת ב-Document Language; אין הבטחה לתמיכה בעברית בכל גרסה.
  • שמרו את תמונת הסריקה המקורית. OCR עלול לטעות במספרים, שמות וסכומים ולכן אין להסתמך עליו בלי בדיקה.

בדיקה ופתרון — שלב אחר שלב

1. אמתו את מטרת הסריקה

הבחינו בין תמונת PDF לבין טקסט לעריכה. פתחו את קובץ הסריקה ובדקו אם הוא רק תמונה. במדריך זה המטרה היא חילוץ טקסט באמצעות כלי OCR, לא שיפור איכות ההדפסה.

תוצאה צפויה: ידוע איזה סוג תוצאה חסר ומה צריך לקבל.

אם זה לא קרה: אם נדרש PDF לחיפוש דווקא, בדקו אפשרות מתאימה לשמירה בגרסת התוכנה.

2. בדקו איכות מקור

הניחו מסמך מודפס נקי וישר על הזכוכית. סרקו דוגמה ובדקו שהאותיות חדות ולא חתוכות. מקור קטן מאוד, דהוי, מעוצב או בכתב יד קשה יותר לזיהוי.

תוצאה צפויה: תמונת בסיס קריאה ומציגה את כל שורות הטקסט.

אם זה לא קרה: אם התמונה מטושטשת, תקנו את הסריקה לפני שינוי שפת OCR.

3. בחרו שפה נתמכת

ב-IJ Scan Utility פתחו Settings ו-General Settings ובחרו ב-Document Language את שפת הטקסט הרצויה. השתמשו רק בשפה שמופיעה בפועל ברשימה של הגרסה המותקנת.

תוצאה צפויה: מנוע הזיהוי מוגדר לשפה שהמסמך מכיל.

אם זה לא קרה: אם השפה חסרה, אל תבחרו שפה אחרת כפתרון; נדרש כלי OCR שתומך בה.

4. הפעילו יעד OCR

בהגדרות Document Scan בחרו Start OCR תחת Application Settings ואת האפליקציה המתאימה לתוצאה. כאשר אין אפליקציה תואמת, הכלי המתועד יכול להציג טקסט בעורך טקסט.

תוצאה צפויה: סריקה חדשה מפעילה חילוץ טקסט במקום שמירת תמונה בלבד.

אם זה לא קרה: אם הבחירה חסרה, בדקו את גרסת IJ Scan Utility ותאימותה לדגם.

5. השוו ידנית למקור

סרקו מחדש את הדוגמה וקראו את הטקסט שהתקבל מול המקור, כולל סימני פיסוק, מספרים ושורות. אם כמה מסמכים יוצאים בקובץ טקסט אחד, הוסיפו סימון הפרדה לפני שימוש.

תוצאה צפויה: הטקסט קריא וטעויות שאותרו מתוקנות לפני שימוש.

אם זה לא קרה: אם גם מקור חד בשפה נתמכת נכשל, תעדו הגדרות ודוגמה לא רגישה לתמיכה.

מתי עוצרים ופונים לשירות?

פנו לתמיכה אם OCR אינו נפתח למרות כלי תואם ויעד מוגדר, או אם מקור מודפס חד בשפה נתמכת נכשל שוב ושוב. שפה שאינה ברשימה היא מגבלת כלי ומצריכה פתרון OCR מתאים ולא תיקון במדפסת.

איך מצמצמים את הסיכוי לחזרה?

  • שמרו תמונת מקור לצד הטקסט המחולץ.
  • בחרו שפה לפני כל סדרת מסמכים ובדקו ידנית מידע בעל משמעות כספית או אישית.

שאלות נפוצות

האם סריקת PDF רגילה תמיד מאפשרת חיפוש?

לא. PDF יכול להכיל תמונות בלבד, ללא שכבת טקסט מזוהה.

האם כל שפה נתמכת ב-Canon OCR?

לא בהכרח. צריך לבדוק את רשימת Document Language בגרסה הנתמכת; אין להניח תמיכה בעברית ללא בדיקה.

מקורות והוראות יצרן

הוראות הדגם המדויק ותנאי האחריות גוברים על הנחיה כללית. תפריטי תוכנה ותכונות עשויים להשתנות בין גרסאות.

מדריכים קשורים