חילוץ טקסט מ-PDF — מדריך שימוש שלב אחר שלב
איך להוציא טקסט דיגיטלי מתוך PDF, לבדוק עברית הפוכה ולשמור טקסט שאפשר להעתיק ולערוך.
מה עושים עם הכלי
איך להוציא טקסט דיגיטלי מתוך PDF, לבדוק עברית הפוכה ולשמור טקסט שאפשר להעתיק ולערוך.
לפני שמתחילים
נסו לבחור מילה בקורא PDF. אם העמוד הוא צילום בלבד, חילוץ רגיל לא יפענח את האותיות; במקרה כזה השתמשו ב-OCR בדיו.
אין צורך בחשבון או בקרדיטים. עיבוד הקובץ מתבצע בדפדפן במכשיר שלכם. השאירו את הלשונית פתוחה עד להשלמת הפעולה וההורדה; פתיחת העמוד עצמו דורשת חיבור לאתר.
שלב אחר שלב
שלב 1: בחרו קובץ PDF והפעילו את חילוץ הטקסט באמצעות הכפתור שמופיע מתחת לבחירת הקובץ.
שלב 2: המתינו להצגת הטקסט. בדקו את תחילת המסמך ואת המעברים בין העמודים.
שלב 3: אם העברית נראית הפוכה, בדקו את אפשרות תיקון הכיווניות המוצגת. השוו למקור, במיוחד מילים מעורבות בעברית ובאנגלית.
שלב 4: ערכו בתיבה את הטקסט שחולץ: הסירו כותרות חוזרות, תקנו מעברי שורה ושמרו פסקאות לפי המשמעות.
שלב 5: השתמשו בכפתורי ההעתקה או ההורדה שבמסך. פתחו את התוצר ובדקו שוב מספרים, תאריכים וראשי תיבות.
דוגמה להתנסות
אפשר להתחיל בדוגמה קצרה כדי להכיר את הפעולה לפני שעובדים על חומר ארוך או חשוב.
בחרו עמוד ובו המשפט ׳נרשמו 25 תלמידים׳. אחרי החילוץ ודאו שגם האותיות וגם המספר 25 נשארו בסדר הנכון.
איך בודקים את התוצאה
- עברית, רצפי מספרים ואנגלית נקראים בכיוון הנכון.
- טקסט משתי עמודות לא התחבר למשפטים מעורבבים.
- לא חסרו הערות שוליים או חלקים חשובים בגלל אופן השמירה בתוך ה-PDF.
אם משהו לא מסתדר
לא יוצא טקסט: זו עשויה להיות סריקה. המרה ל-Word לבדה לא תבצע פענוח.
סדר המילים מוזר גם אחרי תיקון: קובצי PDF שונים שומרים את הטקסט בדרכים שונות. תקנו מול המקור או עברו לפענוח תמונה כשנחוץ.
שמירה והמשך עבודה
שמרו את הטקסט הבדוק לפני המשך לסיכום או לתרגום. אחרת שגיאת החילוץ עלולה להתגלגל לכל התוצרים הבאים.