CodeKitHub
כלי PDF

המרת PDF ל-Excel

עודכן לאחרונה:

גררו קובץ PDF וקבלו בחזרה גיליון Excel. הכלי מחלץ את הטקסט מכל עמוד ומסדר אותו בשורות ובעמודות, תוך ניחוש הפרדות בין עמודות לפי הרווחים בין המילים — נקודת התחלה שימושית מאוד לחילוץ נתונים מקובצי PDF, אך אינה תחליף לתוכנת זיהוי טבלאות אמיתית בפריסות מורכבות. הכול פועל באופן מקומי בדפדפן שלכם; הקובץ לעולם אינו מועלה לשרת.

Note: this tool guesses column boundaries from the whitespace gaps between text on each line, and lays out each page as rows and columns in Excel. It works well on regularly-structured tables; on merged cells or irregular layouts the split can be inaccurate — review and adjust the result after downloading.

מהו הכלי הזה?

הכלי הזה קורא את תוכן הטקסט של כל עמוד בקובץ PDF ובונה אותו מחדש כשורות ועמודות בחוברת עבודה של Excel, גיליון אחד לכל עמוד. הוא מקבץ את הטקסט לשורות לפי מיקום אנכי, ולאחר מכן מפצל כל שורה לתאים במקומות שבהם קיים רווח אופקי רחב בין מילים — סימן סביר לכך ש'כאן מתחילה עמודה חדשה', ולא סתם רווח.

השיטה הזו עובדת היטב בקובצי PDF עם טבלאות או רשימות פשוטות ומרווחות באופן אחיד — חשבוניות, מחירונים, דוחות מיוצאים. היא אינה משחזרת בצורה אמינה פריסות מורכבות עם תאים ממוזגים, תוכן תא רב-שורתי, או טבלאות ללא רווחים ברורים בין העמודות; במקרים כאלה כדאי לצפות שתצטרכו להתאים את התוצאה ידנית לאחר ההורדה.

למה להשתמש בו?

  • הופך טבלאות ורשימות מ-PDF לקובץ Excel הניתן לעריכה ולמיון, במקום להקליד מחדש את הנתונים ידנית.
  • ללא הרשמה, ללא סימן מים, לגמרי בחינם.
  • מקומי ופרטי — קובץ ה-PDF שלכם לעולם אינו מועלה לשום שרת.
  • גיליון אחד לכל עמוד PDF, כך שמסמכים מרובי עמודים נשארים מסודרים.

איך להשתמש

  1. לחצו על התיבה או גררו לתוכה קובץ PDF.
  2. המתינו בזמן שהכלי מחלץ את הטקסט ומסדר אותו בשורות ובעמודות.
  3. הורידו את קובץ ה-xlsx. ופתחו אותו ב-Excel, ב-Google Sheets, או בכל אפליקציית גיליונות אחרת.
  4. בדקו את חלוקת העמודות — בטבלאות מורכבות ייתכן שתצטרכו להתאים ידנית כמה תאים.

דוגמה

קלט

invoice.pdf — חשבונית בעמוד אחד עם טבלת שורות פריטים

פלט

invoice.xlsx — גיליון אחד שבו כל שורת חשבונית היא שורה בטבלה, עם עמודות לפריט, כמות ומחיר

הדיוק תלוי במידה רבה באופן פריסת קובץ ה-PDF המקורי — טבלאות פשוטות עם רווחי עמודות ברורים מומרות בצורה נקייה, בעוד שטבלאות צפופות או בעלות מרווחים לא סדירים עשויות לדרוש ניקוי ידני.

שאלות נפוצות

מדוע חלק מהעמודות שלי ממוזגות יחד או מפוצלות בצורה שגויה?

הכלי מנחש את גבולות העמודות לפי הרווח האופקי בין המילים בשכבת הטקסט של קובץ ה-PDF — אין לו גישה למבנה הטבלה המקורי של ה-PDF (רוב קובצי ה-PDF אינם שומרים אחד כזה). אם העמודות קרובות זו לזו או שהטבלה משתמשת ברווחים חריגים, הניחוש עלול להיות שגוי. בדקו את התוצאה והתאימו ידנית במידת הצורך.

האם זה עובד על קובצי PDF סרוקים?

לא. הכלי הזה קורא את שכבת הטקסט המוטמעת בקובץ ה-PDF; מסמכים סרוקים הם תמונות בלבד ואין בהם טקסט שניתן לחלץ. הריצו קודם כלי OCR ל-PDF כדי להוסיף שכבת טקסט, ורק אז השתמשו בממיר הזה.

האם קובץ ה-PDF שלי מועלה לשרת?

לא. גם חילוץ הטקסט וגם יצירת קובץ ה-Excel מתבצעים באופן מקומי בדפדפן שלכם באמצעות JavaScript. הקובץ שלכם לעולם אינו עוזב את המכשיר שלכם.

האם זה שומר על עיצוב התאים, הצבעים או התאים הממוזגים מהטבלה המקורית?

לא. הפלט הוא טקסט פשוט המסודר ברשת — גופנים, צבעים, מסגרות ותאים ממוזגים מקובץ ה-PDF המקורי אינם נשמרים.

כלים קשורים