CodeKitHub
PDF ხელსაწყოები

PDF-ის გადაყვანა Excel-ში

ბოლოს განახლდა:

ჩააგდეთ PDF ფაილი და უკან მიიღეთ Excel ცხრილი. ეს ინსტრუმენტი გამოიტანს ტექსტს ყოველი გვერდიდან და აწყობს მას სტრიქონებად და სვეტებად, სვეტებს შორის საზღვრებს ითვალისწინებს სიტყვებს შორის დაშორების მიხედვით — ეს ნამდვილად სასარგებლო საწყისი წერტილია PDF-იდან მონაცემების ამოღებისთვის, თუმცა ის არ ცვლის ცხრილების ნამდვილი ამოცნობის პროგრამულ უზრუნველყოფას რთული განლაგების შემთხვევაში. ყველაფერი ხდება ლოკალურად, თქვენს ბრაუზერში; ფაილი არასდროს იტვირთება სერვერზე.

Note: this tool guesses column boundaries from the whitespace gaps between text on each line, and lays out each page as rows and columns in Excel. It works well on regularly-structured tables; on merged cells or irregular layouts the split can be inaccurate — review and adjust the result after downloading.

რა არის ეს ხელსაწყო?

ეს ინსტრუმენტი კითხულობს PDF-ის ყოველი გვერდის ტექსტურ შინაარსს და აღადგენს მას სტრიქონებად და სვეტებად Excel-ის სამუშაო წიგნში, თითო ფურცელი თითო გვერდზე. ის აჯგუფებს ტექსტს სტრიქონებად ვერტიკალური მდებარეობის მიხედვით, შემდეგ კი ყოფს თითოეულ სტრიქონს უჯრედებად იქ, სადაც სიტყვებს შორის ფართო ჰორიზონტალური დაშორებაა — გონივრული ნიშანი იმისა, რომ 'აქ იწყება ახალი სვეტი', და არა უბრალოდ ცარიელი ადგილი.

ეს ევრისტიკული მიდგომა კარგად მუშაობს მარტივი, თანაბრად დაშორებული ცხრილების ან სიების მქონე PDF-ებზე — ინვოისები, ფასების ჩამონათვალები, ექსპორტირებული ანგარიშები. ის სანდოდ ვერ აღადგენს რთულ განლაგებას გაერთიანებული უჯრედებით, მრავალსტრიქონიანი უჯრედის შინაარსით ან ცხრილებით, სვეტებს შორის ცხადი დაშორების გარეშე; ასეთ შემთხვევებში მოსალოდნელია, რომ გადმოწერის შემდეგ შედეგი ხელით მოგიწევთ დაზუსტება.

რატომ გამოვიყენო ის?

  • PDF-ის ცხრილებსა და სიებს აქცევს რედაქტირებად, დასალაგებელ Excel ფაილად, მონაცემების ხელით ხელახლა აკრეფის ნაცვლად.
  • რეგისტრაცია არ საჭიროებს, წყლის ნიშანი არ ჩანს, სრულიად უფასოა.
  • ლოკალური და პირადი — თქვენი PDF არასდროს იტვირთება არცერთ სერვერზე.
  • თითო ფურცელი თითო PDF გვერდზე, ისე რომ მრავალგვერდიანი დოკუმენტები ორგანიზებული რჩება.

როგორ გამოვიყენო

  1. დააჭირეთ ველს ან გადმოათრიეთ PDF ფაილი მასზე.
  2. დაელოდეთ, სანამ ინსტრუმენტი გამოიტანს ტექსტს და დააწყობს მას სტრიქონებად და სვეტებად.
  3. გადმოწერეთ .xlsx ფაილი და გახსენით ის Excel-ში, Google Sheets-ში ან ნებისმიერ სხვა ცხრილების აპლიკაციაში.
  4. გადახედეთ სვეტების დაყოფას — რთული ცხრილებისთვის შესაძლოა დაგჭირდეთ რამდენიმე უჯრედის ხელით დაზუსტება.

მაგალითი

შეყვანა

invoice.pdf — ერთგვერდიანი ინვოისი პროდუქციის სტრიქონების ცხრილით

შედეგი

invoice.xlsx — ერთი ფურცელი, სადაც ინვოისის თითოეული სტრიქონი ცალკე რიგია, სვეტებით პროდუქტის, რაოდენობისა და ფასისთვის

სიზუსტე დიდწილად დამოკიდებულია იმაზე, თუ როგორ არის განლაგებული ორიგინალი PDF — მარტივი ცხრილები ცხადი სვეტთაშორისი დაშორებით სუფთად გარდაიქმნება, ხოლო მკვრივი ან არარეგულარულად დაშორებული ცხრილები შესაძლოა ხელით გასუფთავებას საჭიროებდეს.

ხშირად დასმული კითხვები

რატომ არის ჩემი ზოგიერთი სვეტი გაერთიანებული ან არასწორად გაყოფილი?

ეს ინსტრუმენტი სვეტების საზღვრებს ითვალისწინებს PDF-ის ტექსტურ ფენაში სიტყვებს შორის ჰორიზონტალური დაშორების მიხედვით — მას არ აქვს წვდომა PDF-ის ორიგინალურ ცხრილის სტრუქტურაზე (PDF-ების უმეტესობა ასეთს არც ინახავს). თუ სვეტები ერთმანეთთან ახლოსაა ან ცხრილი უჩვეულო დაშორებას იყენებს, ვარაუდი შეიძლება არასწორი აღმოჩნდეს. გადახედეთ შედეგს და საჭიროების შემთხვევაში ხელით დაზუსტეთ.

მუშაობს ეს სკანირებულ PDF-ებზე?

არა. ეს ინსტრუმენტი კითხულობს PDF-ში ჩაშენებულ ტექსტურ ფენას; სკანირებული დოკუმენტები უბრალოდ სურათებია და მათგან ტექსტის გამოტანა შეუძლებელია. ჯერ გაუშვით PDF OCR ინსტრუმენტი ტექსტური ფენის დასამატებლად, შემდეგ კი გამოიყენეთ ეს გადამყვანი.

იტვირთება ჩემი PDF სერვერზე?

არა. როგორც ტექსტის გამოტანა, ისე Excel ფაილის შექმნა ხდება ლოკალურად, თქვენს ბრაუზერში, JavaScript-ის მეშვეობით. თქვენი ფაილი არასდროს ტოვებს თქვენს მოწყობილობას.

შეინარჩუნებს ეს ორიგინალი ცხრილის უჯრედების ფორმატირებას, ფერებს ან გაერთიანებულ უჯრედებს?

არა. შედეგი არის უბრალო ტექსტი ბადეში დაწყობილი — ორიგინალი PDF-ის შრიფტები, ფერები, საზღვრები და გაერთიანებული უჯრედები არ გადმოდის.

დაკავშირებული ხელსაწყოები