Ce este acest instrument?
Acest instrument citește stratul de text al unui PDF (textul real, selectabil și copiabil, încorporat în fișier — nu o imagine) și îl reconstruiește ca document Word nou, fiecare linie detectată devenind un paragraf, cu un salt de pagină inserat între fiecare pagină originală a PDF-ului. Este util atunci când aveți un PDF bazat pe text — un raport, un articol, un document exportat — și trebuie să copiați, editați sau reutilizați textul fără a-l retasta în întregime.
Sincer vorbind, acesta este un instrument de extragere a textului, nu un convertor care păstrează aspectul: nu va recrea aspecte pe mai multe coloane, tabele, antete/subsoluri, fonturi specifice sau imagini încorporate exact așa cum apăreau în PDF. Dacă PDF-ul dvs. este o imagine scanată (o fotografie sau un scan fără un strat de text de bază), acest instrument nu va găsi niciun text de extras — veți avea nevoie mai întâi de un instrument OCR care să recunoască textul din imagine.
De ce să-l folosești?
- Transformă textul unui PDF static într-un document Word editabil în câteva secunde, fără retastare.
- Funcționează complet offline, în browserul dvs. — fișierul PDF nu este niciodată încărcat pe niciun server.
- Gratuit, fără înregistrare, fără limită de pagini, în afară de ceea ce poate gestiona browserul dvs.
- Sincer în privința limitărilor sale: extrage text, în loc să pretindă că recreează perfect aspectul original.
Cum se folosește
- Faceți clic pe casetă sau trageți un fișier PDF pe ea.
- Așteptați în timp ce textul este extras și documentul Word este generat.
- Faceți clic pe butonul de descărcare pentru a salva fișierul .docx.
Exemplu
Intrare
report.pdf — un document text de 3 paginiRezultat
report.docx — un fișier Word editabil cu textul extras, cu salturile de pagină dintre cele 3 pagini originale păstrateFiecare linie de text devine un paragraf în documentul Word; aspectul vizual original, fonturile și orice imagini încorporate nu sunt reproduse.
Întrebări frecvente
Va păstra acest instrument formatarea exactă a PDF-ului meu?
Nu, nu exact. Acest instrument extrage conținutul text și îl reconstruiește ca paragrafe simple într-un document Word nou, cu salturi de pagină între paginile originale. Nu recreează aspecte pe mai multe coloane, tabele, fonturi specifice, antete/subsoluri sau imagini încorporate. Dacă aveți nevoie de păstrarea exactă a aspectului la nivel de pixel, acesta nu este instrumentul potrivit — este construit pentru extragerea și editarea conținutului text.
De ce apare mesajul că nu a fost găsit text în PDF-ul meu?
Acest lucru se întâmplă atunci când PDF-ul dvs. este o imagine scanată — practic o fotografie a unei pagini fără un strat de text selectabil de bază, doar pixeli. Acest instrument citește datele text deja încorporate în PDF; nu efectuează OCR (recunoaștere optică a caracterelor) pentru a citi text dintr-o imagine. Veți avea nevoie de un instrument OCR pentru a converti mai întâi imaginea scanată în text.
Este PDF-ul meu încărcat pe un server?
Nu. Întreaga conversie — citirea PDF-ului și generarea fișierului Word — are loc local, în browserul dvs., folosind JavaScript. Fișierul dvs. nu părăsește niciodată dispozitivul dvs., ceea ce face sigură utilizarea sa cu documente private sau sensibile.
Ce format de fișier este descărcat?
Un fișier .docx standard, compatibil cu Microsoft Word, Google Docs, LibreOffice Writer și alte procesoare de text care acceptă formatul Office Open XML.
Pot converti un PDF protejat cu parolă?
Nu, momentan nu — acest instrument nu gestionează PDF-uri criptate sau protejate cu parolă. Ar trebui să eliminați mai întâi protecția prin parolă folosind un editor PDF, înainte de conversie.