Mis see tööriist on?
See tööriist loeb PDF-i tekstikihti (faili manustatud tegelikku, valitavat ja kopeeritavat teksti — mitte pilti) ning ehitab selle uuesti üles Wordi dokumendina, kusjuures iga tuvastatud rida muutub lõiguks ja iga algse PDF-i lehekülje vahele lisatakse leheküljevahetus. See on kasulik, kui sul on tekstipõhine PDF — aruanne, artikkel, eksporditud dokument — ning pead teksti kopeerima, redigeerima või taaskasutama ilma kõike uuesti trükkimata.
Ausalt öeldes on see teksti eraldamise tööriist, mitte paigutust säilitav konverter: see ei taasloo mitmeveerulisi paigutusi, tabeleid, päiseid/jaluseid, kindlaid fonte ega manustatud pilte täpselt sellisena, nagu need PDF-is välja nägid. Kui sinu PDF on skaneeritud pilt (foto või skann ilma aluseks oleva tekstikihita), ei leia see tööriist ühtegi eraldatavat teksti — enne on vaja OCR-tööriista, mis pildilt teksti tuvastaks.
Miks seda kasutada?
- Muudab staatilise PDF-i teksti sekunditega redigeeritavaks Wordi dokumendiks, ilma ümbertrükkimata.
- Töötab täielikult võrguühenduseta sinu brauseris — PDF-faili ei laadita kunagi üles ühtegi serverisse.
- Tasuta, ilma registreerimiseta, ilma leheküljepiiranguta peale selle, millega sinu brauser hakkama saab.
- Aus oma piirangute suhtes: eraldab teksti, selle asemel et teeselda algse paigutuse täiuslikku taasloomist.
Kuidas kasutada
- Klõpsa kastil või lohista PDF-fail selle peale.
- Oota, kuni tekst eraldatakse ja Wordi dokument genereeritakse.
- Klõpsa allalaadimisnuppu, et salvestada .docx-fail.
Näide
Sisend
report.pdf — 3-leheküljeline tekstidokumentTulemus
report.docx — redigeeritav Wordi fail eraldatud tekstiga, kus algse 3 lehekülje vahelised leheküljevahetused on säilitatudIga tekstirida muutub Wordi dokumendis lõiguks; algset visuaalset paigutust, fonte ega manustatud pilte ei taasesitata.
Korduma kippuvad küsimused
Kas see säilitab minu PDF-i täpse vorminduse?
Ei, mitte täpselt. See tööriist eraldab tekstisisu ja ehitab selle uuesti üles tavaliste lõikudena uues Wordi dokumendis, koos leheküljevahetustega algsete lehekülgede vahel. See ei taasloo mitmeveerulisi paigutusi, tabeleid, kindlaid fonte, päiseid/jaluseid ega manustatud pilte. Kui vajad piksliprofiili säilitavat paigutust, ei ole see õige tööriist — see on loodud tekstisisu eraldamiseks ja redigeerimiseks.
Miks öeldakse, et minu PDF-ist ei leitud teksti?
See juhtub siis, kui sinu PDF on skaneeritud pilt — sisuliselt lehekülje foto ilma aluseks oleva valitava tekstikihita, ainult pikslid. See tööriist loeb PDF-i juba manustatud tekstiandmeid; see ei tee OCR-i (optiline tähemärgituvastus), et lugeda teksti pildilt. Skaneeritud pildi tekstiks teisendamiseks vajad kõigepealt OCR-tööriista.
Kas minu PDF laaditakse serverisse üles?
Ei. Kogu teisendus — PDF-i lugemine ja Wordi faili genereerimine — toimub kohalikult sinu brauseris JavaScripti abil. Sinu fail ei lahku kunagi sinu seadmest, mistõttu on seda ohutu kasutada isiklike või tundlike dokumentidega.
Millises failivormingus fail alla laaditakse?
Standardne .docx-fail, mis ühildub Microsoft Wordi, Google Docsi, LibreOffice Writeri ja teiste Office Open XML vormingut toetavate tekstitöötlusprogrammidega.
Kas ma saan teisendada parooliga kaitstud PDF-i?
Ei, praegu mitte — see tööriist ei tööta krüpteeritud ega parooliga kaitstud PDF-idega. Enne teisendamist peaksid parooli kaitse eemaldama PDF-redaktoriga.