Mikä tämä työkalu on?
Tämä työkalu lukee PDF:n tekstitason (tiedostoon upotetun, todella valittavan ja kopioitavan tekstin — ei kuvaa) ja rakentaa sen uudelleen uudeksi Word-dokumentiksi siten, että jokaisesta havaitusta rivistä tulee kappale ja jokaisen alkuperäisen PDF-sivun väliin lisätään sivunvaihto. Se on hyödyllinen, kun sinulla on tekstipohjainen PDF — raportti, artikkeli, viety dokumentti — ja sinun täytyy kopioida, muokata tai käyttää tekstiä uudelleen kirjoittamatta kaikkea uudestaan.
Rehellisesti sanottuna tämä on tekstinpoimintatyökalu, ei ulkoasun säilyttävä muunnin: se ei toista monipalstaisia asetteluja, taulukoita, ylä-/alatunnisteita, tiettyjä fontteja tai upotettuja kuvia täsmälleen sellaisina kuin ne näkyivät PDF:ssä. Jos PDF-tiedostosi on skannattu kuva (valokuva tai skannaus ilman taustalla olevaa tekstitasoa), tämä työkalu ei löydä siitä tekstiä poimittavaksi — tarvitset ensin OCR-työkalun, joka tunnistaa tekstin kuvasta.
Miksi käyttää sitä?
- Muuttaa staattisen PDF:n tekstin muokattavaksi Word-dokumentiksi sekunneissa, ilman uudelleenkirjoittamista.
- Toimii täysin offline-tilassa selaimessasi — PDF-tiedostoa ei koskaan ladata mihinkään palvelimeen.
- Ilmainen, ei rekisteröitymistä, ei sivumäärärajaa muuta kuin sen, minkä selaimesi kykenee käsittelemään.
- Rehellinen rajoituksistaan: poimii tekstiä sen sijaan, että teeskentelisi toistavansa alkuperäisen ulkoasun täydellisesti.
Käyttöohje
- Napsauta laatikkoa tai vedä PDF-tiedosto sen päälle.
- Odota, kun teksti puretaan ja Word-dokumentti luodaan.
- Napsauta latauspainiketta tallentaaksesi .docx-tiedoston.
Esimerkki
Syöte
report.pdf — 3-sivuinen tekstidokumenttiTuloste
report.docx — muokattava Word-tiedosto, jossa on poimittu teksti ja sivunvaihdot alkuperäisen 3 sivun välissä säilytettyinäJokaisesta tekstirivistä tulee kappale Word-dokumentissa; alkuperäistä visuaalista ulkoasua, fontteja tai upotettuja kuvia ei toisteta.
Usein kysytyt kysymykset
Säilyttääkö tämä työkalu PDF:ni tarkan muotoilun?
Ei, ei täsmälleen. Tämä työkalu poimii tekstisisällön ja rakentaa sen uudelleen tavallisina kappaleina uuteen Word-dokumenttiin, sivunvaihtoineen alkuperäisten sivujen välissä. Se ei toista monipalstaisia asetteluja, taulukoita, tiettyjä fontteja, ylä-/alatunnisteita tai upotettuja kuvia. Jos tarvitset pikselintarkan ulkoasun säilyttämisen, tämä ei ole oikea työkalu — se on rakennettu tekstisisällön poimimiseen ja muokkaamiseen.
Miksi työkalu sanoo, ettei PDF:stäni löytynyt tekstiä?
Näin käy, kun PDF-tiedostosi on skannattu kuva — käytännössä valokuva sivusta ilman taustalla olevaa valittavaa tekstitasoa, pelkkiä pikseleitä. Tämä työkalu lukee PDF:ään jo upotettua tekstidataa; se ei tee OCR:ää (optista merkintunnistusta) tekstin lukemiseksi kuvasta. Tarvitset OCR-työkalun muuntaaksesi skannatun kuvan ensin tekstiksi.
Ladataanko PDF-tiedostoni palvelimelle?
Ei. Koko muunnos — PDF:n lukeminen ja Word-tiedoston luominen — tapahtuu paikallisesti selaimessasi JavaScriptin avulla. Tiedostosi ei koskaan poistu laitteeltasi, mikä tekee siitä turvallisen käyttää yksityisten tai arkaluontoisten dokumenttien kanssa.
Minkä tiedostomuodon lataus tuottaa?
Tavallisen .docx-tiedoston, joka on yhteensopiva Microsoft Wordin, Google Docsin, LibreOffice Writerin ja muiden Office Open XML -muotoa tukevien tekstinkäsittelyohjelmien kanssa.
Voinko muuntaa salasanasuojatun PDF:n?
En, ei tällä hetkellä — tämä työkalu ei käsittele salattuja tai salasanasuojattuja PDF-tiedostoja. Sinun täytyisi ensin poistaa salasanasuojaus PDF-editorilla ennen muuntamista.