Mi ez az eszköz?
Ez az eszköz beolvassa a PDF szövegrétegét (a fájlba ágyazott, ténylegesen kijelölhető és másolható szöveget — nem képet), és új Word dokumentumként építi fel újra, ahol minden felismert sor bekezdéssé válik, és az eredeti PDF egyes oldalai közé oldaltörés kerül. Hasznos, ha szöveges alapú PDF-ed van — jelentés, cikk, exportált dokumentum —, és a szöveget másolnod, szerkesztened vagy újrahasznosítanod kell anélkül, hogy mindent újra begépelnél.
Őszintén szólva ez egy szövegkinyerő eszköz, nem elrendezésmegőrző konverter: nem hozza létre pontosan a többhasábos elrendezéseket, táblázatokat, fejléceket/lábléceket, konkrét betűtípusokat vagy beágyazott képeket úgy, ahogy azok a PDF-ben megjelentek. Ha a PDF-ed beszkennelt kép (fotó vagy szkennelés, alatta futó szövegréteg nélkül), ez az eszköz nem talál benne kinyerhető szöveget — előbb OCR-eszközre lesz szükséged, amely felismeri a szöveget a képről.
Miért érdemes használni?
- Egy statikus PDF szövegét másodpercek alatt szerkeszthető Word dokumentummá alakítja, újragépelés nélkül.
- Teljesen offline működik a böngésződben — a PDF fájl soha nem kerül feltöltésre semmilyen szerverre.
- Ingyenes, regisztráció nélkül, oldalszámkorlát nélkül, azon kívül, amit a böngésződ el tud viselni.
- Őszinte a korlátaival kapcsolatban: szöveget nyer ki, ahelyett hogy azt színlelné, tökéletesen visszaadja az eredeti elrendezést.
Használati útmutató
- Kattints a mezőre, vagy húzz rá egy PDF fájlt.
- Várj, amíg a szöveg kinyerésre kerül, és elkészül a Word dokumentum.
- Kattints a letöltés gombra a .docx fájl mentéséhez.
Példa
Bemenet
report.pdf — egy 3 oldalas szöveges dokumentumKimenet
report.docx — szerkeszthető Word fájl a kinyert szöveggel, az eredeti 3 oldal közötti oldaltörések megtartásávalMinden szövegsor bekezdéssé válik a Word dokumentumban; az eredeti vizuális elrendezés, betűtípusok és bármilyen beágyazott kép nem jelenik meg újra.
Gyakori kérdések
Megőrzi ez az eszköz a PDF-em pontos formázását?
Nem, nem pontosan. Ez az eszköz kinyeri a szöveges tartalmat, és egyszerű bekezdésekként építi fel újra egy új Word dokumentumban, az eredeti oldalak közötti oldaltörésekkel. Nem hozza létre újra a többhasábos elrendezéseket, táblázatokat, konkrét betűtípusokat, fejléceket/lábléceket vagy beágyazott képeket. Ha pixelpontos elrendezésmegőrzésre van szükséged, ez nem a megfelelő eszköz — a szöveges tartalom kinyerésére és szerkesztésére készült.
Miért írja azt, hogy nem talált szöveget a PDF-emben?
Ez akkor fordul elő, ha a PDF-ed beszkennelt kép — lényegében egy oldal fotója, alatta futó, kijelölhető szövegréteg nélkül, csak pixelek. Ez az eszköz a PDF-be már beágyazott szöveges adatokat olvassa be; nem végez OCR-t (optikai karakterfelismerést) a kép szövegének kiolvasásához. OCR-eszközre lesz szükséged, hogy a beszkennelt képet előbb szöveggé alakítsd.
Feltöltésre kerül a PDF-em egy szerverre?
Nem. A teljes átalakítás — a PDF beolvasása és a Word fájl létrehozása — helyben, a böngésződben történik JavaScript segítségével. A fájlod soha nem hagyja el az eszközödet, így biztonságosan használható magánjellegű vagy érzékeny dokumentumokhoz is.
Milyen fájlformátumot tölt le?
Egy szabványos .docx fájlt, amely kompatibilis a Microsoft Worddal, a Google Docsszal, a LibreOffice Writerrel és más, az Office Open XML formátumot támogató szövegszerkesztőkkel.
Átalakíthatok jelszóval védett PDF-et?
Nem, jelenleg nem — ez az eszköz nem kezeli a titkosított vagy jelszóval védett PDF-eket. Az átalakítás előtt előbb el kell távolítanod a jelszavas védelmet egy PDF-szerkesztővel.