Co je tento nástroj?
Tento nástroj čte textovou vrstvu PDF (skutečný, vybratelný a kopírovatelný text vložený v souboru — nikoli obrázek) a znovu ji sestaví jako nový dokument Word, přičemž každý rozpoznaný řádek se stane odstavcem a mezi jednotlivými původními stránkami PDF se vloží zalomení stránky. Hodí se, když máte textové PDF — zprávu, článek, exportovaný dokument — a potřebujete text zkopírovat, upravit nebo znovu použít, aniž byste vše přepisovali.
Upřímně řečeno, jde o nástroj pro extrakci textu, nikoli o konvertor zachovávající rozvržení: nedokáže přesně obnovit vícesloupcová rozvržení, tabulky, záhlaví/zápatí, konkrétní písma ani vložené obrázky tak, jak vypadaly v PDF. Pokud je vaše PDF naskenovaným obrázkem (fotografie nebo sken bez podkladové textové vrstvy), tento nástroj v něm žádný text k extrakci nenajde — nejprve byste potřebovali nástroj OCR, který text z obrázku rozpozná.
Proč ho používat?
- Během několika sekund promění text statického PDF v upravitelný dokument Word, bez přepisování.
- Pracuje zcela offline ve vašem prohlížeči — PDF soubor se nikdy nenahrává na žádný server.
- Zdarma, bez registrace, bez omezení počtu stránek nad rámec toho, co zvládne váš prohlížeč.
- Upřímný ohledně svých limitů: extrahuje text, místo aby předstíral dokonalé obnovení původního rozvržení.
Jak se používá
- Klikněte na pole nebo na něj přetáhněte soubor PDF.
- Počkejte, než se text extrahuje a vygeneruje se dokument Word.
- Kliknutím na tlačítko stažení uložte soubor .docx.
Příklad
Vstup
report.pdf — třístránkový textový dokumentVýstup
report.docx — upravitelný soubor Word s extrahovaným textem, se zachovanými zalomeními stránek mezi původními 3 stránkamiKaždý řádek textu se v dokumentu Word stane odstavcem; původní vizuální rozvržení, písma a jakékoli vložené obrázky se nereprodukují.
Časté dotazy
Zachová tento nástroj přesné formátování mého PDF?
Ne, přesně ne. Tento nástroj extrahuje textový obsah a znovu ho sestaví jako obyčejné odstavce v novém dokumentu Word, se zalomeními stránek mezi původními stránkami. Nedokáže obnovit vícesloupcová rozvržení, tabulky, konkrétní písma, záhlaví/zápatí ani vložené obrázky. Pokud potřebujete zachování rozvržení na pixel přesně, není to správný nástroj — je určen pro extrakci a úpravu textového obsahu.
Proč se zobrazuje, že v mém PDF nebyl nalezen žádný text?
To se stává, když je vaše PDF naskenovaným obrázkem — v podstatě fotografií stránky bez podkladové vybratelné textové vrstvy, jen pixely. Tento nástroj čte textová data, která už jsou v PDF vložena; neprovádí OCR (optické rozpoznávání znaků), aby přečetl text z obrázku. Nejprve byste potřebovali nástroj OCR pro převod naskenovaného obrázku na text.
Nahrává se moje PDF na server?
Ne. Celý proces převodu — čtení PDF a generování souboru Word — probíhá lokálně ve vašem prohlížeči pomocí JavaScriptu. Váš soubor nikdy neopustí vaše zařízení, takže je bezpečné jej používat i pro soukromé nebo citlivé dokumenty.
Jaký formát souboru se stahuje?
Standardní soubor .docx, kompatibilní s Microsoft Word, Google Docs, LibreOffice Writer a dalšími textovými procesory podporujícími formát Office Open XML.
Mohu převést PDF chráněné heslem?
Ne, momentálně to nejde — tento nástroj nezvládá šifrovaná ani heslem chráněná PDF. Před převodem byste museli nejprve odstranit ochranu heslem pomocí editoru PDF.