Hvad er dette værktøj?
Værktøjet læser tekstlaget i en PDF (den faktiske, markérbare og kopierbare tekst, der er indlejret i filen — ikke et billede) og genopbygger den som et nyt Word-dokument, hvor hver registreret linje bliver et afsnit, og der indsættes et sideskift mellem hver original PDF-side. Det er nyttigt, når du har en tekstbaseret PDF — en rapport, en artikel, et eksporteret dokument — og skal kopiere, redigere eller genbruge teksten uden at skrive alt om.
For at være ærlig er dette et tekstudtrækningsværktøj og ikke en layout-bevarende konverter: det genskaber ikke flerkolonne-layout, tabeller, sidehoveder/sidefødder, bestemte skrifttyper eller indlejrede billeder præcis som de så ud i PDF'en. Hvis din PDF er et scannet billede (et foto eller scan uden et underliggende tekstlag), finder værktøjet ingen tekst at udtrække — du skal først bruge et OCR-værktøj til at genkende teksten fra billedet.
Hvorfor bruge det?
- Omdanner teksten i en statisk PDF til et redigerbart Word-dokument på få sekunder, uden at du skal skrive noget om.
- Fungerer helt offline i din browser — PDF-filen bliver aldrig uploadet til nogen server.
- Gratis, uden tilmelding, uden sidegrænse ud over det, din browser kan klare.
- Ærlig om sine begrænsninger: udtrækker tekst i stedet for at foregive at genskabe det oprindelige layout perfekt.
Sådan bruger du det
- Klik på feltet, eller træk en PDF-fil hen på det.
- Vent, mens teksten udtrækkes, og Word-dokumentet genereres.
- Klik på downloadknappen for at gemme .docx-filen.
Eksempel
Input
report.pdf — et tekstdokument på 3 siderOutput
report.docx — en redigerbar Word-fil med den udtrukne tekst, hvor sideskiftene mellem de originale 3 sider er bevaretHver tekstlinje bliver et afsnit i Word-dokumentet; det oprindelige visuelle layout, skrifttyper og eventuelle indlejrede billeder gengives ikke.
Ofte stillede spørgsmål
Bevarer værktøjet den nøjagtige formatering af min PDF?
Nej, ikke præcist. Værktøjet udtrækker tekstindhold og genopbygger det som almindelige afsnit i et nyt Word-dokument med sideskift mellem de originale sider. Det genskaber ikke flerkolonne-layout, tabeller, bestemte skrifttyper, sidehoveder/sidefødder eller indlejrede billeder. Har du brug for pixelperfekt layoutbevarelse, er dette ikke det rette værktøj — det er bygget til at udtrække og redigere tekstindhold.
Hvorfor står der, at der ikke blev fundet tekst i min PDF?
Det sker, når din PDF er et scannet billede — i bund og grund et foto af en side uden et underliggende, markérbart tekstlag, kun pixels. Værktøjet læser eksisterende tekstdata indlejret i PDF'en; det udfører ikke OCR (optisk tegngenkendelse) for at læse tekst fra et billede. Du skal bruge et OCR-værktøj til først at konvertere det scannede billede til tekst.
Bliver min PDF uploadet til en server?
Nej. Hele konverteringen — læsning af PDF'en og generering af Word-filen — foregår lokalt i din browser ved hjælp af JavaScript. Din fil forlader aldrig din enhed, hvilket gør det sikkert at bruge med private eller følsomme dokumenter.
Hvilket filformat downloades der?
En standard .docx-fil, der er kompatibel med Microsoft Word, Google Docs, LibreOffice Writer og andre tekstbehandlere, der understøtter Office Open XML-formatet.
Kan jeg konvertere en adgangskodebeskyttet PDF?
Nej, ikke i øjeblikket — værktøjet håndterer ikke krypterede eller adgangskodebeskyttede PDF-filer. Du skal først fjerne adgangskodebeskyttelsen med et PDF-redigeringsværktøj, før du konverterer.