Hva er dette verktøyet?
Dette verktøyet leser tekstlaget i en PDF (den faktiske, markerbare og kopierbare teksten som er innebygd i filen — ikke et bilde) og bygger den opp på nytt som et nytt Word-dokument, der hver registrerte linje blir et avsnitt, og det settes inn et sideskift mellom hver original PDF-side. Det er nyttig når du har en tekstbasert PDF — en rapport, en artikkel, et eksportert dokument — og trenger å kopiere, redigere eller gjenbruke teksten uten å skrive alt på nytt.
Ærlig talt er dette et verktøy for tekstuthenting, ikke en konverterer som bevarer oppsettet: det vil ikke gjenskape flerspaltede oppsett, tabeller, topp-/bunntekster, bestemte skrifttyper eller innebygde bilder nøyaktig slik de så ut i PDF-en. Hvis PDF-en din er et skannet bilde (et foto eller en skanning uten et underliggende tekstlag), finner ikke dette verktøyet noen tekst å hente ut — du trenger først et OCR-verktøy som kan gjenkjenne teksten fra bildet.
Hvorfor bruke det?
- Gjør teksten i en statisk PDF om til et redigerbart Word-dokument på sekunder, uten å måtte skrive den på nytt.
- Fungerer helt frakoblet i nettleseren din — PDF-filen blir aldri lastet opp til noen server.
- Gratis, ingen registrering, ingen sidegrense utover det nettleseren din kan håndtere.
- Ærlig om sine begrensninger: henter ut tekst i stedet for å late som om den gjenskaper det opprinnelige oppsettet perfekt.
Slik bruker du det
- Klikk på boksen, eller dra en PDF-fil over den.
- Vent mens teksten hentes ut og Word-dokumentet genereres.
- Klikk på nedlastingsknappen for å lagre .docx-filen.
Eksempel
Inndata
report.pdf — et 3-siders tekstdokumentResultat
report.docx — en redigerbar Word-fil med den uthentede teksten, der sideskiftene mellom de opprinnelige 3 sidene er bevartHver tekstlinje blir et avsnitt i Word-dokumentet; det opprinnelige visuelle oppsettet, skrifttypene og eventuelle innebygde bilder gjengis ikke.
Ofte stilte spørsmål
Vil dette verktøyet bevare den nøyaktige formateringen av PDF-en min?
Nei, ikke nøyaktig. Dette verktøyet henter ut tekstinnholdet og bygger det opp på nytt som vanlige avsnitt i et nytt Word-dokument, med sideskift mellom de opprinnelige sidene. Det gjenskaper ikke flerspaltede oppsett, tabeller, bestemte skrifttyper, topp-/bunntekster eller innebygde bilder. Hvis du trenger pikselnøyaktig bevaring av oppsettet, er dette ikke riktig verktøy — det er laget for å hente ut og redigere tekstinnhold.
Hvorfor står det at det ikke ble funnet tekst i PDF-en min?
Dette skjer når PDF-en din er et skannet bilde — i praksis et fotografi av en side uten et underliggende, markerbart tekstlag, bare piksler. Dette verktøyet leser tekstdata som allerede er innebygd i PDF-en; det utfører ikke OCR (optisk tegngjenkjenning) for å lese tekst fra et bilde. Du trenger et OCR-verktøy for å konvertere det skannede bildet til tekst først.
Blir PDF-en min lastet opp til en server?
Nei. Hele konverteringen — lesing av PDF-en og generering av Word-filen — skjer lokalt i nettleseren din ved hjelp av JavaScript. Filen din forlater aldri enheten din, noe som gjør det trygt å bruke med private eller sensitive dokumenter.
Hvilket filformat lastes ned?
En standard .docx-fil, kompatibel med Microsoft Word, Google Docs, LibreOffice Writer og andre tekstbehandlere som støtter Office Open XML-formatet.
Kan jeg konvertere en passordbeskyttet PDF?
Nei, ikke for øyeblikket — dette verktøyet håndterer ikke krypterte eller passordbeskyttede PDF-er. Du må først fjerne passordbeskyttelsen med et PDF-redigeringsverktøy før du konverterer.