Kas ir šis rīks?
Šis rīks nolasa PDF teksta slāni (faktisko, iezīmējamo un kopējamo tekstu, kas iegults failā — nevis attēlu) un no jauna izveido to kā jaunu Word dokumentu, kur katra atpazītā rinda kļūst par rindkopu, un starp katru oriģinālo PDF lappusi tiek ievietots lappuses pārtraukums. Tas noder, ja jums ir uz tekstu balstīts PDF — atskaite, raksts, eksportēts dokuments — un jums jākopē, jārediģē vai atkārtoti jāizmanto teksts, neievadot visu no jauna.
Godīgi sakot, šis ir teksta izgūšanas rīks, nevis izkārtojumu saglabājošs konvertētājs: tas precīzi neatveidos vairāku kolonnu izkārtojumus, tabulas, galvenes/kājenes, konkrētus fontus vai iegultos attēlus tā, kā tie izskatījās PDF failā. Ja jūsu PDF ir skenēts attēls (fotoattēls vai skenējums bez pamatā esoša teksta slāņa), šis rīks neatradīs tekstu, ko izgūt — vispirms jums būs vajadzīgs OCR rīks, kas atpazīst tekstu no attēla.
Kāpēc to izmantot?
- Dažu sekunžu laikā pārvērš statiska PDF tekstu par rediģējamu Word dokumentu, neko no jauna neievadot.
- Darbojas pilnībā bezsaistē jūsu pārlūkprogrammā — PDF fails nekad netiek augšupielādēts nevienā serverī.
- Bezmaksas, bez reģistrācijas, bez lappušu ierobežojuma, izņemot to, ko spēj apstrādāt jūsu pārlūkprogramma.
- Godīgs par saviem ierobežojumiem: izgūst tekstu, nevis izliekas, ka perfekti atveido oriģinālo izkārtojumu.
Kā to lietot
- Noklikšķiniet uz lodziņa vai ievelciet tajā PDF failu.
- Uzgaidiet, kamēr teksts tiek izgūts un tiek izveidots Word dokuments.
- Noklikšķiniet uz lejupielādes pogas, lai saglabātu .docx failu.
Piemērs
Ievade
report.pdf — 3 lappušu teksta dokumentsIzvade
report.docx — rediģējams Word fails ar izgūto tekstu, saglabājot lappušu pārtraukumus starp oriģinālajām 3 lappusēmKatra teksta rinda Word dokumentā kļūst par rindkopu; oriģinālais vizuālais izkārtojums, fonti un jebkādi iegultie attēli netiek atveidoti.
Biežāk uzdotie jautājumi
Vai šis rīks saglabās precīzu mana PDF formatējumu?
Nē, ne precīzi. Šis rīks izgūst teksta saturu un no jauna izveido to kā vienkāršas rindkopas jaunā Word dokumentā, ar lappušu pārtraukumiem starp oriģinālajām lappusēm. Tas neatveido vairāku kolonnu izkārtojumus, tabulas, konkrētus fontus, galvenes/kājenes vai iegultos attēlus. Ja jums nepieciešama pikseļu precizitātes izkārtojuma saglabāšana, šis nav pareizais rīks — tas veidots teksta satura izgūšanai un rediģēšanai.
Kāpēc rādīts, ka manā PDF failā nav atrasts teksts?
Tas notiek, ja jūsu PDF ir skenēts attēls — būtībā lappuses fotoattēls bez pamatā esoša iezīmējama teksta slāņa, tikai pikseļi. Šis rīks nolasa teksta datus, kas jau iegulti PDF failā; tas neveic OCR (optisko rakstzīmju atpazīšanu), lai nolasītu tekstu no attēla. Jums būs vajadzīgs OCR rīks, lai vispirms pārvērstu skenēto attēlu par tekstu.
Vai mans PDF tiek augšupielādēts serverī?
Nē. Viss konvertēšanas process — PDF nolasīšana un Word faila izveide — notiek lokāli jūsu pārlūkprogrammā, izmantojot JavaScript. Jūsu fails nekad nepamet jūsu ierīci, tāpēc to droši var izmantot ar privātiem vai sensitīviem dokumentiem.
Kāds faila formāts tiek lejupielādēts?
Standarta .docx fails, kas saderīgs ar Microsoft Word, Google Docs, LibreOffice Writer un citiem teksta apstrādes rīkiem, kas atbalsta Office Open XML formātu.
Vai varu konvertēt ar paroli aizsargātu PDF?
Nē, pašlaik ne — šis rīks nespēj apstrādāt šifrētus vai ar paroli aizsargātus PDF failus. Pirms konvertēšanas jums vispirms būtu jānoņem paroles aizsardzība, izmantojot PDF redaktoru.