Какво представлява този инструмент?
Този инструмент чете текстовия слой на PDF файла (действителния, избираем и копируем текст, вграден във файла — не изображение) и го изгражда наново като Word документ, като всеки открит ред става абзац, а между отделните страници на оригиналния PDF се вмъква прекъсване на страница. Полезен е, когато разполагате с текстов PDF — отчет, статия, експортиран документ — и трябва да копирате, редактирате или използвате текста повторно, без да го въвеждате наново.
Честно казано, това е инструмент за извличане на текст, а не конвертор, който запазва оформлението: той няма да пресъздаде многоколонни оформления, таблици, горни/долни колонтитули, конкретни шрифтове или вградени изображения точно както изглеждат в PDF файла. Ако вашият PDF е сканирано изображение (снимка или скан без залегащ текстов слой), инструментът няма да намери текст за извличане — първо ще ви трябва инструмент за OCR, който да разпознае текста от изображението.
Защо да го използвате?
- Превръща текста на статичен PDF в редактируем Word документ за секунди, без препечатване.
- Работи изцяло офлайн във вашия браузър — PDF файлът никога не се качва на сървър.
- Безплатен е, без регистрация, без ограничение за брой страници освен това, което браузърът ви може да обработи.
- Честен относно ограниченията си: извлича текст, вместо да се преструва, че пресъздава перфектно оригиналното оформление.
Как да го използвате
- Кликнете върху полето или плъзнете PDF файл върху него.
- Изчакайте, докато текстът бъде извлечен и Word документът генериран.
- Кликнете бутона за изтегляне, за да запазите .docx файла.
Пример
Вход
report.pdf — текстов документ с 3 странициРезултат
report.docx — редактируем Word файл с извлечения текст, като прекъсванията на страници между оригиналните 3 страници са запазениВсеки ред текст става абзац в Word документа; оригиналното визуално оформление, шрифтовете и вградените изображения не се възпроизвеждат.
Често задавани въпроси
Ще запази ли инструментът точното форматиране на моя PDF?
Не, не съвсем точно. Този инструмент извлича текстовото съдържание и го изгражда наново като обикновени абзаци в нов Word документ, с прекъсвания на страници между оригиналните страници. Той не пресъздава многоколонни оформления, таблици, конкретни шрифтове, горни/долни колонтитули или вградени изображения. Ако ви е нужно запазване на оформлението пиксел по пиксел, това не е подходящият инструмент — той е създаден за извличане и редактиране на текстово съдържание.
Защо се появява съобщение, че в моя PDF не е намерен текст?
Това се случва, когато вашият PDF е сканирано изображение — по същество снимка на страница без залегащ избираем текстов слой, само пиксели. Този инструмент чете текстови данни, вече вградени в PDF файла; той не извършва OCR (оптично разпознаване на символи), за да прочете текст от изображение. Ще ви трябва инструмент за OCR, за да конвертирате първо сканираното изображение в текст.
Качва ли се моят PDF на сървър?
Не. Цялото преобразуване — четенето на PDF файла и генерирането на Word файла — се извършва локално във вашия браузър чрез JavaScript. Файлът ви никога не напуска устройството ви, което прави инструмента безопасен за използване с лични или чувствителни документи.
Какъв формат файл се изтегля?
Стандартен .docx файл, съвместим с Microsoft Word, Google Docs, LibreOffice Writer и други текстообработващи програми, поддържащи формата Office Open XML.
Мога ли да конвертирам PDF, защитен с парола?
Не, засега не — този инструмент не работи с криптирани или защитени с парола PDF файлове. Ще трябва първо да премахнете защитата с парола с помощта на PDF редактор, преди да пристъпите към конвертиране.