Що це за інструмент?
Цей інструмент читає текстовий шар PDF (справжній, вибірний і копійований текст, вбудований у файл — а не зображення) і відтворює його як новий документ Word, при цьому кожен розпізнаний рядок стає абзацом, а між кожною оригінальною сторінкою PDF вставляється розрив сторінки. Це корисно, коли у вас є текстовий PDF — звіт, стаття, експортований документ — і вам потрібно скопіювати, відредагувати чи повторно використати текст, не набираючи все заново.
Чесно кажучи, це інструмент для витягування тексту, а не конвертер, що зберігає макет: він не відтворить точно багатоколонкові макети, таблиці, верхні/нижні колонтитули, конкретні шрифти чи вбудовані зображення такими, якими вони виглядали в PDF. Якщо ваш PDF — це скановане зображення (фото чи скан без базового текстового шару), цей інструмент не знайде тексту для витягування — спочатку вам знадобиться інструмент OCR, який розпізнає текст із зображення.
Навіщо його використовувати?
- Перетворює текст статичного PDF на редагований документ Word за лічені секунди, без повторного набору.
- Працює повністю офлайн у вашому браузері — файл PDF ніколи не завантажується на жоден сервер.
- Безкоштовний, без реєстрації, без обмеження кількості сторінок, окрім того, що здатен обробити ваш браузер.
- Чесний щодо своїх обмежень: витягує текст, а не вдає, що ідеально відтворює оригінальний макет.
Як користуватися
- Натисніть на поле або перетягніть на нього файл PDF.
- Зачекайте, поки текст буде витягнуто, а документ Word — згенеровано.
- Натисніть кнопку завантаження, щоб зберегти файл .docx.
Приклад
Введення
report.pdf — текстовий документ на 3 сторінкиРезультат
report.docx — редагований файл Word із витягнутим текстом, зі збереженими розривами сторінок між оригінальними 3 сторінкамиКожен рядок тексту стає абзацом у документі Word; оригінальний візуальний макет, шрифти та будь-які вбудовані зображення не відтворюються.
Часті запитання
Чи збереже цей інструмент точне форматування мого PDF?
Ні, не точно. Цей інструмент витягує текстовий вміст і відтворює його як звичайні абзаци в новому документі Word, з розривами сторінок між оригінальними сторінками. Він не відтворює багатоколонкові макети, таблиці, конкретні шрифти, верхні/нижні колонтитули чи вбудовані зображення. Якщо вам потрібне точне до пікселя збереження макета, це не той інструмент — він створений для витягування та редагування текстового вмісту.
Чому пишеться, що в моєму PDF не знайдено тексту?
Це трапляється, коли ваш PDF — це скановане зображення — по суті, фотографія сторінки без базового вибірного текстового шару, лише пікселі. Цей інструмент читає текстові дані, вже вбудовані в PDF; він не виконує OCR (оптичне розпізнавання символів), щоб прочитати текст із зображення. Вам знадобиться інструмент OCR, щоб спочатку перетворити скановане зображення на текст.
Чи завантажується мій PDF на сервер?
Ні. Уся конвертація — читання PDF і створення файлу Word — відбувається локально у вашому браузері за допомогою JavaScript. Ваш файл ніколи не залишає ваш пристрій, що робить безпечним його використання з приватними чи конфіденційними документами.
Який формат файлу завантажується?
Стандартний файл .docx, сумісний із Microsoft Word, Google Docs, LibreOffice Writer та іншими текстовими редакторами, які підтримують формат Office Open XML.
Чи можу я конвертувати PDF, захищений паролем?
Ні, наразі ні — цей інструмент не працює із зашифрованими або захищеними паролем PDF-файлами. Спершу вам потрібно буде зняти захист паролем за допомогою редактора PDF, перш ніж конвертувати.