Công Cụ Này Là Gì?
Công cụ này đọc lớp văn bản của PDF (văn bản thực, có thể chọn và sao chép, được nhúng trong file — không phải hình ảnh) và dựng lại thành một tài liệu Word mới, mỗi dòng được phát hiện trở thành một đoạn văn và một dấu ngắt trang được chèn giữa mỗi trang PDF gốc. Điều này hữu ích khi bạn có một file PDF dạng văn bản — một báo cáo, một bài viết, một tài liệu được xuất ra — và cần sao chép, chỉnh sửa hoặc sử dụng lại nội dung mà không phải gõ lại toàn bộ.
Thành thật mà nói, đây là công cụ trích xuất văn bản, không phải công cụ chuyển đổi giữ nguyên bố cục: nó sẽ không tái tạo chính xác bố cục nhiều cột, bảng biểu, tiêu đề đầu/cuối trang, phông chữ cụ thể hay hình ảnh nhúng như chúng xuất hiện trong PDF. Nếu file PDF của bạn là ảnh quét (một bức ảnh hoặc bản quét không có lớp văn bản bên dưới), công cụ này sẽ không tìm thấy văn bản nào để trích xuất — bạn cần một công cụ OCR trước để nhận dạng văn bản từ hình ảnh.
Tại Sao Nên Dùng?
- Biến văn bản trong một PDF tĩnh thành tài liệu Word có thể chỉnh sửa chỉ trong vài giây, không cần gõ lại.
- Hoạt động hoàn toàn ngoại tuyến ngay trên trình duyệt của bạn — file PDF không bao giờ được tải lên bất kỳ máy chủ nào.
- Miễn phí, không cần đăng ký, không giới hạn số trang ngoài khả năng xử lý của trình duyệt bạn.
- Trung thực về giới hạn của nó: công cụ trích xuất văn bản chứ không giả vờ tái tạo hoàn hảo bố cục gốc.
Cách Sử Dụng
- Nhấp vào ô hoặc kéo một file PDF vào đó.
- Chờ trong khi văn bản được trích xuất và tài liệu Word được tạo ra.
- Nhấp vào nút tải xuống để lưu file .docx.
Ví dụ
Đầu vào
baocao.pdf — tài liệu văn bản 3 trangĐầu ra
baocao.docx — file Word có thể chỉnh sửa với văn bản đã trích xuất, giữ nguyên các dấu ngắt trang giữa 3 trang gốcMỗi dòng văn bản trở thành một đoạn văn trong tài liệu Word; bố cục hình ảnh gốc, phông chữ và bất kỳ hình ảnh nhúng nào đều không được tái tạo.
Câu Hỏi Thường Gặp
Công cụ này có giữ nguyên định dạng chính xác của file PDF của tôi không?
Không, không hoàn toàn chính xác. Công cụ này trích xuất nội dung văn bản và dựng lại thành các đoạn văn đơn giản trong một tài liệu Word mới, có ngắt trang giữa các trang gốc. Nó không tái tạo bố cục nhiều cột, bảng biểu, phông chữ cụ thể, tiêu đề đầu/cuối trang hay hình ảnh nhúng. Nếu bạn cần giữ nguyên bố cục chính xác đến từng điểm ảnh, đây không phải là công cụ phù hợp — nó được xây dựng để trích xuất và chỉnh sửa nội dung văn bản.
Tại sao công cụ báo không tìm thấy văn bản nào trong PDF của tôi?
Điều này xảy ra khi file PDF của bạn là ảnh quét — về cơ bản là ảnh chụp một trang giấy không có lớp văn bản có thể chọn bên dưới, chỉ toàn điểm ảnh. Công cụ này đọc dữ liệu văn bản đã có sẵn được nhúng trong PDF; nó không thực hiện OCR (nhận dạng ký tự quang học) để đọc văn bản từ hình ảnh. Bạn cần một công cụ OCR để chuyển ảnh quét thành văn bản trước.
File PDF của tôi có được tải lên máy chủ không?
Không. Toàn bộ quá trình chuyển đổi — đọc file PDF và tạo file Word — diễn ra cục bộ ngay trên trình duyệt của bạn bằng JavaScript. File của bạn không bao giờ rời khỏi thiết bị của bạn, điều này giúp việc sử dụng với các tài liệu riêng tư hoặc nhạy cảm trở nên an toàn.
File tải xuống có định dạng gì?
Một file .docx tiêu chuẩn, tương thích với Microsoft Word, Google Docs, LibreOffice Writer và các phần mềm soạn thảo văn bản khác hỗ trợ định dạng Office Open XML.
Tôi có thể chuyển đổi file PDF được bảo vệ bằng mật khẩu không?
Không, hiện tại chưa được — công cụ này không xử lý file PDF được mã hóa hoặc bảo vệ bằng mật khẩu. Bạn cần gỡ bỏ bảo vệ mật khẩu trước bằng một trình chỉnh sửa PDF trước khi chuyển đổi.