CodeKitHub
Bahasa Indonesia
Alat Gambar

Foto Halaman Buku ke Teks

Ubah foto halaman buku menjadi teks yang bisa diedit dan dicari — dibuat khusus untuk foto asli buku sungguhan, bukan pindaian dokumen rata. Kebanyakan alat OCR mengasumsikan pindaian yang sejajar sempurna; alat ini secara otomatis mendeteksi dan mengoreksi sudut miring yang muncul saat memotret halaman dengan tangan, lalu mengenali teksnya. Semuanya berjalan di peramban Anda: foto dan hasil ekstraksi teks tidak pernah meninggalkan perangkat Anda.

Cara Menggunakan

  1. Ambil foto halaman buku — usahakan seluruh halaman masuk dalam bingkai, tapi jangan khawatir soal memegang kamera secara sempurna sejajar.
  2. Klik atau seret foto ke area unggah.
  3. Biarkan "Koreksi kemiringan otomatis" tercentang (aktif secara default) dan pilih bahasa halaman.
  4. Klik "Ekstrak teks" — alat ini akan meluruskan gambar terlebih dahulu, lalu mengenali teksnya.
  5. Salin hasilnya atau unduh sebagai file .txt.

Contoh

Input

Foto ponsel dari halaman buku saku terbuka, dipegang dengan sudut sekitar 10°

Output

Kemiringan terdeteksi: -10,5° → teks diekstrak dengan struktur paragraf yang tetap terjaga

Tanpa langkah pelurusan, foto dengan sudut seperti ini biasanya kehilangan sepertiga katanya akibat salah baca; mengoreksi sudut terlebih dahulu mengembalikan pengenalan mendekati akurasi pemindai.

Apa Itu Alat Ini?

Alat ini mengekstrak teks dari foto buku, buku teks, atau halaman cetak menggunakan OCR (pengenalan karakter optik) yang berjalan sepenuhnya di dalam peramban Anda. Berbeda dengan alat OCR berbasis pemindai, alat ini dibangun khusus untuk masalah foto yang digenggam tangan: halaman yang difoto dengan sudut agak miring, yang hampir tidak bisa dihindari saat Anda memegang ponsel di atas buku terbuka alih-alih menekannya rata pada kaca pemindai.

Sebelum pengenalan dimulai, alat ini menganalisis gambar untuk mendeteksi berapa derajat kemiringannya dari horizontal, lalu meluruskannya secara otomatis. Langkah tunggal ini lebih penting daripada hampir semua hal lain untuk OCR berbasis foto: halaman yang difoto hanya 10-12 derajat dari sejajar bisa menurunkan akurasi pengenalan dari di atas 95% menjadi di bawah 70%, mengubah teks yang jelas terbaca menjadi kacau tak berarti — meluruskan terlebih dahulu memulihkannya mendekati kualitas hasil pemindai.

Mengapa sudut foto lebih penting dari yang Anda kira

Mesin OCR membaca teks dengan memindai baris piksel mencari pita horizontal tinta yang konsisten — begitulah cara mereka memisahkan satu baris teks dari baris berikutnya. Ketika halaman miring bahkan sedikit saja, apa yang seharusnya menjadi garis teks horizontal yang bersih menjadi coretan diagonal di banyak baris piksel, dan logika segmentasi baris mesin mulai menggabungkan karakter dari baris yang berdekatan atau memecah karakter tunggal.

Inilah sebabnya foto yang terlihat sempurna terbaca oleh mata Anda tetap bisa menghasilkan output OCR yang kacau: otak Anda secara otomatis mengompensasi kemiringan kecil, tapi jalur OCR yang naif tidak. Solusinya bukan model pengenalan yang lebih pintar — melainkan meluruskan gambar terlebih dahulu, yang persis dilakukan langkah koreksi otomatis alat ini sebelum pengenalan dijalankan.

Kasus penggunaan umum

  • Mendigitalkan catatan atau kutipan dari buku teks fisik tanpa perlu mengetik ulang secara manual.
  • Mengekstrak bagian dari buku saku lama atau buku perpustakaan untuk dikutip atau dicari nanti.
  • Mengubah handout, lembar kerja, atau artikel cetak yang difoto menjadi teks yang bisa dicari dan diedit.
  • Mengarsipkan halaman dari buku yang mulai rusak atau terlalu rapuh untuk dipindai rata di atas mesin pemindai.

Konverter Gambar ke Seni ASCII · Penghitung Kata

Mendapatkan hasil terbaik

  • Pencahayaan yang baik dan merata lebih penting daripada tangan yang sempurna stabil — foto yang sedikit miring tapi cukup terang mengungguli foto yang sejajar tapi dengan bayangan berat di atas teks.
  • Hindari flash langsung pada halaman mengilap; silau/titik terang yang dihasilkan bisa mengosongkan teks di bawahnya terlepas dari koreksi sudut.
  • Pastikan seluruh halaman masuk dalam bingkai dengan sedikit margin — memotong terlalu ketat bisa memotong baris pertama atau terakhir.
  • Untuk bagian yang sangat panjang, foto dan proses satu halaman pada satu waktu daripada mencoba menangkap sebaran dua halaman sekaligus, yang menimbulkan distorsi lengkung sendiri di dekat punggung buku.

Mengapa Menggunakannya?

Koreksi kemiringan otomatis: mendeteksi dan meluruskan sudut foto yang miring sebelum pengenalan, faktor akurasi terbesar untuk foto buku yang digenggam tangan.

Pemrosesan sepenuhnya offline: foto dan teks hasil ekstraksi tidak pernah meninggalkan peramban Anda — tidak ada yang diunggah ke server.

Berfungsi untuk halaman buku lama, menguning, atau sedikit pudar sama baiknya dengan cetakan modern yang tajam.

Mendukung beberapa bahasa pengenalan (Inggris, Tionghoa, Spanyol, Prancis, Jerman, Jepang) sehingga Anda bisa memindai buku dalam berbagai bahasa.

Tanpa akun, tanpa batas unggahan, tanpa langganan — gratis untuk sebanyak apa pun halaman yang Anda butuhkan.

Pertanyaan yang Sering Diajukan

Mengapa foto buku saya butuh penanganan khusus dibanding OCR biasa?

Alat OCR biasa umumnya diuji dan disetel untuk pindaian yang rata dan sejajar sempurna. Halaman buku yang difoto dengan tangan hampir tidak pernah sejajar — bahkan kemiringan kecil 8-12 derajat, yang normal untuk foto genggam, bisa menjatuhkan akurasi pengenalan jauh di bawah 70%. Alat ini mengukur kemiringan tersebut dan mengoreksinya secara otomatis sebelum menjalankan pengenalan, yang menjadi perbedaan antara teks yang bisa dipakai dan hasil yang kacau.

Apakah ini berfungsi pada halaman buku lama atau menguning?

Ya — perubahan warna halaman dan sedikit penurunan kontras akibat kertas yang menua sangat sedikit memengaruhi akurasi pengenalan dengan sendirinya. Sudut fotolah yang menjadi faktor dominan, bukan warna kertasnya, jadi buku saku lama dan buku teks bekas bekerja hampir sama baiknya dengan yang baru setelah gambar diluruskan.

Apakah foto saya diunggah ke suatu tempat?

Tidak. Baik deteksi kemiringan maupun pengenalan teks berjalan sepenuhnya di peramban Anda menggunakan WebAssembly — tidak ada apa pun tentang foto Anda atau isinya yang dikirim ke server mana pun. Anda bahkan bisa memutuskan koneksi internet setelah halaman dimuat pertama kali dan alat ini akan tetap berfungsi (kecuali pengunduhan satu kali mesin pengenalan).

Bisakah saya mematikan koreksi otomatis jika foto saya sudah lurus?

Bisa, hilangkan centang "Koreksi kemiringan otomatis" jika Anda bekerja dari pindaian rata atau foto yang sudah diluruskan — ini melewati langkah deteksi dan menjalankan pengenalan sedikit lebih cepat.

Mengapa ekstraksi pertama terasa lambat?

Saat pertama kali Anda klik "Ekstrak teks", alat ini mengunduh mesin pengenalan OCR (beberapa megabita, hanya sekali, disimpan cache oleh peramban Anda setelahnya). Setiap ekstraksi setelah itu jauh lebih cepat karena mesinnya sudah dimuat.

Bahasa apa saja yang bisa dikenali?

Inggris, Tionghoa Sederhana, Spanyol, Prancis, Jerman, dan Jepang tersedia di pemilih bahasa. Pilih bahasa yang sesuai dengan bahasa cetakan halaman untuk akurasi terbaik — kualitas pengenalan turun tajam jika bahasa yang dipilih salah.

Alat Terkait