CodeKitHub
Türkçe
Görsel Araçları

Kitap Sayfasını Metne Dönüştür

Bir kitap sayfasının fotoğrafını düzenlenebilir ve aranabilir metne dönüştürün — bu araç, düz belge taramaları değil, gerçek kitapların gerçek fotoğrafları için özel olarak geliştirilmiştir. Çoğu OCR aracı, taramanın kusursuz bir şekilde hizalanmış olduğunu varsayar; bu araç ise bir sayfayı elle fotoğraflarken ortaya çıkan eğri açıyı otomatik olarak algılar ve düzeltir, ardından metni tanır. Her şey tarayıcınızda gerçekleşir: Fotoğraf ve metin çıkarma işlemi cihazınızın dışına asla çıkmaz.

Nasıl Kullanılır

  1. Kitabın sayfasının bir fotoğrafını çekin — sayfanın tamamını kadraja sığdırmaya çalışın, ancak kamerayı tam olarak düz tutmaya gerek yok.
  2. Fotoğrafı tıklayın veya yükleme alanına sürükleyin.
  3. "Eğriliği otomatik olarak düzelt" seçeneğini işaretli bırakın (varsayılan olarak açıktır) ve sayfanın dilini seçin.
  4. "Metni ayıkla" seçeneğine tıklayın — araç önce görüntüyü düzeltir, ardından metni tanır.
  5. Sonucu kopyalayın veya .txt dosyası olarak indirin.

Örnek

Giriş

A phone photo of an open paperback page, held at roughly a 10° angle

Çıkış

Detected skew: -10.5° → text extracted with full paragraph structure preserved

Eğrilik düzeltme adımı yapılmadığında, bu açıda çekilen bir fotoğrafta kelimelerin genellikle üçte biri yanlış okunma nedeniyle kaybolur; önce açıyı düzeltmek, tanıma doğruluğunu tarayıcı düzeyine yakın bir seviyeye geri getirir.

Bu Araç Nedir?

Bu araç, tamamen tarayıcınızın içinde çalışan OCR (optik karakter tanıma) teknolojisini kullanarak bir kitabın, ders kitabının veya basılı sayfanın fotoğrafından metni ayıklar. Tarayıcı tabanlı OCR araçlarından farklı olarak, bu araç özellikle elle çekilen fotoğrafların yarattığı bir sorunu çözmek üzere tasarlanmıştır: sayfalar hafif bir açıyla fotoğraflanır; bu durum, telefonu tarayıcı camına düz bir şekilde bastırmak yerine açık bir kitabın üzerine tutarken neredeyse kaçınılmazdır.

Tanıma işlemi başlamadan önce, araç görüntüyü analiz ederek yatay düzlemden tam olarak kaç derece döndüğünü tespit eder ve ardından görüntüyü otomatik olarak düzeltir. Fotoğraf tabanlı OCR için bu tek adım, neredeyse diğer her şeyden daha önemlidir: Düzlemden sadece 10-12 derece sapmış bir şekilde fotoğraflanan bir sayfa, tanıma doğruluğunu %95'in üzerindeyken %70'in altına düşürebilir ve açıkça okunabilir metni anlamsız bir karmaşaya dönüştürebilir — eğriliği düzeltme işlemi, metni öncelikle tarayıcı kalitesine yakın sonuçlara geri getirir.

Fotoğraf çekim açısı neden sandığınızdan daha önemli?

OCR motorları, metni tararken piksel satırlarını tarayarak tutarlı yatay mürekkep şeritlerini arar — bir metin satırını bir sonrakinden bu şekilde ayırırlar. Bir sayfa en ufak bir açıyla bile eğildiğinde, düzgün bir yatay metin satırı olması gereken yer, birçok piksel satırına yayılan çapraz bir lekeye dönüşür ve motorun satır bölme mantığı, bitişik satırlardaki karakterleri birleştirmeye veya tek bir karakteri parçalara ayırmaya başlar.

İşte bu yüzden, gözünüze tamamen okunabilir görünen bir fotoğraf bile yine de bozuk bir OCR çıktısı verebilir: Beyniniz hafif bir eğimi zahmetsizce telafi eder, ancak basit bir OCR iş akışı bunu yapamaz. Çözüm, daha akıllı bir tanıma modeli değildir; önce görüntüyü düzeltmektir. Bu araçtaki otomatik düzeltme adımı, tanıma işlemi başlamadan önce tam da bunu yapar.

Yaygın kullanım örnekleri

  • Fiziksel bir ders kitabındaki notları veya alıntıları elle yeniden yazmadan dijital ortama aktarmak.
  • Eski bir ciltsiz kitap veya kütüphane kitabından bir pasajı alıntı yapmak ya da daha sonra araştırmak üzere çıkarmak.
  • Fotoğrafı çekilmiş bir ders notu, çalışma kağıdı veya basılı makaleyi, arama yapılabilir ve düzenlenebilir metne dönüştürmek.
  • Parçalanmakta olan ya da tarayıcının yatağına düz bir şekilde yerleştirilemeyecek kadar kırılgan bir kitaptaki sayfaların arşivlenmesi.

Görüntüden ASCII Sanatı Dönüştürücü · Kelime Sayacı

En iyi sonuçları elde etmek

  • İyi ve eşit bir aydınlatma, mükemmel derecede sabit bir elden daha önemlidir — hafifçe eğri olsa da iyi aydınlatılmış bir fotoğraf, metin üzerinde yoğun gölge bulunan düz bir fotoğraftan daha iyi sonuç verir.
  • Parlak sayfalara doğrudan flaş tutmaktan kaçının; bunun sonucunda ortaya çıkan parlama veya parlak nokta, açı düzeltmesi yapılsa bile altındaki metni okunmaz hale getirebilir.
  • Sayfanın tamamını çerçeveye biraz kenar boşluğu bırakarak sığdırın — çok sıkı kırpmak, ilk veya son satırı kesebilir.
  • Çok uzun bölümlerde, iki sayfayı birden çekmeye çalışmak yerine her seferinde tek bir sayfayı fotoğraflayıp işleyin; aksi takdirde, kitap sırtına yakın bölgede eğrilik kaynaklı bozulmalar ortaya çıkar.

Neden Kullanmalısınız?

Otomatik eğrilik düzeltme: Tanıma işleminden önce eğri çekilmiş fotoğraf açılarını algılar ve düzeltir; bu, el ile çekilen kitap fotoğraflarında doğruluğu etkileyen en önemli faktördür.

Tamamen çevrimdışı işleme: Fotoğraf ve çıkarılan metin tarayıcınızdan asla dışarı çıkmaz — hiçbir şey bir sunucuya yüklenmez.

Eski, sararmış veya hafifçe solmuş kitap sayfalarının yanı sıra, net ve canlı modern baskılar için de uygundur.

Birden fazla tanıma dilini (İngilizce, Çince, İspanyolca, Fransızca, Almanca, Japonca) destekler; böylece farklı dillerde yazılmış kitapları tarayabilirsiniz.

Hesap yok, yükleme sınırı yok, abonelik yok — ihtiyacınız olan kadar sayfa için tamamen ücretsiz.

Sıkça Sorulan Sorular

Kitap fotoğrafım neden normal OCR yerine özel bir işlem gerektiriyor?

Geleneksel OCR araçları genellikle düz ve kusursuz bir şekilde hizalanmış taramalar üzerinde test edilir ve ayarlanır. Elle fotoğraflanan bir kitap sayfası neredeyse hiçbir zaman düz olmaz — el ile çekilen bir fotoğrafta normal sayılabilecek 8-12 derecelik küçük bir eğim bile tanıma doğruluğunu %70'in çok altına düşürebilir. Bu araç, tanıma işlemini başlatmadan önce bu eğimi ölçer ve otomatik olarak düzeltir; bu da okunabilir metin ile bozuk çıktı arasındaki farkı belirler.

Bu yöntem eski veya sararmış kitap sayfalarında işe yarar mı?

Evet — sayfanın renk solması ve eskimiş kağıttan kaynaklanan hafif kontrast kaybı, tek başlarına tanıma doğruluğu üzerinde çok az etkiye sahiptir. Belirleyici faktör fotoğrafın çekim açısıdır, kağıdın rengi değil; bu nedenle, görüntü düzeltildikten sonra eski ciltsiz kitaplar ve kullanılmış ders kitapları da yenileriyle hemen hemen aynı performansı gösterir.

Fotoğrafım herhangi bir yere yüklendi mi?

Hayır. Hem eğrilik algılama hem de metin tanıma işlemleri, WebAssembly kullanılarak tamamen tarayıcınızda gerçekleştirilir — fotoğrafınız veya içeriği ile ilgili hiçbir bilgi herhangi bir sunucuya gönderilmez. Sayfa ilk kez yüklendikten sonra internet bağlantınızı kesseniz bile, sistem çalışmaya devam eder (tanıma motorunun tek seferlik indirilmesi hariç).

Fotoğrafım zaten düzse otomatik düzeltme özelliğini kapatabilir miyim?

Evet, düz bir taramadan veya önceden düzeltmiş olduğunuz bir fotoğraftan çalışıyorsanız, "Eğriliği otomatik olarak düzelt" seçeneğinin işaretini kaldırın — bu, algılama adımını atlar ve tanıma işlemini biraz daha hızlı gerçekleştirir.

İlk çıkarma işlemi neden yavaş oluyor?

"Metni Ayıkla" seçeneğine ilk kez tıkladığınızda, araç OCR tanıma motorunu indirir (birkaç megabayt boyutunda, yalnızca bir kez indirilir ve daha sonra tarayıcınız tarafından önbelleğe alınır). Motor zaten yüklenmiş olduğu için, bundan sonraki her ayıklama işlemi çok daha hızlı gerçekleşir.

Hangi dilleri tanıyabilir?

Dil seçicide İngilizce, Basitleştirilmiş Çince, İspanyolca, Fransızca, Almanca ve Japonca seçenekleri mevcuttur. En yüksek doğruluk için sayfanın gerçekte hangi dilde basıldığını seçin — yanlış dil seçildiğinde tanıma kalitesi önemli ölçüde düşer.

İlgili Araçlar