2015'te Pakistan'dan üç arkadaş, kendi kaynaklarıyla Ibteda Digital Library'yi kurdu ve basımından çıkmış Urdu kitaplarını dijitalleştirmeye başladı. Tek bir Nikon D5300, bazı LED ampuller ve bir fotokopi camının cam levhasıyla sayfaları elle çevirip Photoshop ile işlediler; bu süreçte D5300 üzerinde 576.000 ve D3300 üzerinde 326.000 çekim sayısı birikti. El ile Photoshop işlemi yerine bir araştırcı, elle işlenmiş görüntülerini etiket olarak kullanarak OpenCV ile bir sinir ağı modeli eğitti.
Model, Photoshop dosyalarından homografi hesaplayarak kırpma, görünür alan ve gutur ayrımını otomatikleştirerek yeni bir kitap için sadece dieci kalibrasyon kırpması gerektiğini gösterdi. Yoğun Urdu metninin tekrar eden desenleri kırpma sınırlarını zorlaştırırken, tablolar ve derin gutur gölgeleri alan tespiti için ekstra zorluk yaratıyor.
Eğitim verisini artırmak doğruluğu düşürüyor, bu da her kitabın özel kırpma marjının desenli bir kalıp taşımadığını gösteriyor. Kitaplar BLAKE3 imzalı bir ZFS havuzunda saklanıyor ve tüm detaylar uzun bir blog yazısında bulunuyor.
