On Saturday 20 March 2010 12:03:15 Ali E.İMREK wrote: > Tesseract'a Türkçe anlatmaya çalışıyorum son bir iki haftadır. Şu ana > kadar Tesseract'ı Xsane arayüzüyle birleştirmeyi başardım, Türkçe'de > kullanılan karakterlerle .box dosyası yaptım. Geriye kalan Türkçe'de en > çok kullanılan kelimeler listesini bulup işlemek kaldı gibi gözüküyor. > İngilizce OCR olarak > kullanıldığında çok başarılı, gerek komut satırından gerek XSane ile. > Türkçe'de çok kullanılan kelimelerle ilgili bir kitap var fakat > kelimeler listesi bulamadım. Bulabilen varsa ve bir bağlantı [link] > verebilirse, lütfen > versin. Böyle bir dosyayı kullanarak ilerletmek mümkün.
Zemberek geliştiricileri konuya yakındır diye düşünüyorum, bir iletişime geçseniz. İyi fikir. Teşekkürler. Bu arada wiktionary'de bir liste [1] buldum, iyi aramamışım demekki. İlkin bu listeyle yola devam edeyim, eğer başarırsam daha detaylı bir liste için rahatsız ederim onları. Değer [1] http://en.wiktionary.org/wiki/Wiktionary:Frequency_lists/Turkish _______________________________________________ Pardus-kullanicilari e-posta listesi Listeden çıkmak için http://liste.pardus.org.tr/mailman/listinfo/pardus-kullanicilari adresini kullanın. Listeye iletmek istediğiniz soruları [email protected] e-posta adresine gönderin. Liste mesajlarında arama yapmak için http://liste.pardus.org.tr/arama web sayfasına gidin.
