On Saturday 20 March 2010 12:03:15 Ali E.İMREK wrote:
   > Tesseract'a Türkçe anlatmaya çalışıyorum son bir iki haftadır. Şu ana
   > kadar Tesseract'ı Xsane arayüzüyle birleştirmeyi başardım,  Türkçe'de
   > kullanılan karakterlerle .box dosyası yaptım. Geriye kalan Türkçe'de en
   > çok kullanılan kelimeler listesini bulup işlemek kaldı gibi gözüküyor.
   > İngilizce OCR olarak
   > kullanıldığında çok başarılı, gerek komut satırından gerek XSane ile.
   > Türkçe'de çok kullanılan kelimelerle ilgili bir kitap var fakat
   > kelimeler listesi bulamadım. Bulabilen varsa ve bir bağlantı [link]
   > verebilirse, lütfen
   > versin. Böyle bir dosyayı kullanarak ilerletmek mümkün.

   Zemberek geliştiricileri konuya yakındır diye düşünüyorum, bir iletişime
   geçseniz.

İyi fikir. Teşekkürler. Bu arada wiktionary'de bir liste [1] buldum, iyi 
aramamışım demekki. İlkin bu listeyle yola devam edeyim, eğer başarırsam daha 
detaylı bir liste için rahatsız ederim onları.

Değer

[1] http://en.wiktionary.org/wiki/Wiktionary:Frequency_lists/Turkish
_______________________________________________
Pardus-kullanicilari e-posta listesi
Listeden çıkmak için 
http://liste.pardus.org.tr/mailman/listinfo/pardus-kullanicilari adresini 
kullanın.
Listeye iletmek istediğiniz soruları  [email protected] 
e-posta adresine gönderin.
Liste mesajlarında arama yapmak için http://liste.pardus.org.tr/arama web 
sayfasına gidin.

Cevap