Root-suffix seperation of Turkish words


Tezin Türü: Yüksek Lisans

Tezin Yürütüldüğü Kurum: Dokuz Eylül Üniversitesi, Fen Bilimleri Enstitüsü, Bilgisayar Mühendisliği Ana Bilim Dalı, Türkiye

Tezin Onay Tarihi: 2008

Tezin Dili: İngilizce

Öğrenci: ÇAĞDAŞ CAN BİRANT

Danışman: YALÇIN ÇEBİ

Açık Arşiv Koleksiyonu: AVESİS Açık Erişim Koleksiyonu

Özet:

Bir dilin yapısını belirlemek ve bu yapıya bağlı çıkarımlarda bulunmak, o dil hakkında bilgi edinilmesini sağlar. Edinilen bilgilerin otomatize edilmiş methodlarla geniş bir kelime kaynağında denenerek gerçek hayata uygulanması ise yeni fikirlere ve ürünlere sağlam bir alt yapı oluşturmaktadır. Bu altyapının günümüzde kurulması ve genelgeçerliliğe sahip olması için temelinde sağlam bir iskelet ve iskelete bağlı kurallar bütünü bulunması gerekmektedir.Bu çalışmanın amacı, oluşturulabilecek mutlak yapıyı ortaya çıkarmak, bu yapıyı doğruluk payından ödün vermeden yüksek performansla çalışan bir modül olarak hazırlamak ve bu modülün önceki çalışmalarla iş birliği içinde olacak ve gelecekte yapılacak çalışmalara temel olacak şekilde çalışmasını sağlamaktır.Bu çalışma esnasında, Özlem AKTAŞ tarafından geliştirilen cümle sonu bulma algoritması temel alınmış ve doğruluk oranı %99'u bulan bu çalışmanın üzerinde yapılan değişikliklerle kullanılan bazı yapılar standart bir hale getirilmiştir. Bu standardizasyon çalışmaları, öncelikle modüller arası veri geçişini sağlayan XML yapıları üzerinde başlamıştır. Hedeflenen biçimbirimsel çalışma programının sonucu olarak kullanıcıya sunulan ve biçimbirimsel ayrıştırma sırasında ekler arası ardalanma kurallarını içeren dosyalarda XML yapısı kullanılmaktadır. Bu XML yapılarında yer alacak ek çeşitlerinin ise isimleri, belirlenen bir takım kurallar çerçevesinde sistematik olarak kısaltılarak kök ve eklerin etiketlenmesine imkân sağlamıştır.Elde edilen sonuçlar aşama aşama daha net bir şekil almaya başlamıştır. İşlem süresi ise ileride geliştirilecek diğer modüller sayesinde daha da azalacaktır.