Ağırlıklandırılmış Çizgelerde Tf-Idf ve Eigen Ayrışımı Kullanarak Metin Sınıflandırma
dc.contributor.author | UÇKAN, Taner | |
dc.contributor.author | HARK, Cengiz | |
dc.contributor.author | SEYYARER, Ebubekir | |
dc.contributor.author | KARCI, Ali | |
dc.date.accessioned | 2024-03-12T06:11:35Z | |
dc.date.available | 2024-03-12T06:11:35Z | |
dc.date.issued | 2019 | |
dc.identifier.issn | 2147-3129 | |
dc.identifier.uri | http://dspace.beu.edu.tr:8080/xmlui/handle/123456789/14472 | |
dc.description.abstract | Günümüzde gerek metin gerekse cümle sınıflandırma problemleri üzerinde yoğunlukla çalışılmaktadır. Metin sınıflandırma işlemlerinde en önemli problemlerden biri sınıflandırılacak metinlerin yapısal olmamasıdır. Belli bir formata sahip olmayan metinlerin öncelikle bir önişlemden geçirilmesi gerekmektedir. Bu çalışmada metinleri sınıflandırma işleminde öncelikle sınıflandırılacak metinlerin önişlemini yapmak amacıyla KUSH (Karci-UçkanSeyyarer-Hark) adında bir önişleme aracı geliştirildi. Sonrasında elde edilen işlenmiş metinlerin sınıflandırılmasında çizge tabanlı matematiksel bir yaklaşım sunulmaktadır. Yapılan çalışmada Türkiye’de iyi bilinen 6 haber portalından ve 6 farklı alandan elde edilen metinleri içeren TTC-3600 veri seti kullanılmaktadır. Sınıflandırılacak metinler Tf (Terim frekansı) ve Idf (Ters doküman Frekansı) değerleri dikkate alınarak çeşitli önişlemlerden geçirildikten sonra kenar ve düğümlerden oluşan bir ağırlıklı çizge oluşturulmaktadır. Ağırlıklandırılmış çizgeler kullanılarak sınıflandırma işleminin etkililiği ve matematiksel verimliliği arttırılmıştır. Elde edilen çizgeyi ifade eden Komşuluk Matrisi ve Derece Matrisi kullanılarak Laplace Matrisi elde edilmektedir. Laplace Matrisinin özdeğer ayrışımı sonucunda elde edilen özdeğer ve özdeğer vektörleri ile metinler sınıflandırılmaktadır. Yapılan testler sonucunda sınıflandırma oranlarında dikkate değer bir doğruluk değerine ulaşıldığı görülmektedir. | tr_TR |
dc.language.iso | Turkish | tr_TR |
dc.publisher | Bitlis Eren Üniversitesi | tr_TR |
dc.rights | info:eu-repo/semantics/openAccess | tr_TR |
dc.subject | Çizge Bölümleme, | tr_TR |
dc.subject | Metin Sınıflandırma, | tr_TR |
dc.subject | Öz Vektörler, | tr_TR |
dc.subject | TTC-3600, | tr_TR |
dc.subject | Tf-Idf | tr_TR |
dc.title | Ağırlıklandırılmış Çizgelerde Tf-Idf ve Eigen Ayrışımı Kullanarak Metin Sınıflandırma | tr_TR |
dc.type | Article | tr_TR |
dc.identifier.issue | 4 | tr_TR |
dc.relation.journal | Bitlis Eren Üniversitesi Fen Bilimleri Dergisi | tr_TR |
dc.identifier.volume | 8 | tr_TR |